词频统计器
编辑、学生和 SEO 团队经常需要快速查看一篇草稿里哪些词重复最多。粘贴文本,选择最小词长和显示行数,即可得到按频率排序的表格,包含出现次数和密度。统计在浏览器中完成,会合并大小写,并可复制 CSV。中文没有天然空格分词,如果要按词精确统计,请先用空格分好词,或把结果当作初步线索再人工核对。
如何统计词频
-
1
粘贴文本
可以是一段文字、一篇文章或较长草稿。样本越长,模式越稳定。
-
2
设置限制
选择最小词长,以及结果排名中显示的行数。
-
3
统计词语
工具识别字母、数字和撇号,统一大小写后统计完全相同的 token。
-
4
复制 CSV
查看高频项,然后把词、次数和密度列复制到你的工作流程中。
结果示例
一篇 1,500 词左右的营销文章,最小长度设置为 4 时:
| 排名 | 词 | 次数 | 占总数比例 |
|---|---|---|---|
| 1 | marketing | 47 | 3.13% |
| 2 | campaign | 38 | 2.53% |
| 3 | audience | 29 | 1.93% |
| 4 | 27 | 1.80% |
如果你预期的核心词没有出现在前几行,草稿可能还不够聚焦。如果某个无意重复的填充词排得很高,就值得优先修改。
如何看待 SEO 关键词密度
把密度当作提示信号,而不是固定 SEO 公式:
- 主关键词自然出现时,通常 1-2% 左右已经足够。
- 主题讲清楚的情况下,次要词可以更低。
- 完全相同的 token 超过 3%,如果是硬塞进去的,读起来可能重复。
- 搜索引擎比这个简单计数器更懂变体和语境,因此复数、同义词和相关短语仍要人工检查。
内容质量、搜索意图匹配和有用覆盖,比重复同一个关键词更重要。
精确 token 统计说明
- 不区分大小写:
Marketing和marketing会合并统计。 - 不会删除停用词,不做词干提取,也不做词形还原。
- 最小长度是隐藏短词的主要过滤方式。
- 中文、日文和泰文通常没有词间空格。若需要真正的词级频率,请先分词或用空格隔开关键词。
常见用途
- 修改重复表达。 找出让草稿显得啰嗦的口头词或高频词。
- 内容审计。 在电子表格中比较多篇文章,查看哪些主题占比过高。
- 学术写作。 确认核心概念在引言之后仍然持续出现。
- SEO 检查。 查看目标词、品牌名和产品名是否以自然频率出现。
常见问题
字数统计给出一个总数,例如 1,500 词。词频统计会显示每个词出现多少次,例如 “marketing” 出现 47 次。
不会。这个版本会在最小长度过滤后统计完全相同的 token。如果想隐藏大量短功能词,请提高最小长度。
可以,适合作为快速检查。把结果当作信号,然后再通读文本,确认关键词使用自然且有帮助。
不会。分词、统计和 CSV 生成都在你的浏览器中完成。
相关工具
坏链检查器
抓取单个页面(或小型站点地图),并按 HTTP 状态标记每个坏链。快速检查并检测重定向链。
规范URL验证器
检查谷歌识别的任意页面的标准URL,检测HTML链接标签、HTTP链接头、冲突以及重定向链路。
外链锚文本分析器
粘贴外链、CSV 行、URL | 锚文本组合或纯锚文本行,统计重复项并导出 Anchor Text,Count,Share CSV。
Breadcrumb Schema 生成器
为任意页面层级生成有效的 BreadcrumbList JSON-LD。输出可直接粘贴到网站 head 中的 schema.org 标记。
规范标签生成器
生成有效的 `rel=canonical` 链接标签,包含对应的 HTTP 链接头信息以及需避免的常见错误。
XML 站点地图检查器
在浏览器中检查站点地图 XML,发现解析错误、缺少地址、重复 URL 以及常用站点地图字段值问题。