关键词密度分析工具(词频统计)
在本地统计字符、词数、句长与可读性,并把占比算法直接写在表格里;对不适用于中文的指标会明确说明原因,而不是假装给出了中文分词结果。
词数 = 英文单词数 + 中文字符数:没有词典时,单个汉字是唯一可信的最小单位。
Flesch 分数不适用于中文:它假定文字以空格分词并依赖音节计数。中文请参考下方的「平均每句字符数」。
这里没有英文单词,中文内容请查看「高频字组」表。
本表只统计英文单词。中文没有空格,因此放在下方的「高频字组」表中。
按当前筛选条件没有可显示的词条。
词组只在同一个句子内部统计,不会跨越句号拼接。
按当前筛选条件没有可显示的词条。
与两词词组规则相同:同句内统计,允许相互重叠。
按当前筛选条件没有可显示的词条。
这是二元、三元字符组视图,不是分词结果。没有词典就无法正确切分中文词,因此对连续的中文片段按 2 字、3 字逐组统计;以停用字开头的字组会被忽略。
占比 = 该词出现次数 ÷ 全文词数。词组之间会共用同一批文字,所以词组列的百分比不会加起来等于 100%。
使用方法
- 粘贴正文或页面源码,点「从 HTML 提取正文」,输入框下方会说明剥离标签与脚本共去掉多少字符。
- 查看指标卡:字符数、词数、句子数、平均句长与不重复英文单词数,以及中文句长对应的可读性档位。
- 点「去除停用词」和「仅显示 ≥2 次」两个开关过滤噪音,四张表会同步重新筛选。
- 点击表头可按词条、出现次数或占比排序,再点「复制表格」把当前可见行以制表符文本粘贴进表格软件。
常见问题
关键词密度多少才算健康?
不存在目标百分比。Google 从未用密度阈值判断主题相关性,为了凑比例反复堆词只会让行文生硬。应当把这份报告当作描述性数据:确认定义主题的词的频次足以证明页面确实在讲这件事,它们自然地出现在标题和小标题中,并且没有哪个词占比高到明显堆砌。正常写成的页面,核心词的占比通常落在 0.5%–2% 左右。
它能直接读取线上网页吗?
不能,本工具不发起任何请求。请把文本粘贴进来,或把页面源码贴进来并点「从 HTML 提取正文」:统计前会剔除 script、style、noscript、template、svg,并显示被剥离的字符数,好让总数依然可以解释。
为什么词组表的占比加起来不等于 100%?
因为每一行都是独立计算的:占比 = 该词条出现次数 ÷ 全文词数,而词组之间会共用同一批文字。例如「seo audit」和「seo audit report」两行统计的是同一处文字,本来就相互重叠,所以永远不会加满 100%。只有单词表勉强可以看总量,且剩下的词同样没有被计入。