词频统计

统计每个词出现的次数。中文、日文、韩文默认连在一起算一个词,也可以按字拆开。

哪些词出现过、出现几次

字数统计告诉你文章有多长。这一页告诉你哪些词重复。第一行是合计,后面每一行是词、制表符、次数,次数多的在前。长度、句子和阅读时间仍在 字数统计。

怎么用

  1. 贴上文字。忽略大小写默认开启,所以 To 和 to 算同一行。
  2. 中日韩按字计数默认关闭。北京 这种连续汉字算一个词。打开后 北 和 京 分开计。平假名、片假名、韩文也跟着这个开关。
  3. 最短长度会丢掉比这个字数更短的词,默认是 1。
  4. 显示示例会载入 To be, or not to be. 和 Paris Paris London。默认下 to、be 各 2 次,paris 是 2 次。

什么算一个词

英文词由字母和数字组成。词中的撇号会保留,所以 don't 是一个词。标点和空格会切开。连续的汉字、假名或韩文,直到空白或其他文字为止,算一个词;打开按字计数才会拆开。忽略大小写时,显示的是小写形式。排序先看次数,再看词本身。短于最短长度的词不会出现在列表里,也不计入合计。全角空格会把中文词切开。

什么时候用

  • 改稿之前先看哪些词特别多。
  • 确认地名「北京」被贴了两次,是一个词而不是两个字。
  • 把最短长度调高,去掉单字母噪声。

常见问题

北京只有一行,不是两个字。

这是默认。若要按字计,打开「中日韩按字计数」。空格仍然会分开词。

The 和 the 合并了。

忽略大小写开着。关掉就会分成两行。