詞頻統計

統計每個詞出現的次數。中文、日文、韓文預設連在一起算一個詞,也可以按字拆開。

哪些詞出現過、出現幾次

字數統計告訴你文章有多長。這一頁告訴你哪些詞重複。第一行是合計,後面每一行是詞、定位字元、次數,次數多的在前。長度、句子和閱讀時間仍在 字數統計。

怎麼用

  1. 貼上文字。忽略大小寫預設開啟,所以 To 和 to 算同一列。
  2. 中日韓按字計數預設關閉。北京 這種連續漢字算一個詞。打開後 北 和 京 分開計。平假名、片假名、諺文也跟著這個開關。
  3. 最短長度會丟掉比這個字數更短的詞,預設是 1。
  4. 顯示範例會載入 To be, or not to be. 和 Paris Paris London。預設下 to、be 各 2 次,paris 是 2 次。

什麼算一個詞

英文詞由字母和數字組成。詞中的撇號會保留,所以 don't 是一個詞。標點和空格會切開。連續的漢字、假名或諺文,直到空白或其他文字為止,算一個詞;打開按字計數才會拆開。忽略大小寫時,顯示的是小寫形式。排序先看次數,再看詞本身。短於最短長度的詞不會出現在清單裡,也不計入合計。全形空白會把中文詞切開。

什麼時候用

  • 改稿之前先看哪些詞特別多。
  • 確認地名 北京 被貼了兩次,是一個詞而不是兩個字。
  • 把最短長度調高,去掉單字母雜訊。

常見問題

北京只有一列,不是兩個字。

這是預設。若要按字計,打開「中日韓按字計數」。空白仍然會分開詞。

The 和 the 合併了。

忽略大小寫開著。關掉就會分成兩列。