Conta quante volte compare ogni parola. Una sequenza di cinese, giapponese o coreano resta un solo token, salvo che tu la separi.
Un contatore dice quanto è lungo il testo. Questa pagina dice quali parole si ripetono. La prima riga è il totale. Ogni riga dopo è una parola, un tabulatore e un numero, le più frequenti prima. Lunghezza e frasi restano su contatore di parole.
To e to condividono una riga.北京 è un token. Acceso, 北 e 京 si separano. Hiragana, katakana e hangul seguono lo stesso interruttore.To be, or not to be. e Paris Paris London. Di base, to e be sono 2, e paris è 2.Le parole latine sono lettere e cifre. Un apostrofo dentro la parola resta, quindi don't è un token. Punteggiatura e spazi tagliano. Una sequenza di han, kana o hangul è un token fino a uno spazio o a un’altra scrittura, salvo che separi il CJK. Ignorare le maiuscole mostra la forma minuscola. L’ordine è il conteggio e poi la parola. Ciò che è più corto del minimo esce dall’elenco e dal totale. Anche uno spazio ideografico taglia.
È l’impostazione di partenza. Attiva Conta ogni carattere CJK se vuoi il conto per carattere.
Ignora maiuscole e minuscole è attivo. Spegnilo per tenere la maiuscola su un’altra riga.