単語数をカウント
単語数、文の数、段落数、読むのにかかる時間を、入力に合わせてリアルタイムで表示。単語の間にスペースを入れない言語でも正しく数えます。ほとんどのカウンターはここを間違えます。何も保存されません。
- 保存しません
- 順番待ちなし
- 登録不要・透かしなし
0
単語数
どの言語でも
0
文字数
絵文字は1文字
0
文の数
略語も正しく処理
0
段落数
空行で区切り
- 行数エディターの行番号と同じ数え方
- 0
- 文の数「Dr.」や「etc.」で区切られません
- 0
- 段落数空行で区切られたまとまり
- 0
- コードポイント正規表現の「.」が一致する単位
- 0
- UTF-16単位JavaScriptのstring.lengthが返す値
- 0
- UTF-8バイト数VARCHARの上限やHTTPヘッダーが数える単位
- 0
- 読了時間黙読で1分あたり238語として計算
- —
- スピーチ時間音読で1分あたり150語として計算
- —
- 最長の単語バイト数ではなく文字数で
- —
- 単語の平均読みやすさの大まかな目安
- —
入力を始めると、すべての項目が表示されます。絵文字や中国語の文を試してみてください。どちらも人が数えるとおりに数えます。多くのカウンターはここを間違えます。
使い方
貼り付けまたは入力
テキストファイルをドロップすることもできます。カウントは入力に合わせて更新され、どこにも送信されません。
数値を確認
単語数、文の数、段落数、行数、文字数に加えて、読了時間とスピーチ時間を表示します。
上限をチェック
SEOタイトル、メタディスクリプション、SMSなど、上限に合わせて書いている場合は、あとどれくらい余裕があるかをページに表示します。
何を数え、何が数えているのか
単語数を決めているのは、私たちではありません。 単語はブラウザ自体のUnicode分割機能から得ています。特定のロケールではなく既定のロケールで問い合わせ、単語とみなされた部分を残しています。その上にハイフン、アポストロフィ、数字に関する独自のルールは一切加えていません。得られるのは、単語がどこで始まるかについての分割機能の判断そのものです。だからこそ中国語や日本語でも正しい答えになり、同じテキストでもブラウザや端末によってごくわずかに結果が異なることがあります。分割機能がない古いブラウザでは、空白で区切る方法に切り替えて、数値が概算であることをお知らせします。単純なカウンターは、何も言わずに常にこの数値を出しています。
段落と行は独自のルールで数えますが、その2つのルールは同じではありません。段落の区切りは空行、つまりスペースやタブ以外に何もない2つの改行です。そのため、CR(キャリッジリターン)が残ったままのWindowsのテキストファイルをドロップすると、全体が1段落と数えられます。 テキストボックスはLF(改行)で渡すため、ボックスに貼り付けたテキストではこの問題は起きません。行はエディターの行番号と同じように数えます。空のボックスは0行、1単語なら1行で、改行で終わるファイルは最後の空行も数えます。これは、行末記号の数を返すコマンドラインのwcとは、あえて異なる数え方です。
数値をめぐる疑問の多くは、2つの細かな判断で解決します。「空白を除く」文字数では、ブラウザが空白とみなすものをすべて除きます。Webページからコピーしたテキストに含まれるノーブレークスペースも除かれますが、ゼロ幅スペースは空白ではないので数に残ります。また、最長の単語と単語の平均の長さは、メインの文字数で使う書記素クラスターではなくコードポイントで測ります。そのため、絵文字や結合アクセントを含む単語は、見た目より長く表示されます。頻度表では、よく使われる約60個の英語の機能語を、表示を選ばない限り非表示にします。また、どの言語で書いていても、大文字・小文字は英語の単純なルールでそろえます。
ほかの目的には
特定のプログラムで判定されるなら、意味があるのはそのプログラムの数値だけです。 「参考文献を含めて8,000語」とする学術誌が意味しているのはWordが出す数値で、Wordはフィールド、脚注、図表番号、テキストボックスを独自の設定に従って数えています。このページの数値は一般的な文章ならほぼ一致しますが、1語単位では一致しません。提出するときは、このページではなく、判定に使われるツールの数値に合わせてください。
複数の文書を数えるなら、シェルで1行です。wc -wはフォルダー全体を一度に処理でき、メモリより大きなファイルもストリーミングで扱えます。Markdown、HTML、LaTeXなら、先にpandocでプレーンテキストに変換するとマークアップが取り除かれ、コードブロック、リンク先、タグが本文として数えられなくなります。リポジトリの単語数と本当の単語数の差はそこにあります。どちらも、400個のファイルを貼り付けボックスで処理することはできません。
よくある質問
テキストはどこかに保存されますか?
いいえ。何も保存されず、通信も一切発生しないので、ネットワークを切断しても動作し続けます。テキストの場合、これは見た目以上に重要です。オンラインのカウンターに貼り付けられるのは、未発表の原稿、法律文書の下書き、学生の課題、社内文書だからです。
中国語、日本語、タイ語でも使えますか?
はい。これこそが、ほとんどのカウンターとの一番の違いです。これらの言語は単語の間にスペースを入れないため、空白で区切るという一般的な実装では、中国語の記事全体が1単語と数えられてしまいます。このツールはブラウザのUnicode単語分割(UAX #29アルゴリズム)を使っており、あらゆる文字体系で単語が実際にどこで始まりどこで終わるかを把握しています。中国語のテキストをこのページとほかのカウンターに並べて貼り付けてみてください。違いはすぐに分かります。
読了時間はどのように計算していますか?
黙読は1分あたり238語、音読は1分あたり150語で単語数を割っています。238という数値は、ブログ記事の間で引用し合われている200や250といった切りのいい数字ではなく、成人の黙読に関する190件の研究をまとめたBrysbaertの2019年のメタ分析に基づいています。一般的な文章での平均値なので、専門的で密度の高い文章なら遅く、なじみのある話題なら速くなります。
何を1文として数えますか?
文はピリオド、疑問符、感嘆符で終わります。ただし、敬称や略語の後は除きます。「We met Dr. Smith on Monday.」は2文ではなく1文です。ブラウザ自体の分割機能はここを間違えますが、このページでは補正しています。「Bring pens, paper, etc. and we will start」も1文ですが、同じ語句の後に大文字が続けば2文になります。
何を1段落として数えますか?
空行で区切られたテキストのまとまりです。改行のたびに段落と数えると、住所の各行がそれぞれ1段落になってしまいます。ほかのツールと数値が異なるのはこのためです。
Word文書やPDFの単語数も数えられますか?
直接はできません。テキストを貼り付けるか、先にPDFテキスト抽出ツールを使って結果を貼り付けてください。このページはテキストを対象にしており、だからこそ瞬時に動き、外部に送らずに処理できます。
Microsoft Wordと単語数が違うのはなぜですか?
たいていはハイフンと数字が原因です。Wordは「well-known」を1語と数え、このページも同じですが、2語と数えるツールもあります。ここでは、単独の数字、日付、記号も、数字か文字を含んでいれば単語として扱います。一般的な文章なら両者はほぼ一致しますが、部品番号のリストでは一致しません。
ご注意: 読了時間とスピーチ時間は一般的な文章での平均値です。専門的で密度の高い文章なら遅く、なじみのある話題なら速くなるため、約束ではなく目安としてお使いください。カウントにはブラウザのUnicode分割機能を使います。この機能がない古いブラウザでは推定値になり、その旨をページに表示します。
このツールをあなたのサイトに設置
ブログ、授業のページ、ヘルプ記事などに無料で設置できます。コードを1つ貼り付けるだけで、訪問者がそのページ上でツールを使えるようになります。