1200 語を貼ると、テキストカウンターが 7 つの質問に一度で答える:語数、スペース有りの文字数と無しの文字数、文数、段落数、行数、そして 1 分 200 語で 6 分の読み時間、130 語で 10 分の話し時間。横の文字カウントはもう一段深い:上位 10 文字と、大文字・小文字・数字・記号・空白の 5 系統への分解。両方とも完全にブラウザ内で動作し、送信は無い。
2 つのツール、2 種の質問
テキストカウンターはページの摘要:7 個の数字の箱に、大文字・小文字・タイトルケース・センテンスケースのワンクリック変換 4 種。文字カウントは構成レポート:同じコア計数に、読み時間と話し時間、空白の集計、5 系統の文字分解、出現の多い上位 10 文字のランキングを加える。投稿前のざっと確認には 7 枚のカードで十分、どの文字かどの語が多用されているかを問う段階では、文字カウントと単語出現頻度が詳細を持つ。
語数と文字数の差はどこから
語は連続空白で切られる。だから全英単語文 the quick brown fox jumps over the lazy dog は 9 語、スペース有り 43 文字、無し 35 文字。句読点は語尾に付き、語を始めない。2 種の文字数の差は正確に空白である。さらに CJK の境界がある:中日韓のテキストはスペースを含まないので、200 字の 1 段落は 1 語として読め、CJK では文字数こそが正直な長さの口径になる。文字種変換はカウンターを動かさない:the、THE、The は同重なので、大文字小文字変換を経ようが内蔵ボタンを使おうが、変わるは外見であり、長さではない。
読みは 200、話しは 130
読み時間は語数を 200 で割って切り上げ、下限 1 分:1200 語はちょうど 6、1300 語は 7、1300 / 200 = 6.5 を切り上げるため。話し時間は 130 で割り、プレゼンのペース:1200 語で 9.23、切り上げて 10 分。だから 10 分の講演原稿は 1300 語前後、2 分のブログ冒頭は 400 語前後に落ちる。2 種のレートは文字カウントに並置され、原稿は読み予算と話し予算の双方に同時に照合できる。
上位 10 と 5 系統の分解
空白を除き、残り全文字に計数、頻度でソート:上位 10 がランキングになる。英語散文では通常 e が先頭、次は t、a、o。5 系統の分解は各文字を大文字・小文字・数字・記号・空白に分類し、罠がある:a-z、A-Z、0-9 の外はすべて記号なので、中日韓の文、絵文字、ドイツ語の変音記号はすべて記号の箱に入る。分解を純度ゲージと読む:清潔なラテン文字の段落は巨大な小文字の帯とほぼゼロの記号の帯、単位や電話番号、ハッシュタグだらけのテキストは逆転する。
文字数制限が効く理由
計数は上限に会う場所である。ツイートは 280 文字の上限、商品タイトルは数百文字、AI プロンプトは画像モデルと動画モデルで変わる硬い予算。AI 画像プロンプトガイドは文字数予算の中で組む、スタイルとカメラ用語が同じ 75 から 200 文字の余白を競う。AI 動画プロンプトガイドはより長い動き重視の説明で同じ算術を行う。カウンターは API がペイロードを拒否する前に教えてくれる:形容詞を削れ、主体を削るな。
計数が本当に測っているもの
文字数は貼り付けた文字列の長さであり、貼り付けは 2 つのものを隠し得る。1 つはマークアップ:リッチエディタからの貼り付けはタグを連れてくる、<b>hi</b> は 10 文字と数えられるが、見えるのは hi のみ、HTML フォーマットガイドはその層を見つけて剥ぐ方法を示す。2 つはエンコーディング:長さは UTF-16 コード単位で数えるので、😀 のような絵文字は 1 グリフでも数では 2 を取り、UTF-8 では 4 バイト、テキストからバイナリへガイドは同じコードポイントをバイト単位で歩く。2 つの間で、カウンターは文字列の保存形態を忠実に報告する、受け側が測るのもまさにそれだ。