text-henkan

文字数カウント

入力すると同時に文字数・行数・バイト数を計算します。サーバーに送らないので、下書き中の原稿や社外秘の文章でも安心して貼り付けられます。絵文字やサロゲートペア、結合文字も見た目どおりに数えます。

またはファイルを選ぶ

表示される項目

文字数(コードポイント)、書記素数(見た目の文字数)、UTF-16 コードユニット数、改行を除く文字数、空白を除く文字数、行数、単語数、UTF-8 バイト数、Shift_JIS バイト数、原稿用紙(400 字)換算の枚数を表示します。

「文字数」は 1 種類ではない

「👨‍👩‍👧」は見た目 1 文字ですが、コードポイントでは 5、UTF-16 では 8 と数えられます。「が」を結合文字で書いた場合も、見た目 1 文字・コードポイント 2 です。Twitter の文字数は UTF-16 ベース、Excel の LEN() も UTF-16 ベース、多くのプログラミング言語の len() は言語ごとに異なります。用途に合う数字を見てください。

バイト数が要るとき

データベースの VARCHAR や固定長ファイル、レガシーな帳票システムはバイト数で上限を決めていることがあります。UTF-8 では日本語 1 文字が 3 バイト、Shift_JIS では 2 バイト(半角カナは 1 バイト)です。両方を同時に確認できます。

よくある質問

原稿用紙の換算はどう計算していますか?

改行を除いた文字数を 400(20 字 × 20 行)で割り、切り上げた枚数を表示しています。

絵文字は何文字として数えられますか?

「書記素数」では 1 文字、「文字数(コードポイント)」では絵文字の構成に応じて 1〜数文字、「UTF-16」では 2 以上になります。SNS の文字数制限は UTF-16 を見てください。

テキストは保存されますか?

保存も送信もされません。ページを閉じるとメモリから消えます。

単語数はどう数えていますか?

空白(全角スペースを含む)で区切られたかたまりの数です。日本語は分かち書きしないため、日本語文の単語数はあまり意味を持ちません。

関連ツール

改行コード変換全角 ⇄ 半角重複行削除・並べ替えUnicode 正規化Shift-JIS → UTF-8UTF-8 → Shift-JISEUC-JP → UTF-8UTF-8 → EUC-JP