字元 / 字數統計

字元 / 字數統計

統計字元(含/不含空白)、字、行、中日韓漢字與 UTF-8 位元組

瀏覽器本地計算

輸入或粘貼文本即可實時統計。核對字段限制時,先確認目標要求是字符數、字節數還是平台自己的計數方式。

字符數(含空白)0
字符數(不含空白)0
詞組數0
行數0
漢字數(CJK 統一表意文字)0
字節數(UTF-8)0

範例

輸入

A中
B

示例結果

碼點數:4 · 非空白字符數:3 · 行數:2 · UTF-8 字節數:6

換行佔一個碼點和一個 UTF-8 字節;“中”佔三個字節。

技術細節與邊界

字符數通過碼點迭代計算,字節數通過 TextEncoder 的 UTF-8 編碼計算,兩者通常不同。組合附加符和連字序列可能由多個碼點組成。詞數按連續字母、數字及連接符統計,不是中文分詞;漢字計數覆蓋代碼中列出的常用及擴展範圍,不是全部 Unicode 漢字版本。

關於此工具

實時統計文本的 Unicode 碼點數、非空白字符、詞組、行數、漢字與 UTF-8 字節數。用於核對字段長度、接口字節限制和內容規模,並說明不同計數口徑。

適用場景

  • 發佈或提交文本前核對字符數量;目標平台可能採用不同的計數規則,應再按其規則確認。
  • 估算中英混排文字在資料庫佔多少位元組。
  • 快速看一份 CSV 有多少行、是否有空行。

注意事項

詞組按連續的 Unicode 字母、數字、下划線及部分連接符統計,不做自然語言分詞。連續中文可能只算一個詞組,中文字數請查看漢字欄。字節數按 UTF-8 計算。

常見問題

為甚麼一整句中文只統計為一個詞?
詞數統計連續字母和數字,而不是自然語言分詞。連續漢字可形成一個詞組;需要中文字數時請看漢字或碼點欄目。
`\n` 會算成 1 個字元嗎?
會算成 1 個字元(空白類)。行數按 `\n` / `\r\n` 切分。
為甚麼和編輯器的字符數不同?
編輯器可能統計 UTF-16 碼元、用戶可見字形或包含不同的換行符。對接長度限制時應先確認系統要求的是字節、碼點還是字形。
為甚麼一個可見字符可能統計成多個字符?
這裡按 Unicode 碼點計數。組合附加符和某些連字序列可能包含多個碼點;這與用戶感知的字形數量並不總是一致。

相關工具

字元 / 字數統計 · 統計字元(含/不含空白)、字、行、中日韓漢字與 UTF-8 位元組
字元 / 字數統計 — 工具示意圖 · dayeku.com