字元 / 字數統計
統計字元(含/不含空白)、字、行、中日韓漢字與 UTF-8 位元組
輸入或粘貼文本即可實時統計。核對字段限制時,先確認目標要求是字符數、字節數還是平台自己的計數方式。
| 字符數(含空白) | 0 |
|---|---|
| 字符數(不含空白) | 0 |
| 詞組數 | 0 |
| 行數 | 0 |
| 漢字數(CJK 統一表意文字) | 0 |
| 字節數(UTF-8) | 0 |
範例
輸入
A中 B
示例結果
碼點數:4 · 非空白字符數:3 · 行數:2 · UTF-8 字節數:6
換行佔一個碼點和一個 UTF-8 字節;“中”佔三個字節。
技術細節與邊界
字符數通過碼點迭代計算,字節數通過 TextEncoder 的 UTF-8 編碼計算,兩者通常不同。組合附加符和連字序列可能由多個碼點組成。詞數按連續字母、數字及連接符統計,不是中文分詞;漢字計數覆蓋代碼中列出的常用及擴展範圍,不是全部 Unicode 漢字版本。
關於此工具
實時統計文本的 Unicode 碼點數、非空白字符、詞組、行數、漢字與 UTF-8 字節數。用於核對字段長度、接口字節限制和內容規模,並說明不同計數口徑。
適用場景
- 發佈或提交文本前核對字符數量;目標平台可能採用不同的計數規則,應再按其規則確認。
- 估算中英混排文字在資料庫佔多少位元組。
- 快速看一份 CSV 有多少行、是否有空行。
注意事項
詞組按連續的 Unicode 字母、數字、下划線及部分連接符統計,不做自然語言分詞。連續中文可能只算一個詞組,中文字數請查看漢字欄。字節數按 UTF-8 計算。
常見問題
- 為甚麼一整句中文只統計為一個詞?
- 詞數統計連續字母和數字,而不是自然語言分詞。連續漢字可形成一個詞組;需要中文字數時請看漢字或碼點欄目。
- `\n` 會算成 1 個字元嗎?
- 會算成 1 個字元(空白類)。行數按 `\n` / `\r\n` 切分。
- 為甚麼和編輯器的字符數不同?
- 編輯器可能統計 UTF-16 碼元、用戶可見字形或包含不同的換行符。對接長度限制時應先確認系統要求的是字節、碼點還是字形。
- 為甚麼一個可見字符可能統計成多個字符?
- 這裡按 Unicode 碼點計數。組合附加符和某些連字序列可能包含多個碼點;這與用戶感知的字形數量並不總是一致。
相關工具