tools / wordcount
wordcount/
即時統計漢字、單字、字元、標點、段落、行數、UTF-8 位元組數,並估算閱讀時間。
文字
統計
段落 = 非空行數;標點依 Unicode 標點類別統計(含中英文標點)。
常見問題
「中文字數」是怎麼統計的,標點、數字和日文韓文算不算
只數漢字,標點、數字和英文字母都不算。日文中的漢字會算進去,假名和韓文諺文不算「中文字數」,但會計入字元數和閱讀時間。罕見的擴充區漢字也能辨識。想要含標點的總數,請看「字元(不含空格)」。
單字數是怎麼數的,為什麼和 Word 不一樣
由字母連成的就算 1 個詞,不限英文:é、ñ、ü、ß 這類拉丁字母、西里爾字母和越南語帶聲調的字母都能辨識(越南語按音節計,每個音節算 1 個詞)。撇號不會把詞拆開(don't、l'été 各算 1 個),用連字號連起來的詞(well-known)算 2 個,純數字(2024)不算詞。漢字、日文假名和韓文諺文不算單字:漢字另在「中文字數」裡統計,假名和諺文計入字元數和閱讀時間。依空格分詞的軟體(如 Word)會把 well-known 和 2024 都算作一個詞,所以數字對不上很正常。
字元數裡的「含空格」和「不含空格」有什麼差別,emoji 算幾個
「字元(含空格)」是全部字元,包括空格、Tab 和每個換行;「字元(不含空格)」先去掉所有空白字元(全形空格也去掉)再數。計數依 Unicode 碼位,漢字和一般 emoji 各算 1 個,但帶膚色的 emoji、國旗、家庭這類組合 emoji 由多個碼位拼成,會算成 2 個以上。「標點」一行依 Unicode 的標點類別統計,$、+、= 這類符號不算標點,但算字元。
「位元組 UTF-8」是什麼,為什麼和檔案大小對不上
它是文字以 UTF-8 編碼後佔用的位元組數:英文字母、數字和半形標點各 1 位元組,常見漢字 3 位元組,多數 emoji 4 位元組。這裡每個換行只算 1 位元組,Windows 風格(\r\n)的檔案每個換行是 2 位元組,檔案開頭如果帶 BOM 還會多 3 位元組,所以和實際檔案大小可能差幾個位元組。用 GBK 等其他編碼儲存的檔案,位元組數會不一樣。
「段落」和「行數」有什麼差別,為什麼段落數比我想的多
段落數是不空的行的數量,行數是所有行(含空行)。只要按 Enter 換了行、下一行有字,就算一個新段落,不要求中間隔一個空行;一段話在視窗裡自動換行不會多算一行。結尾多按一個 Enter,行數會加 1,段落數不變。
預計閱讀時間是怎麼算的,準嗎
漢字、日文假名、韓文諺文合計以每分鐘 400 字計算,單字以每分鐘 200 個計算,兩部分相加,數字和標點不計入。這只是平均水準的估算,每個人的閱讀速度和文章難度差別很大。不到 1 分鐘時顯示秒數。
「移除多餘空行 / 頭尾空格」具體會改什麼
它會直接改寫輸入框裡的文字,做三件事:去掉每一行開頭和結尾的空白(包括全形空格),把連續的多個空行壓成一個,再去掉整段文字開頭和結尾的空行。行內的空格和單個空行不會動。需要保留原文的話,請先自行備份一份。
貼上的文字會上傳或儲存嗎
不會。統計在瀏覽器裡完成,工具不會向伺服器傳送任何文字,也不會把內容存在本機,重新開啟頁面後需要重新貼上。文字特別長(超過 20 萬字元)時,結果會稍晚一點出現。