tools / wordcount
wordcount/
Menghitung karakter Mandarin, kata, karakter, tanda baca, paragraf, baris, dan byte UTF-8 saat Anda mengetik, serta memperkirakan waktu baca.
Teks
Statistik
Paragraf = baris yang tidak kosong. Tanda baca dihitung berdasarkan karakter tanda baca Unicode (CJK maupun ASCII).
Pertanyaan umum
Bagaimana "Karakter Mandarin" dihitung, dan apakah tanda baca, angka, serta huruf Jepang dan Korea ikut dihitung?
Hanya karakter Han yang dihitung; tanda baca, angka, dan huruf Latin tidak. Kanji dalam teks Jepang ikut dihitung, sedangkan kana dan hangul Korea tidak dihitung sebagai karakter Mandarin, meskipun tetap masuk ke total karakter dan waktu baca. Karakter langka dari blok CJK tambahan juga dikenali. Untuk total yang mencakup tanda baca, lihat "Karakter (tanpa spasi)".
Bagaimana kata dihitung, dan mengapa hasilnya berbeda dari Word?
Setiap rangkaian huruf dihitung satu kata, tidak hanya bahasa Inggris: huruf Latin seperti é, ñ, ü, ß, huruf Kiril, dan huruf Vietnam bertanda nada juga dikenali (bahasa Vietnam dihitung per suku kata). Apostrof tidak memecah kata (don't dan l'été masing-masing dihitung satu), kata bertanda hubung seperti anak-anak atau well-known dihitung dua, dan angka biasa seperti 2024 bukan kata. Karakter Mandarin, kana Jepang, dan hangul Korea tidak dihitung sebagai kata: karakter Mandarin punya baris sendiri, sedangkan kana dan hangul masuk ke total karakter dan waktu baca. Perangkat lunak yang memecah berdasarkan spasi, misalnya Word, menghitung anak-anak dan 2024 masing-masing sebagai satu kata, jadi total yang berbeda itu wajar.
Apa beda "dengan spasi" dan "tanpa spasi" pada hitungan karakter, dan berapa hitungan sebuah emoji?
"Karakter (dengan spasi)" menghitung semuanya, termasuk spasi, tab, dan setiap pemisah baris; "Karakter (tanpa spasi)" lebih dulu membuang semua spasi putih (termasuk spasi lebar penuh) lalu menghitung. Penghitungan memakai code point Unicode, jadi satu karakter Mandarin atau emoji biasa dihitung 1, tetapi emoji gabungan seperti varian warna kulit, bendera, dan keluarga tersusun dari beberapa code point dan dihitung 2 atau lebih. Baris "Tanda baca" memakai kategori tanda baca Unicode, jadi simbol seperti $, +, dan = bukan tanda baca, tetapi tetap dihitung sebagai karakter.
Apa itu "Byte (UTF-8)", dan mengapa berbeda dari ukuran file?
Itu adalah jumlah byte yang dipakai teks saat dikodekan sebagai UTF-8: 1 byte untuk huruf, angka, dan tanda baca ASCII, 3 untuk karakter Mandarin, Jepang, dan Korea yang umum, dan 4 untuk kebanyakan emoji. Setiap pemisah baris dihitung 1 byte di sini, sedangkan file bergaya Windows (\r\n) memakai 2 per pemisah baris, dan BOM di awal file menambah 3 lagi, jadi angkanya bisa sedikit berbeda dari ukuran file sebenarnya. File yang disimpan dengan encoding lain seperti GBK akan memiliki jumlah byte berbeda.
Apa beda "Paragraf" dan "Baris", dan mengapa jumlah paragraf lebih banyak dari perkiraan saya?
Paragraf adalah jumlah baris yang tidak kosong; Baris menghitung semua baris, termasuk yang kosong. Setiap pemisah baris yang diikuti teks memulai paragraf baru, tanpa perlu baris kosong di antaranya, sedangkan teks yang hanya terlipat otomatis di jendela tidak dihitung sebagai baris tambahan. Enter tambahan di akhir menambah 1 pada Baris dan tidak mengubah Paragraf.
Bagaimana perkiraan waktu baca dihitung, dan seberapa akuratkah?
Karakter Mandarin, kana, dan hangul dihitung bersama dengan kecepatan 400 per menit dan kata dengan kecepatan 200 per menit, lalu keduanya dijumlahkan; angka dan tanda baca tidak dihitung. Ini hanya perkiraan untuk pembaca rata-rata, dan kecepatan baca serta tingkat kesulitan sebenarnya sangat bervariasi. Di bawah satu menit, waktu ditampilkan dalam detik.
Apa sebenarnya yang diubah oleh "Hapus baris kosong berlebih / pangkas spasi"?
Fitur ini menulis ulang teks di kotak secara langsung dan melakukan tiga hal: memangkas spasi putih di awal dan akhir setiap baris (termasuk spasi lebar penuh), meringkas beberapa baris kosong berurutan menjadi satu, dan menghapus baris kosong di paling awal dan paling akhir teks. Spasi di dalam baris dan baris kosong tunggal dibiarkan. Jika Anda butuh teks aslinya, simpan salinannya lebih dulu.
Apakah teks yang saya tempel diunggah atau disimpan?
Tidak. Penghitungan dilakukan di browser Anda; alat ini tidak mengirim teks ke server dan tidak menyimpannya di perangkat Anda, jadi Anda harus menempel lagi setelah membuka ulang halaman. Untuk teks yang sangat panjang (lebih dari 200.000 karakter), angka muncul sedikit lebih lambat.