Langsung ke konten

Hitung kata

Kata, kalimat, paragraf, dan berapa lama waktu membacanya — diperbarui saat Anda mengetik. Akurat untuk bahasa yang tidak memakai spasi di antara kata, yang salah dihitung oleh kebanyakan penghitung. Tidak ada yang disimpan.

  • Tidak pernah disimpan
  • Tanpa antre, tanpa menunggu
  • Tanpa daftar, tanpa watermark

0

Kata

bahasa apa pun

0

Karakter

emoji dihitung satu

0

Kalimat

singkatan dikenali

0

Paragraf

dipisah baris kosong

Semua hitungan, dan apa yang memakainya
BarisSeperti penomoran di editor
0
KalimatTidak terpotong oleh “dr.” atau “dll.”
0
ParagrafBlok yang dipisahkan baris kosong
0
Code pointYang dicocokkan oleh “.” dalam regular expression
0
Unit UTF-16Yang dilaporkan string.length di JavaScript
0
Byte UTF-8Yang diukur batas VARCHAR dan header HTTP
0
Waktu bacaDalam hati, 238 kata per menit
—
Waktu bicaraDengan suara, 150 kata per menit
—
Kata terpanjangMenurut karakter, bukan byte
—
Rata-rata kataGambaran kasar keterbacaan
—

Mulailah mengetik dan semuanya akan terisi. Coba emoji, atau satu kalimat bahasa Mandarin — keduanya dihitung seperti cara orang menghitung, hal yang sering salah di kebanyakan penghitung.

Cara kerjanya

1

Tempel atau ketik

Atau letakkan file teks. Hitungan diperbarui saat Anda mengetik; tidak ada yang dikirim ke mana pun.

2

Baca angkanya

Kata, kalimat, paragraf, baris, dan karakter, plus waktu baca dan waktu bicara.

3

Periksa batas Anda

Jika Anda menulis dengan batas tertentu — judul SEO, meta description, SMS — halaman ini menunjukkan seberapa dekat Anda dengan batas itu.

Apa yang dihitung, dan siapa yang menghitungnya

Jumlah kata bukan hitungan kami. Kata-kata berasal dari segmenter Unicode milik browser sendiri, yang dipanggil dengan locale bawaannya alih-alih locale tertentu, dan halaman ini menyimpan potongan yang ditandainya sebagai kata. Tidak ada aturan tambahan untuk tanda hubung, apostrof, atau angka di atasnya — yang Anda dapatkan adalah penilaian segmenter tentang di mana kata dimulai, itulah sebabnya hasilnya benar untuk bahasa Mandarin dan Jepang, dan itulah sebabnya dua browser di dua komputer bisa sedikit berbeda untuk teks yang sama. Di browser yang terlalu lama sehingga tidak punya segmenter, halaman ini beralih ke pemecahan berdasarkan spasi dan memberi tahu bahwa angkanya perkiraan — angka yang sebenarnya selalu diberikan penghitung sederhana tanpa pemberitahuan.

Paragraf dan baris dihitung dengan aturan kami sendiri, dan aturannya tidak sama. Batas paragraf adalah baris kosong — dua jeda baris yang di antaranya hanya ada spasi atau tab — sehingga file teks Windows yang diletakkan dengan carriage return-nya utuh dihitung sebagai satu paragraf; teks yang ditempel ke kotak tidak pernah mengalami masalah itu, karena kotak teks menyerahkan line feed. Baris dihitung seperti gutter editor menghitungnya: kotak kosong berarti nol baris, satu kata berarti satu baris, dan file yang diakhiri baris baru punya baris terakhir yang kosong dan ikut dihitung. Itu sengaja berbeda dari yang dilaporkan wc di command line, yaitu jumlah penanda akhir baris.

Dua keputusan kecil menjawab sebagian besar perdebatan soal angka-angkanya. Karakter tanpa spasi membuang apa pun yang dianggap browser sebagai spasi, termasuk non-breaking space yang ikut terbawa saat teks disalin dari halaman web — tetapi tidak zero-width space, yang bukan spasi dan tetap dihitung. Lalu kata terpanjang dan rata-rata panjang kata diukur dalam code point, bukan dalam grapheme cluster yang dipakai angka karakter utama, sehingga kata yang memuat emoji atau aksen gabungan terukur lebih panjang di sini daripada kelihatannya. Tabel frekuensi menyembunyikan sekitar enam puluh kata fungsi umum bahasa Inggris kecuali Anda memintanya, dan menyamakan huruf besar/kecil dengan aturan bahasa Inggris biasa, apa pun bahasa yang Anda tulis.

Jika Anda butuh hal lain

Jika penilaiannya dilakukan oleh program tertentu, hanya angka dari program itulah yang berlaku. Jurnal yang menyebut delapan ribu kata termasuk referensi berarti angka yang dihasilkan Word, dan Word menghitung field, catatan kaki, keterangan gambar, dan kotak teks menurut pengaturannya sendiri. Halaman ini akan mendekati angka itu untuk tulisan biasa tetapi tidak akan cocok hingga ke setiap kata, jadi ikuti alat yang dipakai untuk menilai Anda, bukan alat ini.

Untuk lebih dari satu dokumen, penghitungan cukup dengan satu baris shell. wc -w memproses satu folder sekaligus dan membaca file yang lebih besar dari memori Anda secara streaming; untuk Markdown, HTML, atau LaTeX, mengalirkan file lewat pandoc ke teks biasa terlebih dahulu akan membuang markup-nya, sehingga blok kode, target tautan, dan tag tidak dihitung sebagai tulisan — itulah selisih antara jumlah kata sebuah repositori dan jumlah yang sebenarnya. Keduanya bukan hal yang bisa dilakukan kotak tempel untuk empat ratus file.

Pertanyaan yang sering diajukan

Apakah teks saya disimpan di suatu tempat?

Tidak. Tidak ada yang disimpan dan tidak ada permintaan yang dikirim, dan alat ini tetap berfungsi saat jaringan terputus. Untuk teks, hal ini lebih penting daripada kelihatannya: yang ditempel orang ke penghitung online adalah tulisan yang belum terbit, draf hukum, tugas siswa, dan dokumen internal.

Apakah alat ini berfungsi untuk bahasa Mandarin, Jepang, atau Thai?

Ya, dan inilah pembeda utamanya dari kebanyakan penghitung. Bahasa-bahasa itu tidak memakai spasi di antara kata, sehingga cara yang umum — memecah teks berdasarkan spasi — menganggap seluruh artikel berbahasa Mandarin sebagai satu kata. Alat ini memakai segmentasi kata Unicode milik browser (algoritma UAX #29), yang tahu di mana kata benar-benar dimulai dan berakhir dalam setiap aksara. Tempel teks Mandarin ke halaman ini dan ke penghitung lain berdampingan; perbedaannya langsung terlihat.

Bagaimana waktu baca dihitung?

Jumlah kata dibagi 238 per menit untuk membaca dalam hati, dan 150 per menit untuk membaca dengan suara keras. Angka 238 berasal dari meta-analisis Brysbaert tahun 2019 atas 190 studi tentang membaca dalam hati pada orang dewasa, bukan angka bulat 200 atau 250 yang disalin dari satu blog ke blog lain. Ini rata-rata untuk tulisan biasa — tulisan teknis yang padat lebih lambat, dan topik yang sudah akrab lebih cepat.

Apa yang dihitung sebagai kalimat?

Kalimat berakhir pada titik, tanda tanya, atau tanda seru — tetapi tidak setelah gelar atau singkatan. “We met Dr. Smith on Monday.” adalah satu kalimat, bukan dua; segmentasi bawaan browser salah menghitungnya dan halaman ini membetulkannya. “Bring pens, paper, etc. and we will start” juga satu kalimat; frasa yang sama bila diikuti huruf kapital dihitung dua.

Apa yang dihitung sebagai paragraf?

Blok teks yang dipisahkan oleh baris kosong. Jika setiap jeda baris dihitung sebagai paragraf, setiap baris alamat akan dianggap satu paragraf — itulah sebabnya angka di sini berbeda dari beberapa alat lain.

Bisakah alat ini menghitung kata dalam dokumen Word atau PDF?

Tidak secara langsung — tempel teksnya, atau gunakan alat PDF ke Teks kami terlebih dahulu lalu tempel hasilnya. Halaman ini bekerja dengan teks, dan itulah yang membuatnya instan dan privat.

Mengapa jumlah kata saya berbeda dengan Microsoft Word?

Biasanya karena tanda hubung dan angka. Word menghitung “well-known” sebagai satu kata, begitu pula kami; sebagian alat menghitungnya dua. Angka, tanggal, dan simbol yang berdiri sendiri dihitung sebagai kata di sini jika mengandung angka atau huruf. Untuk tulisan biasa, hasil keduanya sangat mirip; untuk daftar nomor komponen, tidak.

Perlu diketahui: Waktu baca dan waktu bicara adalah rata-rata untuk tulisan biasa — tulisan teknis yang padat lebih lambat dan topik yang sudah akrab lebih cepat, jadi anggaplah sebagai panduan, bukan janji. Penghitungan bergantung pada segmentasi Unicode milik browser; browser yang terlalu lama sehingga tidak memilikinya akan beralih ke perkiraan dan menyatakannya di halaman.

Pasang alat ini di situs Anda

Gratis untuk blog, halaman kelas, atau artikel bantuan apa pun. Tempel satu potong kode dan pengunjung Anda bisa langsung memakainya di halaman Anda.