본문 바로가기

단어 수 세기

단어, 문장, 문단, 그리고 읽는 데 걸리는 시간을 입력하는 대로 바로 보여 줍니다. 대부분의 도구가 틀리는, 단어 사이에 띄어쓰기가 없는 언어도 정확하게 셉니다. 아무것도 저장하지 않습니다.

  • 저장되지 않음
  • 대기열 없음, 기다림 없음
  • 회원가입 없음, 워터마크 없음

0

단어 수

모든 언어 지원

0

글자 수

이모지는 1자로

0

문장 수

약어 처리

0

문단 수

빈 줄로 구분

모든 수치와 쓰이는 곳
줄 수편집기가 줄 번호를 매기는 기준
0
문장 수“Dr.”나 “etc.”에서 끊기지 않음
0
문단 수빈 줄로 구분된 덩어리
0
코드 포인트정규 표현식 “.”이 일치하는 단위
0
UTF-16 단위JavaScript의 string.length가 반환하는 값
0
UTF-8 바이트VARCHAR 제한과 HTTP 헤더가 재는 기준
0
읽는 시간눈으로 읽을 때, 분당 238단어 기준
—
말하는 시간소리 내어 읽을 때, 분당 150단어 기준
—
가장 긴 단어바이트가 아닌 글자 기준
—
평균 단어 길이대략적인 가독성 지표
—

입력을 시작하면 모든 수치가 채워져요. 이모지나 중국어 문장을 넣어 보세요. 둘 다 사람이 세는 방식 그대로 세는데, 대부분의 글자 수 세기 도구는 이걸 틀리게 셉니다.

사용 방법

1

붙여 넣거나 입력하기

텍스트 파일을 끌어다 놓아도 됩니다. 입력하는 대로 수치가 바뀌며, 아무 곳으로도 전송되지 않습니다.

2

수치 확인

단어, 문장, 문단, 줄, 글자 수와 함께 읽는 시간과 말하는 시간을 보여 줍니다.

3

제한 확인

SEO 제목, 메타 설명, 문자 메시지처럼 글자 수 제한에 맞춰 쓰고 있다면, 제한까지 얼마나 남았는지 페이지에 표시됩니다.

무엇을 세고, 무엇이 세는가

단어 수는 저희가 정한 것이 아닙니다. 단어는 브라우저 자체의 유니코드 분절기에서 나오며, 특정 로케일이 아니라 기본 로케일로 요청하고, 분절기가 단어로 표시한 조각만 셉니다. 여기서는 하이픈, 아포스트로피, 숫자에 대한 규칙을 따로 덧붙이지 않습니다. 결과는 단어가 어디서 시작하는지에 대한 분절기의 판단 그대로이며, 그래서 중국어와 일본어에서도 답이 정확하고, 서로 다른 기기의 두 브라우저가 같은 텍스트에 대해 아주 조금 다른 결과를 낼 수도 있습니다. 분절기가 없는 오래된 브라우저에서는 공백 기준으로 나누는 방식으로 대신하고 수치가 대략적이라고 알려 드리는데, 이는 단순한 도구들이 아무 말 없이 늘 내놓는 수치입니다.

문단과 줄은 저희 자체 규칙으로 세며, 두 규칙은 서로 다릅니다. 문단 경계는 빈 줄, 즉 사이에 공백이나 탭만 있는 두 번의 줄바꿈입니다. 그래서 캐리지 리턴이 그대로 남은 Windows 텍스트 파일을 끌어다 놓으면 문단 하나로 셉니다. 입력란에 붙여 넣은 텍스트는 입력란이 라인 피드로 넘겨주므로 이런 문제가 없습니다. 줄은 편집기 옆의 줄 번호처럼 셉니다. 빈 입력란은 0줄, 단어 하나는 1줄이며, 줄바꿈으로 끝나는 파일은 마지막에 빈 줄이 있는 것으로 보고 이것도 셉니다. 이는 줄 종결 문자의 개수를 알려 주는 명령줄 wc의 결과와 일부러 다르게 한 것입니다.

두 가지 작은 결정이 수치에 관한 논란 대부분을 정리합니다. 공백 제외 글자 수는 브라우저가 공백으로 보는 모든 문자를 뺍니다. 여기에는 웹 페이지에서 복사한 텍스트에 딸려 오는 줄바꿈 없는 공백도 포함되지만, 공백 문자가 아닌 폭 없는 공백은 빠지지 않고 수에 남습니다. 그리고 가장 긴 단어와 평균 단어 길이는 대표 글자 수가 쓰는 자소 클러스터가 아니라 코드 포인트 단위로 재므로, 이모지나 결합 악센트가 붙은 단어는 보이는 것보다 길게 측정됩니다. 빈도표는 따로 요청하지 않으면 흔한 영어 기능어 약 60개를 숨기며, 어떤 언어로 쓰든 대소문자는 단순한 영어 규칙으로 통합합니다.

다른 작업이 필요할 때

특정 프로그램이 평가를 맡는다면 그 프로그램의 수치만 의미가 있습니다. 참고문헌 포함 8,000단어라고 한 학술지는 Word가 내놓는 수치를 뜻하며, Word는 필드, 각주, 캡션, 텍스트 상자를 자체 설정에 따라 셉니다. 이 페이지는 일반적인 글에서 비슷한 결과를 내지만 한 단어까지 똑같지는 않으므로, 이 도구가 아니라 실제로 평가하는 도구를 기준으로 맞추세요.

문서가 여러 개라면 셸 명령 한 줄이면 됩니다. wc -w는 폴더 전체를 한 번에 받고 메모리보다 큰 파일도 스트리밍으로 처리합니다. 마크다운, HTML, LaTeX라면 먼저 pandoc으로 일반 텍스트로 바꿔 마크업을 없애면 코드 블록, 링크 주소, 태그가 본문으로 세어지지 않습니다. 저장소 전체의 단어 수와 실제 단어 수의 차이가 바로 여기서 생깁니다. 둘 다 붙여 넣기 입력란으로는 파일 400개에 대해 할 수 없는 일입니다.

자주 묻는 질문

제 텍스트가 어딘가에 저장되나요?

아니요. 아무것도 저장하지 않고 어떤 요청도 보내지 않으며, 네트워크 연결을 끊어도 계속 작동합니다. 텍스트에서는 이 점이 생각보다 중요합니다. 사람들이 온라인 글자 수 세기 도구에 붙여 넣는 것은 미발표 원고, 법률 문서 초안, 학생 과제, 내부 문서이기 때문입니다.

중국어, 일본어, 태국어도 되나요?

네. 이것이 대부분의 도구와 가장 크게 다른 점입니다. 이런 언어는 단어 사이를 띄어 쓰지 않으므로, 공백을 기준으로 나누는 흔한 방식은 중국어 기사 한 편 전체를 한 단어로 셉니다. 이 도구는 브라우저의 유니코드 단어 분절 기능(UAX #29 알고리즘)을 사용하며, 이 기능은 모든 문자 체계에서 단어가 실제로 어디서 시작하고 끝나는지 알고 있습니다. 중국어 텍스트를 이 페이지와 다른 도구에 나란히 붙여 넣어 보세요. 차이가 바로 보입니다.

읽는 시간은 어떻게 계산하나요?

눈으로 읽을 때는 단어 수를 분당 238단어로, 소리 내어 읽을 때는 분당 150단어로 나눕니다. 238이라는 수치는 성인의 묵독에 관한 연구 190편을 분석한 Brysbaert의 2019년 메타 분석에서 나온 것으로, 블로그 글 사이에서 복사되어 퍼지는 200이나 250 같은 어림수가 아닙니다. 일반적인 글을 기준으로 한 평균이므로, 빽빽한 기술 문서는 더 오래 걸리고 익숙한 주제는 더 빨리 읽힙니다.

무엇을 한 문장으로 세나요?

문장은 마침표, 물음표, 느낌표에서 끝나지만, 호칭이나 약어 뒤에서는 끝나지 않습니다. “We met Dr. Smith on Monday.”는 두 문장이 아니라 한 문장인데, 브라우저 자체의 분절 기능은 이를 틀리게 처리하고 이 페이지가 바로잡습니다. “Bring pens, paper, etc. and we will start”도 한 문장이며, 같은 구절 뒤에 대문자가 오면 두 문장이 됩니다.

무엇을 한 문단으로 세나요?

빈 줄로 구분된 텍스트 덩어리입니다. 줄바꿈마다 문단으로 세면 주소의 각 줄이 모두 문단이 되므로, 여기서 나오는 수치가 다른 도구와 다를 수 있습니다.

워드 문서나 PDF의 단어 수도 세나요?

직접은 안 됩니다. 텍스트를 붙여 넣거나, 먼저 PDF 텍스트 추출 도구를 쓴 뒤 결과를 붙여 넣으세요. 이 페이지는 텍스트만 다루며, 그래서 즉시 결과가 나오고 안전합니다.

Microsoft Word의 단어 수와 왜 다른가요?

대개 하이픈과 숫자 때문입니다. Word는 “well-known”을 한 단어로 세고 이 도구도 마찬가지지만, 두 단어로 세는 도구도 있습니다. 여기서는 따로 떨어진 숫자, 날짜, 기호도 숫자나 문자가 들어 있으면 단어로 셉니다. 일반적인 글에서는 두 결과가 거의 같지만, 부품 번호 목록이라면 다르게 나옵니다.

참고: 읽는 시간과 말하는 시간은 일반적인 글을 기준으로 한 평균값입니다. 빽빽한 기술 문서는 더 오래 걸리고 익숙한 주제는 더 빨리 읽히므로, 약속이 아니라 참고용으로 보세요. 단어 세기는 브라우저의 유니코드 분절 기능에 의존합니다. 이 기능이 없는 오래된 브라우저에서는 추정치로 대신하며, 페이지에 그 사실을 표시합니다.

내 웹사이트에 이 도구 넣기

블로그, 수업 페이지, 도움말 글 어디에나 무료로 넣을 수 있습니다. 코드 한 줄만 붙여 넣으면 방문자가 페이지에서 바로 사용할 수 있습니다.