Посчитать слова
Слова, предложения, абзацы и сколько времени займёт чтение — всё обновляется по мере набора. Правильно и для языков, где слова не разделяются пробелами, на чём ошибается большинство счётчиков. Ничего не сохраняется.
- Не сохраняется
- Без очереди и ожидания
- Без регистрации и водяных знаков
0
Слова
на любом языке
0
Символы
эмодзи считается за один
0
Предложения
с учётом сокращений
0
Абзацы
по пустым строкам
- СтрокиКак их нумерует редактор
- 0
- ПредложенияНе разрываются на «т. е.» или «и т. д.»
- 0
- АбзацыБлоки, разделённые пустой строкой
- 0
- Кодовые точкиТо, чему соответствует «.» в регулярном выражении
- 0
- Единицы UTF-16То, что возвращает string.length в JavaScript
- 0
- Байты UTF-8То, что измеряют лимит VARCHAR и HTTP-заголовки
- 0
- Время чтенияПро себя, 238 слов в минуту
- —
- Время произнесенияВслух, 150 слов в минуту
- —
- Самое длинное словоВ символах, а не в байтах
- —
- Средняя длина словаГрубый показатель читаемости
- —
Начните вводить — и всё заполнится. Попробуйте эмодзи или предложение на китайском: оба посчитаются так, как посчитал бы человек, а большинство счётчиков тут ошибается.
Как это работает
Вставьте или наберите текст
Или перетащите текстовый файл. Подсчёт обновляется по ходу; ничего никуда не отправляется.
Посмотрите цифры
Слова, предложения, абзацы, строки и символы, а также время чтения про себя и вслух.
Проверьте лимиты
Если вы пишете с ограничением — SEO-заголовок, метаописание, SMS, — страница покажет, сколько ещё осталось.
Что считается и кто считает
Подсчёт слов — не наш. Слова определяет собственный Unicode-сегментатор браузера, которому задаётся локаль по умолчанию, а не конкретная, и страница оставляет фрагменты, отмеченные им как словоподобные. Никаких своих правил для дефисов, апострофов или цифр поверх этого не добавляется — вы получаете суждение сегментатора о том, где начинаются слова. Поэтому ответ верен для китайского и японского, и поэтому два браузера на двух компьютерах могут очень немного расходиться на одном и том же тексте. В браузере настолько старом, что сегментатора в нём нет, страница переходит к разбиению по пробелам и сообщает, что цифра приблизительная, — именно такое число простые счётчики выдают всегда, не предупреждая об этом.
Абзацы и строки считаются по нашим собственным правилам, и правила эти разные. Граница абзаца — пустая строка: два переноса строки, между которыми только пробелы или табуляции, — поэтому текстовый файл Windows, перетащенный с сохранёнными символами возврата каретки, считается одним абзацем; у текста, вставленного в поле, такой проблемы нет, потому что текстовое поле передаёт переводы строк. Строки считаются так, как их нумерует редактор: пустое поле — ноль строк, одно слово — одна строка, а у файла, который заканчивается переносом строки, есть пустая последняя строка, и она учитывается. Это сознательно не совпадает с тем, что выдаёт wc в командной строке: он считает число символов конца строки.
Два небольших решения снимают большинство споров о цифрах. «Символы без пробелов» исключают всё, что браузер считает пробельными символами, включая неразрывный пробел, который приходит вместе с текстом, скопированным с веб-страницы, — но не пробел нулевой ширины: он не пробельный и остаётся в подсчёте. А самое длинное слово и средняя длина слова измеряются в кодовых точках, а не в графемных кластерах, которые использует основной подсчёт символов, поэтому слово с эмодзи или комбинируемым диакритическим знаком здесь оказывается длиннее, чем выглядит. Таблица частотности скрывает около шестидесяти частых служебных слов английского языка, если вы не попросите их показать, и приводит регистр по простому английскому правилу независимо от языка, на котором вы пишете.
Если нужно другое
Когда оценивать будет конкретная программа, значение имеет только её цифра. Если журнал пишет «восемь тысяч слов вместе со списком литературы», имеется в виду число, которое выдаёт Word, а Word считает поля, сноски, подписи и текстовые поля согласно своим настройкам. На обычном тексте эта страница даст близкий результат, но не совпадёт до слова, так что ориентируйтесь на тот инструмент, которым вас будут проверять, а не на этот.
Для большего, чем один документ, подсчёт — это одна строка в терминале. wc -w обрабатывает целую папку сразу и читает потоком файлы больше вашей памяти; для Markdown, HTML или LaTeX, если сначала прогнать файл через pandoc в простой текст, разметка исчезнет, и блоки кода, адреса ссылок и теги не будут считаться текстом, — в этом и разница между подсчётом слов по репозиторию и настоящим. Ни то ни другое поле для вставки не сделает для четырёхсот файлов.
Частые вопросы
Мой текст где-нибудь сохраняется?
Нет. Ничего не сохраняется, никакие запросы не отправляются, и инструмент продолжает работать даже без сети. Для текста это важнее, чем кажется: в онлайн-счётчики вставляют неопубликованные тексты, черновики юридических документов, студенческие работы и внутренние документы.
Работает ли он с китайским, японским или тайским?
Да, и именно этим он прежде всего отличается от большинства счётчиков. В этих языках слова не разделяются пробелами, поэтому обычная реализация — разбиение по пробелам — считает целую китайскую статью одним словом. Здесь используется Unicode-сегментация слов в браузере (алгоритм UAX #29), которая знает, где на самом деле начинаются и заканчиваются слова в любой письменности. Вставьте китайский текст в эту страницу и в другой счётчик рядом — разница видна сразу.
Как вычисляется время чтения?
Число слов делится на 238 в минуту для чтения про себя и на 150 в минуту для чтения вслух. Цифра 238 взята из метаанализа Брисбарта 2019 года, обобщившего 190 исследований чтения взрослых про себя, а не круглые 200 или 250, которые кочуют из блога в блог. Это среднее значение для обычного текста — плотный технический текст читается медленнее, а знакомая тема — быстрее.
Что считается предложением?
Предложение заканчивается точкой, вопросительным или восклицательным знаком — но не после обращения или сокращения. «We met Dr. Smith on Monday.» — это одно предложение, а не два: собственная сегментация браузера здесь ошибается, а эта страница исправляет. «Bring pens, paper, etc. and we will start» — тоже одно; та же фраза, за которой следует заглавная буква, — уже два.
Что считается абзацем?
Блок текста, отделённый пустой строкой. Если считать абзацем каждый перенос строки, то абзацем окажется каждая строка почтового адреса, — поэтому цифры здесь отличаются от некоторых других инструментов.
Считает ли он слова в документе Word или PDF?
Не напрямую — вставьте текст или сначала воспользуйтесь нашим инструментом «PDF в текст» и вставьте результат. Эта страница работает с текстом, поэтому она мгновенная и конфиденциальная.
Почему мой подсчёт слов отличается от Microsoft Word?
Обычно из-за дефисов и чисел. Word считает «well-known» одним словом, и мы тоже; некоторые инструменты — двумя. Отдельные числа, даты и символы здесь считаются словами, если в них есть цифра или буква. Для обычного текста результаты почти совпадают; для списка артикулов — нет.
Полезно знать: Время чтения и произнесения — среднее значение для обычного текста: плотный технический текст читается медленнее, знакомая тема — быстрее, так что это ориентир, а не обещание. Подсчёт опирается на Unicode-сегментацию браузера; в браузере настолько старом, что её нет, используется приблизительная оценка, и страница об этом сообщает.
Разместите этот инструмент на своём сайте
Бесплатно для любого блога, страницы класса или справочной статьи. Вставьте один фрагмент кода — и посетители смогут пользоваться инструментом прямо на вашей странице.
Ещё Инструменты для текста
Счётчик символов
Символы, байты и что на самом деле считает ваш лимит
Сравнить тексты
Что именно изменилось между двумя версиями
Изменить регистр текста
ВЕРХНИЙ, нижний, Как В Заголовке, camelCase и другие
Удалить повторяющиеся строки
Уберите повторы, отсортируйте и приведите список в порядок
Минификатор HTML
Сожмите HTML, не сломав страницу
Минификатор CSS
Сожмите стили или узнайте, почему нельзя