Перейти к содержимому
UtilDock

Счётчик текста

Слова, символы, предложения и абзацы сразу · работает в этой вкладке и никуда не отправляется

Текст

Вставьте или наберите текст, чтобы посчитать его

Вставьте текст в панель слева. Все подсчёты обновляются по ходу набора, целиком в этой вкладке.

Как работает Счётчик текста

Счётчик слов, который считает всё сразу — слова, символы с пробелами и без, предложения, абзацы, строки и байты UTF-8 — и обновляется по ходу набора. Он также оценивает время чтения и чтения вслух, следит за пределами, под которые люди действительно пишут, и показывает, какие слова встречаются чаще всего. Подсчёт использует собственную сегментацию текста Unicode браузера, поэтому японский и китайский считаются по словам, а не превращаются в одно огромное слово.

Вставьте или наберите текст в панели — и все подсчёты обновятся разом: слова, символы с пробелами и без, предложения, абзацы, строки и байты UTF-8. Ничего нажимать не нужно.

Подсчёт использует собственную сегментацию текста Unicode браузера, а не разбиение по пробелам, и разница здесь не академическая. Японский и китайский не разделяют слова пробелами, поэтому разбиение по пробелам объявляет целый абзац одним словом; то же разбиение режет «l’objet» надвое. Сегментация знает, где слова действительно заканчиваются в каждой письменности, на которой выходит сайт, а время чтения для CJK измеряется в символах в минуту, а не в словах.

Панель пределов следит за теми ограничениями, под которые люди на самом деле пишут, — пост в 280 символов, SMS в 160, заголовок страницы в 60, метаописание в 155 — а таблица частот показывает, на какие слова вы опирались: быстрее заметить повтор нельзя.

Частые вопросы

Как он считает слова в японском или китайском?

Правильно — чего не делает большинство счётчиков. Японский и китайский не разделяют слова пробелами, поэтому подсчёт разбиением по пробелам объявляет целый абзац одним словом. Этот инструмент использует встроенную в браузер сегментацию текста Unicode, которая знает, где слова действительно заканчиваются в любой письменности, и измеряет время чтения CJK в символах в минуту, а не в словах.

Что считается предложением и абзацем?

Предложение определяется правилами разбиения Unicode, поэтому «Dr. Smith went to Washington D.C. yesterday» — это одно предложение, а не три, и идеографическая точка распознаётся. Абзац — это блок, отделённый пустой строкой; если пустых строк в тексте нет вовсе, каждая непустая строка считается за один.

Как считается время чтения?

По 238 слов в минуту для буквенного текста — это медиана взрослого чтения про себя обычной прозы — и по 400 символов в минуту для CJK. Время речи использует более медленные темпы, которые реально выдерживает выступающий, около 140 слов в минуту. Это оценки, а не измерения: плотный технический текст читается медленнее романа.

Мой текст куда-нибудь отправляется?

Нет. Подсчёт — это JavaScript, работающий в вашей собственной вкладке, внутри Web Worker, чтобы длинный документ не подвешивал страницу. Отключите сеть — и он продолжит работать. Для счётчика текста это важнее, чем кажется: считают обычно черновики, сопроводительные письма и неопубликованные тексты.