Анализ текста
Тошнота, водность, плотность ключей, символы и слова — всё в браузере.
Как пользоваться анализом текста
Вставьте статью, описание категории или карточку товара в поле выше. Метрики пересчитываются на каждое нажатие клавиши, ждать нечего. Весь разбор идёт в вашем браузере на JavaScript: текст не уходит на сервер и нигде не сохраняется. Поэтому через инструмент безопасно прогонять черновики и коммерческие материалы, которые нельзя загружать на сторонние сервисы.
Классическая тошнота: формула и норма
Классическая тошнота — квадратный корень из числа повторов самого частого слова. Формула не зависит от длины документа, в этом её особенность и её ловушка. Слово «купить» встретилось 16 раз? Тошнота равна 4 независимо от того, 500 слов в статье или 5000.
- До 3. Спокойное значение, повторов почти не заметно.
- 3–4. Рабочий диапазон для коммерческого текста, где ключ повторяется естественно.
- Выше 4.5. Повод перечитать: скорее всего, одно слово торчит из каждого абзаца.
- Выше 6. Это 36 повторов и больше. Читается тяжело, а антиспам-фильтры реагируют на такое плохо.
Есть нюанс. В лонгриде на 8000 слов тошнота 5 может быть нормой, а в карточке товара на 200 слов даже 3 уже перебор. Сверяйте цифру с таблицей плотности под виджетом: она показывает, какое именно слово дало пик.
Водность и как её снижать
Водность считается как доля стоп-слов от общего числа: предлоги, союзы, местоимения, частицы. Ориентир для информационной статьи — 15–20%. Разговорный или художественный текст спокойно выходит на 25–30%, и для жанра это нормально. Инструкция или спецификация редко поднимается выше 12%.
Что делать при 35% и выше? Искать обороты, которые ничего не сообщают. «Для того чтобы» сокращается до «чтобы». «В связи с тем что» превращается в «потому что». Предложения вида «данный вопрос требует внимательного рассмотрения» удаляются целиком, смысл не пострадает. После одной вычитки водность обычно падает на 5–8 пунктов.
Плотность ключевых слов
Плотность — доля вхождений слова от общего объёма, в процентах. Таблица показывает 12 самых частых слов, служебные из неё исключены. Здоровое распределение выглядит как пологая горка: у лидера 2–3%, у следующих слов 1–2%. Если первое слово занимает 5%, а второе всего 0.8%, текст заточен под один ключ и выглядит искусственно.
Точной нормы «плотность должна быть N%» не существует, и ни Яндекс, ни Google её не публиковали. Практический ориентир для главного ключа — 2–4%. Всё, что выше 5%, стоит разбавить синонимами и словоформами. Поисковики давно понимают, что «доставка пиццы» и «привезти пиццу» об одном и том же.
Академическая тошнота и читаемость
Кроме классической встречается академическая тошнота: доля самых частых слов от общего объёма, в процентах. Единой формулы у неё нет, каждый сервис считает по-своему, из-за чего значения на одном и том же тексте расходятся почти вдвое. Здесь показана классическая версия плюс таблица плотности, по которой видно то же самое, но без чёрного ящика.
Читаемость меряют отдельно, индексами вроде Флеша-Кинкейда. Формула заточена под английский, на русском ведёт себя странно и в SEO почти не применяется. Куда полезнее счётчик предложений рядом с объёмом. Разделите слова на предложения и получите среднюю длину фразы: значение выше 20 слов означает, что текст пора резать на части.
Чем на самом деле вреден переспам
У Яндекса есть фильтр «Баден-Баден», который понижает страницы с текстами, написанными для робота. Google описывает то же явление термином keyword stuffing. Санкция редко прилетает за одну статью, обычно она копится по целому разделу. Восстановление занимает месяцы: тексты надо переписать, а потом дождаться переобхода.
Работает и прямой эффект, без всяких фильтров. Заспамленный текст неприятно читать. Посетитель возвращается в выдачу, поведенческие метрики проседают, следом уезжает позиция. Для коммерческих запросов это бьёт больнее любых формальных показателей.
Что делать с высокими значениями
- Замените часть точных вхождений синонимами и родственными словами.
- Разбейте текст подзаголовками. Смена микротемы естественно снижает концентрацию ключа.
- Добавьте фактуру: цифры, названия моделей, даты, цены. Объём растёт без повторов.
- Уберите служебные абзацы, которые ничего не добавляют к ответу на запрос.
- Прогоните текст ещё раз и сравните значения. Обычно хватает двух итераций.
Частые вопросы
Что такое тошнота текста и какая норма?
Классическая тошнота — это корень из числа повторов самого частого слова. Для веб-текста комфортное значение обычно до 3–4. Высокая тошнота — сигнал переспама одним ключом.
Что показывает водность?
Водность — доля «пустых» слов (предлоги, союзы, местоимения, частицы) от общего числа слов. Ориентир для информационного текста — до 15–20%. Чем выше, тем меньше смысла на объём.
Данные текста куда-то отправляются?
Нет. Весь анализ выполняется прямо в вашем браузере на JavaScript — текст не уходит на сервер и нигде не сохраняется.
Как считается плотность ключевых слов?
Это доля вхождений слова от общего числа слов в тексте, в процентах. Помогает увидеть переспам и главные темы страницы.
Почему тошнота высокая, а текст читается нормально?
Формула берёт только самое частое слово и не смотрит на длину документа. В статье на 6000 слов какое-нибудь «который» легко наберёт 30 повторов, и тошнота покажет 5.5 при нормальной читаемости. Сверяйте цифру с таблицей плотности: если лидер списка это служебное слово, а не ключ, поводов для тревоги мало.
Какой объём текста нужен для статьи?
Универсального числа нет, ориентируйтесь на выдачу по своему запросу. Информационная статья обычно укладывается в 1500–3000 слов, карточке товара хватает 150–300. Дописывать «воду» ради объёма вредно: водность вырастет, а польза нет.