Тошнота текста: классическая и академическая простыми словами

Роман ставит натяжные потолки в Пензе. Текст на страницу услуг он заказал на бирже за девятьсот рублей, с пометкой в задании: «обязательно ключ „натяжные потолки Пенза“, не меньше десяти раз».
Исполнитель задание выполнил буквально. В тексте на три тысячи знаков словосочетание встречается четырнадцать раз, включая три раза в одном абзаце. Читать это невозможно: «Натяжные потолки в Пензе — это современное решение. Наши натяжные потолки в Пензе устанавливаются за один день. Заказать натяжные потолки в Пензе можно по телефону».
Роман текст принял и опубликовал. Через полгода страница так и не поднялась выше третьей десятки, а на вопрос «почему» ему ответили словом «переспам» и предложили переписать за две тысячи.
Главная мысль сразу: тошнота — это измеримая доля повторов, и её действительно стоит держать в границах. Но метрик под этим названием две, считают они разное, и лечится результат не заменой слов на синонимы, а нормальным построением текста.
Что вы узнаете из статьи
- Откуда взялось само слово и что стоит за ним технически
- Чем классическая тошнота отличается от академической и почему их считают отдельно
- Какие значения принято считать нормой и почему у сервисов они расходятся
- Почему низкий показатель не гарантирует хорошего текста
- Как снизить тошноту, не выбросив ключевую фразу и не испортив чтение
Две метрики с одним названием
Слово пришло из практики бирж копирайтинга нулевых, когда поисковые системы ещё можно было обмануть частотой ключевых фраз. Смысл прямой: от текста, где одно словосочетание вбито тридцать раз, читателя буквально мутит.
Классическая тошнота считается от самого частого слова в тексте. Формула простая: квадратный корень из числа его повторов. Слово встретилось 16 раз — классическая тошнота 4. Встретилось 49 раз — уже 7. Метрика не зависит от длины текста, и в этом её главная особенность: одно и то же значение в коротком посте и в длинной статье означает совершенно разные вещи.
Академическая тошнота считается иначе — как доля повторов самых частых слов от общего числа слов, в процентах. Она уже учитывает длину: чем длиннее текст, тем больше повторов он выдерживает без последствий.
Обе метрики смотрят на повторы, но с разных сторон: первая — на абсолютный рекорд одного слова, вторая — на общий фон. Именно поэтому нормальные сервисы показывают обе, и смотреть надо на обе. И ни одна из них не связана с водностью текста: та измеряет пустоту, эта — перенасыщение. Текст может быть плох по обеим сразу.
Ещё одна деталь, о которой редко говорят. Слова считаются по начальной форме: «потолок», «потолка», «потолки», «потолков» — это одно слово. Так что попытка «размазать» ключевую фразу по падежам на показатель не влияет.
Нормы и как их читать
Общепринятые ориентиры выглядят так: классическая тошнота — примерно до 7, академическая — примерно до 8–9% для текста средней длины. У разных сервисов границы немного разъезжаются, потому что отличаются словари и способ подсчёта. Смотрите норму того инструмента, в котором проверяете.
Дальше начинается то, что в отчётах не пишут.
Норма зависит от жанра. В карточке товара слово «смеситель» неизбежно повторяется чаще, чем в статье про ремонт: о чём ещё писать в карточке смесителя. В коротком тексте на тысячу знаков одно упоминание услуги трижды уже даёт заметный показатель, и это нормально.
Самое частое слово не всегда ключевое. Бывает, что рекорд ставит «который», «наш» или «вы». Формально показатель высокий, а переспама нет — есть однообразие конструкций. Лечится это не синонимами, а перестройкой предложений.
Низкий показатель ничего не гарантирует. Текст, где ключевая фраза встречается один раз, а всё остальное — общие слова, получит отличные числа по обеим метрикам и при этом не будет отвечать ни на один запрос. Метрика ловит перебор, но не ловит пустоту.
Поисковые системы такой метрики не считают. Ни классической, ни академической тошноты в их алгоритмах нет — это придумка сервисов анализа. Что у систем действительно есть, так это фильтры за переоптимизацию, и высокая тошнота с ними коррелирует. То есть метрика — не закон, а термометр.
Как снизить, не выбросив ключевую фразу
Первое, что делают неопытные авторы, — заменяют повторы синонимами. Получается хуже: «натяжные потолки», «полотна ПВХ», «подвесные конструкции», «потолочные системы» в одном абзаце читаются как канцелярская отписка, а не как речь мастера.
Работающие приёмы другие.
Уберите ключевую фразу оттуда, где она не нужна грамматически. «Наши натяжные потолки в Пензе устанавливаются за один день» спокойно превращается в «Устанавливаем за один день». Читатель уже понял, о чём страница, — повторять название услуги в каждом предложении не нужно.
Замените словосочетание на местоимение или общее слово там, где это естественно. «Потолок держит форму», «конструкция выдерживает протечку сверху». Не как синонимический ряд, а как обычная человеческая речь.
Добавьте фактуры. Самый надёжный способ снизить долю повторов — написать про то, чего в тексте ещё нет: сроки, материалы, что делать при протечке, чем матовое отличается от сатинового, сколько живёт светильник. Доля ключевой фразы падает сама собой, а текст становится полезнее.
Разбейте текст на разделы с разными темами. В тексте из одного смыслового куска слово неизбежно повторяется. В тексте из пяти разделов у каждого свой словарь.
Проверьте частые служебные слова. Если рекорд ставит «который», перестройте предложения: половина придаточных превращается в причастный оборот или в отдельное предложение. Заодно вырастет читабельность — эти две метрики часто чинятся одной правкой.
И общее правило: ключевая фраза должна быть в заголовке, один раз в первом абзаце и дальше столько раз, сколько требует нормальная речь. Обычно это три-пять вхождений на три тысячи знаков. Всё остальное — суеверие из нулевых. Тошнота — только один пункт в общем списке проверок, и вытягивать её в отрыве от остальных смысла нет.
Сверьтесь с собой
Четыре признака, что текст переспамлен.
Первый: вы читаете абзац вслух и спотыкаетесь о повтор одного и того же словосочетания.
Второй: в задании исполнителю было указано число вхождений ключевой фразы.
Третий: ключевая фраза стоит в предложениях, где она грамматически не нужна, — её можно вычеркнуть, и смысл не изменится.
Четвёртый: в тексте нет ни одного факта, который нельзя было бы вывести из его заголовка.
Совпало два пункта и больше? Текст писали под метрику, а не под читателя, и переделывать его придётся не заменой слов, а добавлением содержания.
Часто задаваемые вопросы
Какая тошнота считается нормальной?
Обычные ориентиры: классическая — до 7, академическая — до 8–9%. Границы у сервисов немного разные, поэтому сверяйтесь с нормой того инструмента, где проверяете, и следите за динамикой внутри него, а не сравнивайте показатели между сервисами.
Накажет ли поисковая система за высокую тошноту?
Такой метрики у поисковых систем нет. Есть фильтры за переоптимизацию, и они срабатывают на текстах, у которых тошнота обычно высокая. То есть показатель — косвенный признак риска, а не сам риск.
Сколько раз нужно вставить ключевую фразу в статью?
Столько, сколько требует нормальная речь: заголовок, первый абзац, один-два подзаголовка и несколько упоминаний по тексту. На материал в три тысячи знаков это обычно три-пять раз. Считать вхождения по заданию — практика, которая больше вредит, чем помогает.
У меня карточка товара, и название модели повторяется постоянно. Что делать?
Для карточек высокий показатель нормален и в правке не нуждается. Полезнее следить за тем, чтобы описание отличалось от описания у соседей по выдаче, — это влияет сильнее, чем доля повторов.
Можно ли снизить тошноту синонимами?
Формально да, по существу — нет. Синонимический ряд из четырёх названий одной вещи читается тяжелее, чем честный повтор. Лучше убрать лишние вхождения и добавить фактуры.
Заключение
Тошнота — метрика из времён, когда поиск обманывался частотой. Времена прошли, метрика осталась, и пользы от неё по-прежнему хватает: она быстро показывает, что текст писали под задание с числом вхождений, а не под человека, который ищет мастера.
Читать её нужно вместе с жанром и длиной. Три повтора в коротком посте — норма, четырнадцать в тексте на три тысячи знаков — переспам. И ни одно значение не отменяет главной проверки: прочитать вслух и услышать, где спотыкаешься.
Посмотреть обе тошноты, водность, читабельность и среднюю длину предложений можно бесплатно, без регистрации и без отправки текста на сервер — dobro-code.ru/text-quality. Инструмент подсвечивает самые частые слова, так что видно не только число, но и что именно его набрало.
Ещё в рубрике «Голос бренда и редакция»
Текст не прошёл проверку на машинный: семь приёмов правки
Что делать с текстом, которому детектор поставил высокую оценку: семь приёмов правки с примерами до и после, порядок работы и случаи, когда на процент можно не смотреть.
Голос бренда и редакцияНегативный отзыв: разбор ответа по шагам
Почему первая реакция почти всегда неверная, из каких пяти частей состоит ответ, который снимает напряжение, что делать с несправедливым отзывом и как отвечать, когда клиент прав.
Голос бренда и редакцияЧто делать, если о вас пишут неправду: порядок действий
Как отличить несправедливый отзыв от заведомо ложного, что можно сделать своими силами, когда обращаться к площадке, где начинается правовая плоскость и почему публичный ответ важнее удаления.