Анализ качества текста
Проверьте водность, тошноту, читабельность и штампы онлайн и бесплатно — прямо в браузере, без регистрации и отправки текста на сервер. Наведите порядок в тексте до публикации.
Что означают метрики и какие значения считать нормой
Инструмент не ставит оценку тексту — он показывает пять измеримых признаков, по которым видно, где текст читается тяжело. Ниже разобрано, откуда берётся каждое число, какая граница считается нормой и что делать, если значение вышло за неё. Метрики применимы к тексту от 50 слов: на более коротком фрагменте частоты слишком шумные, и инструмент честно об этом предупреждает.
Водность
Доля стоп-слов — предлогов, союзов, частиц, вводных, усилителей и слов-пустышек — среди всех слов текста. Эти слова нужны языку, но когда их слишком много, предложение переносит меньше смысла, чем занимает места.
Норма — до 15%. От 15 до 30% стоит перечитать, выше 30% — текст размыт.
Уберите усилители («очень», «действительно»), вводные обороты и связки, которые ничего не добавляют. Разбивка по группам под метрикой показывает, какой именно категории в тексте больше всего.
Тошнота
Насколько часто повторяются одни и те же слова. Академическая тошнота — суммарная доля повторов по основам слов без учёта стоп-слов; классическая — корень из частоты самого частого слова. Высокая тошнота обычно означает не переспам ключом, а бедный словарь.
Норма академической — до 8%, тревожно после 12%. У классической норма — до 3.
Замените часть повторов синонимами или местоимениями, а часть — уберите: обычно половина повторений приходится на фразы, которые можно сократить целиком.
Читабельность
Индекс Флеша в адаптации Оборневой для русского языка: считается по средней длине предложения и средней длине слова в слогах. Чем выше значение, тем легче текст читается.
Норма — от 60. Значения от 30 до 60 требуют внимания, ниже 30 текст тяжёл для широкой аудитории.
Низкий индекс лечится не «упрощением мысли», а короткими предложениями и заменой длинных отглагольных существительных глаголами: «осуществлять проверку» → «проверять».
Длина предложений
Среднее число слов в предложении. Отдельно инструмент подсвечивает предложения длиннее 30 слов — именно на них читатель чаще всего теряет нить.
Норма — до 20 слов в среднем, после 25 текст читается с усилием.
Делите подсвеченные предложения по границам придаточных. Ровный ритм важнее среднего значения: текст из одинаково коротких фраз тоже читается плохо.
Клише и штампы
Узнаваемые пустые конструкции — «в современном мире», «важно отметить», «играет важную роль». В этот же список входят обороты, характерные для текстов, сгенерированных нейросетью без редактуры.
Норма — ноль. Одно-два вхождения терпимы, больше двух заметны читателю.
Штамп почти всегда удаляется без потери смысла: вычеркните фразу и перечитайте предложение. Если смысл не изменился — она была лишней.
Частые вопросы об анализе текста
Текст уходит на сервер?
Нет. Разбор целиком выполняется в браузере: текст не отправляется на наши серверы, не сохраняется и не попадает в логи. Страницу можно закрыть — ничего не останется.
Почему значения отличаются от других сервисов?
Списки стоп-слов и формулы у сервисов разные, поэтому совпадения цифра в цифру не будет ни у одной пары инструментов. Под каждой метрикой раскрывается блок «Как считается» с точной формулой — по нему видно, что именно измеряется.
Почему на коротком тексте метрики не показываются?
Ниже 50 слов частотные метрики дают шум: одно повторённое слово уводит тошноту в красную зону, а одно длинное предложение — читабельность. Показывать такие числа как результат было бы враньём, поэтому инструмент предупреждает, что текст слишком короткий.
Нужно ли добиваться зелёных значений по всем метрикам?
Нет. Это диагностика, а не оценка: у юридического документа читабельность будет низкой по существу жанра, а у короткой новости — высокая тошнота из-за повтора темы. Смотрите на метрики, которые разошлись с нормой сильно, и на подсветку в тексте.
Помогает ли это проверить текст, написанный нейросетью?
Отчасти. Штампы и повторы — типичные следы генерации без редактуры, и они видны по метрикам «Клише» и «Тошнота». Но метрики измеряют качество текста, а не его происхождение: отредактированный ИИ-текст будет выглядеть как хороший человеческий, и это нормально.
Проверяйте качество на потоке, а не по одному тексту
В кабинете те же метрики считаются для каждого материала контент-плана — до публикации и без ручного копирования в форму.