propisyu.by

Частотный анализ текста

Показывает, какие слова встречаются чаще всего, и считает водность.

Текст
из 200 000

Как устроен инструмент

Частотный анализ показывает, вокруг каких слов на самом деле построен текст. Это первое, что стоит сделать перед оптимизацией страницы: если ключевое слово не попало в топ, поисковик тоже вряд ли поймёт, о чём материал.

Служебные слова — предлоги, союзы, частицы, местоимения — по умолчанию исключены из подсчёта. Иначе верх списка занимают «и», «в» и «на», и толку от такого рейтинга нет.

Водность — доля служебных слов от общего числа. Нормой обычно считают 40–60 процентов: ниже текст читается сухо и рвано, выше — расплывается. Это ориентир, а не правило: у инструкции и у эссе показатели естественно разные.

Классическая тошнота — квадратный корень из числа повторов самого частого слова. Значение выше 7 обычно означает переспам. Доля самого частого слова показывает то же самое в процентах и понятнее на коротких текстах.

Часто задаваемые вопросы

Почему у одинаковых слов разные формы считаются отдельно?

Пока анализ идёт по словоформам: «текст» и «тексты» — две разные строки. Приведение к начальной форме появится вместе с морфологическим словарём.

Какая водность считается нормальной?

Для большинства текстов ориентир — 40–60 процентов. Слишком низкая водность означает перегруженный, тяжёлый для чтения текст, слишком высокая — что смысла в нём мало. Оценивать стоит вместе с типом материала.

Совпадают ли показатели с биржами контента?

Не обязательно. У каждой биржи свои формулы и свои списки служебных слов, и они закрыты. Здесь формулы описаны явно: тошнота — корень из числа повторов, водность — доля служебных слов. Числа стоит сравнивать между своими текстами, а не с чужими сервисами.

Другие полезные инструменты