Главная / База знаний / Словарь терминов / Закон Ципфа: что означает эта метрика в анализе текста

Закон Ципфа: что означает эта метрика в анализе текста

Словарь терминов 2 мин чтения Обновлено 12.09.2026
Откуда взялась закономерность распределения частот слов, зачем её считают SEO-инструменты и детекторы ИИ-текста, как читать показатель и чего он не доказывает.

Закон Ципфа — эмпирическое наблюдение: в естественном тексте частота слова обратно пропорциональна его месту в рейтинге частот. Самое частое слово встречается примерно вдвое чаще второго, втрое чаще третьего и так далее.

Откуда он взялся

Закономерность описал лингвист Джордж Ципф в первой половине двадцатого века, а позже её нашли далеко за пределами языка — в размерах городов, доходах, посещаемости сайтов. Для текстов она держится удивительно устойчиво: на любом достаточно большом естественном тексте распределение частот ложится на одну и ту же кривую.

Зачем это в SEO-инструментах

Отклонение от кривой — косвенный признак того, что текст писали не совсем обычным способом: переспамили ключевыми словами, собрали из шаблонов или сгенерировали. Поэтому показатель используют в анализе текста: в нашем детекторе ИИ-текста он одна из тринадцати независимых метрик и отвечает за распределение частот слов.

Как читать этот показатель
По одной метрике выводов не делают. Высокое соответствие кривой не доказывает, что текст писал человек, а низкое — что машина: короткие тексты, узкие термины и списки нарушают распределение сами по себе. Смотрите на весь набор метрик и на здравый смысл, см. как читать результат проверки.

Практическая польза для текстов

  • Диагностика переспама: если ключевое слово выбивается из распределения, оно повторяется слишком часто — это видно и анализом плотности.
  • Оценка словарного богатства: плоское распределение говорит о бедном языке.
  • Сравнение с конкурентами: полезнее абстрактных норм — смотрите, как выглядят тексты из топа.

Простой пример

Возьмите любой большой текст и посчитайте частоты слов. Верхние позиции почти всегда займут служебные слова — предлоги, союзы, местоимения, — и их частоты будут убывать по предсказуемой кривой. Значимые слова темы располагаются ниже, и именно их доля показывает, о чём текст. Если же тематическое слово вдруг оказывается в самом верху рядом с предлогами, это и есть переспам, видимый без всяких инструментов.

Чего закон не делает

Он не влияет на ранжирование напрямую и не является фактором. Это измерительный инструмент, а не правило, которому нужно соответствовать: подгонять текст под кривую бессмысленно.

Частые вопросы

Что означает показатель закона Ципфа в детекторе?
Насколько распределение частот слов в тексте похоже на естественное. Это одна из тринадцати метрик, и выводы по ней одной не делают.
Влияет ли закон Ципфа на ранжирование?
Нет. Это измерительный инструмент, а не фактор: подгонять текст под кривую бессмысленно.
Чем он полезен на практике?
Помогает заметить переспам ключевым словом и бедность словаря, особенно в сравнении с текстами из топа.
Была ли статья полезна?
Попробуйте на своём проекте Всё, что описано в статье, доступно в кабинете — бонус при регистрации уже на балансе.
Открыть кабинет