Головна / База знань / Словник термінів / Закон Ципфа: що означає ця метрика в аналізі тексту

Закон Ципфа: що означає ця метрика в аналізі тексту

Словник термінів 2 хв читання Оновлено 12.09.2026
Звідки взялася закономірність розподілу частот слів, навіщо її рахують SEO-інструменти та детектори ІІ-тексту, як читати показник і чого він не доводить.

Закон Ципфа — емпіричне спостереження: у природному тексті частота слова обернено пропорційна його місцю в рейтингу частот. Найчастіше слово зустрічається приблизно вдвічі частіше другого, втроє частіше третього і так далі.

Звідки він взявся

Закономірність описав лінгвіст Джордж Ципф у першій половині двадцятого століття, а пізніше її знайшли далеко за межами мови — у розмірах міст, доходах, відвідуваності сайтів. Для текстів вона тримається дивовижно стійко: на будь-якому достатньо великому природному тексті розподіл частот лягає на одну й ту ж криву.

Навіщо це в SEO-інструментах

Відхилення від кривої — непрямий показник того, що текст писали не зовсім звичайним способом: переспамили ключовими словами, зібрали з шаблонів або згенерували. Тому показник використовують в аналізі тексту: в нашому детекторі ІІ-тексту він одна з тринадцяти незалежних метрик і відповідає за розподіл частот слів.

Як читати цей показник
По одній метриці висновків не роблять. Високе відповідність кривій не доводить, що текст писав людина, а низьке — що машина: короткі тексти, вузькі терміни і списки порушують розподіл самі по собі. Дивіться на весь набір метрик і на здоровий глузд, см. як читати результат перевірки.

Практична користь для текстів

  • Діагностика переспаму: якщо ключове слово вибивається з розподілу, воно повторюється занадто часто — це видно і аналізом щільності.
  • Оцінка словникового багатства: плоске розподіл говорить про бідну мову.
  • Порівняння з конкурентами: корисніше абстрактних норм — дивіться, як виглядають тексти з топу.

Простий приклад

Візьміть будь-який великий текст і порахуйте частоти слів. Верхні позиції майже завжди займуть службові слова — прийменники, сполучники, займенники, — і їх частоти будуть зменшуватися за передбачуваною кривою. Значущі слова теми розташовуються нижче, і саме їхня частка показує, про що текст. Якщо ж тематичне слово раптом опиняється на самому верху поруч з прийменниками, це і є переспам, видимий без жодних інструментів.

Чого закон не робить

Він не впливає на ранжування безпосередньо і не є фактором. Це вимірювальний інструмент, а не правило, якому потрібно відповідати: підганяти текст під криву безглуздо.

Часті питання

Що означає показник закону Ципфа в детекторі?
Наскільки розподіл частот слів у тексті схоже на природне. Це одна з тринадцяти метрик, і висновки по ній однієї не роблять.
Чи впливає закон Ципфа на ранжування?
Ні. Це вимірювальний інструмент, а не фактор: підганяти текст під криву безглуздо.
Чим він корисний на практиці?
Допомагає помітити переспам ключовим словом і бідність словника, особливо в порівнянні з текстами з топу.
Чи була стаття корисною?
Спробуйте на своєму проєкті Все, що описано в статті, доступно в кабінеті — бонус при реєстрації вже на балансі.
Відкрити кабінет