llms.txt: Google говорит, что не читает его. Кому тогда он нужен
Google в своём руководстве пишет, что Поиск игнорирует llms.txt и файл не влияет на видимость ни в плюс, ни в минус. При этом Lighthouse в Chrome его проверяет — отсюда и путаница. Разбираем, кто файл публикует на самом деле, кто его читает и в каком случае делать его стоит.
За последний год llms.txt превратился в обязательный пункт чек-листов и отдельную строку в коммерческих предложениях. Аргумент везде один: «чтобы вас видели нейросети». Google при этом документально заявил, что его поиск этот файл просто игнорирует. Разберёмся, что это за файл, кто его действительно читает, и в каком случае делать его всё-таки стоит.
Что это за файл
Предложение llms.txt опубликовал Джереми Ховард в сентябре 2024 года. Идея простая и на первый взгляд разумная: HTML-страница сделана для человека — навигация, реклама, скрипты, — и вытащить из неё чистый текст модели сложно. Значит, положим в корень сайта markdown-файл, где коротко описано, что это за проект, и собраны ссылки на действительно важные документы.
Формат минималистичный: заголовок первого уровня с названием проекта — единственная обязательная часть, — краткое описание в виде цитаты, при желании произвольные пояснения, а дальше списки ссылок, сгруппированные заголовками второго уровня.
Важная деталь, которую в коммерческих предложениях обычно опускают: это не стандарт. Это предложение одного человека, открытое для обсуждения сообществом. У него нет статуса спецификации W3C или IETF, и ни один поисковик не обязан его поддерживать.
Что говорит Google
Google высказался предельно однозначно — в собственном руководстве по оптимизации под генеративные функции поиска.
«Вам не нужно создавать новые машиночитаемые файлы, ИИ-текстовые файлы, разметку или Markdown, чтобы появляться в Google Поиске… сам Google Поиск их не использует».
«Это не навредит и не поможет видимости или позициям вашего сайта в Google Поиске, поскольку Google Поиск их игнорирует».
Google Search Central, руководство по оптимизации под генеративные ИИ-функции поискаФормулировка не оставляет пространства для трактовок: не «пока не используем», не «влияние незначительно», а «игнорирует». Поэтому любое предложение «оптимизировать llms.txt для лучшего ранжирования в Google» продаёт то, чего по документации поставщика не существует.
В том же документе Google снимает и второй популярный миф — про обязательную разметку:
«Структурированные данные не требуются для генеративного ИИ-поиска, и нет специальной разметки schema.org, которую нужно добавить».
Google Search CentralА на вопрос, что же тогда работает, отвечает так: лучшие практики SEO остаются актуальными, потому что генеративные функции построены на тех же системах ранжирования и оценки качества, что и обычный поиск. Требование к странице ровно одно и хорошо знакомое: она должна быть проиндексирована и иметь право показываться со сниппетом.
Откуда взялась путаница: Chrome проверяет то, что Поиск игнорирует
Здесь и кроется причина, по которой рынок уверен в обратном. С мая 2026 года в Lighthouse — встроенном в Chrome инструменте аудита — категория «Agentic Browsing» включена в конфигурацию по умолчанию, и каждый отчёт теперь содержит проверку llms.txt. Она смотрит, есть ли файл, есть ли в нём заголовок первого уровня, не слишком ли он короткий и содержит ли ссылки.
Дальше происходит понятное: специалист запускает Lighthouse, видит непройденную проверку в инструменте от Google и делает вывод, что Google этот файл требует. А клиент видит красную отметку в отчёте и просит её закрыть.
Противоречия здесь нет, есть разные адресаты. Категория в Lighthouse помечена как экспериментальная, у неё нет привычной оценки от 0 до 100 — только доля пройденных проверок, — и сам инструмент описывает llms.txt как сигнал обнаружения для ИИ-агентов, а не как директиву для поисковых роботов. То есть Chrome измеряет готовность сайта к агентам, которые по нему ходят, а Поиск при ранжировании файл не читает. Оба утверждения принадлежат Google и говорят о разных вещах.
Практический вывод: непройденная проверка в Lighthouse не означает проблему с SEO. Это отдельная экспериментальная метрика, и трактовать её как фактор ранжирования — ошибка, которая дорого продаётся.
Кто его публикует на самом деле
Расхожий аргумент в пользу файла звучит так: «его публикуют все крупные ИИ-компании, значит, он важен». Мы решили проверить это руками, а не поверить на слово. Запросили /llms.txt по адресам документации 6 августа 2026 года.
| Адрес | Ответ | Что там |
|---|---|---|
docs.anthropic.com/llms.txt | 200 | 58 КБ, документация для разработчиков |
docs.perplexity.ai/llms.txt | 200 | 42 КБ, документация Perplexity |
llmstxt.org/llms.txt | 200 | 0,6 КБ, сайт самого предложения |
platform.openai.com/llms.txt | 404 | файла нет |
ai.google.dev/llms.txt | 404 | файла нет |
developers.google.com/llms.txt | 404 | файла нет |
Картина оказалась вдвое скромнее расхожей. Файл есть у Anthropic и Perplexity, но по проверенным адресам его нет ни у OpenAI, ни у Google. Оговоримся честно: компания может публиковать файл по другому пути, и наличие файла на одном поддомене ничего не говорит про остальные. Но утверждение «его публикуют все» проверку не проходит.
Публиковать и читать — разные вещи
И это главная подмена в спорах вокруг llms.txt. То, что компания выкладывает такой файл у своей документации, не означает, что её модель читает чужие такие файлы, когда отвечает пользователю. Это два совершенно разных действия.
С публикацией всё прозрачно: файлы существуют, их можно открыть и посмотреть. С чтением сложнее — публичных обязательств «мы используем ваш llms.txt при формировании ответов» никто из крупных поставщиков поиска не давал. Единственное однозначное заявление на эту тему принадлежит Google, и оно отрицательное.
Где файл работает предсказуемо — это инструменты, которым вы сами его скармливаете. Кодинговые агенты, ассистенты по документации, внутренние помощники: там llms.txt выступает картой, по которой инструмент понимает, какие страницы вашей документации главные. Именно поэтому его автоматически генерируют платформы документации, и именно поэтому он есть у Anthropic и Perplexity — у обеих это документация для разработчиков, которую читают агенты.
Так делать или нет
Ответ зависит от того, ради кого вы его делаете, и почти не зависит от SEO.
Что делать вместо этого
Раз Google прямо назвал, что имеет значение, разумно этим и заняться — тем более что список короткий и скучный.
Убедиться, что страницы в индексе. Единственное жёсткое требование, которое Google формулирует для показа в генеративных функциях: страница должна быть проиндексирована и иметь право показываться со сниппетом. Страница вне индекса не попадёт ни в обычную выдачу, ни в ИИ-ответ — и никакой файл в корне сайта этого не изменит.
Не резать сниппеты без необходимости. Директивы nosnippet и max-snippet, поставленные когда-то против парсеров, исключают страницу и из генеративных функций тоже.
Писать то, чего нет у других. Google в том же руководстве просит «ценный, не типовой контент» с собственной точкой зрения. Это не лозунг, а прямое следствие того, как устроен генеративный ответ: пересказ общеизвестного в него попадать незачем, он и так есть.
Ничего из этого не выглядит новинкой — и в этом суть. Генеративные функции построены на тех же системах ранжирования, что и обычный поиск, поэтому и работает в них то же самое.
То единственное требование, которое Google действительно назвал. Проверка бесплатная.
Частые вопросы
Что такое llms.txt простыми словами?
Это markdown-файл в корне сайта, где кратко описано, что это за проект, и собраны ссылки на главные документы — чтобы языковой модели не приходилось разбирать HTML. Предложение опубликовал Джереми Ховард в сентябре 2024 года. Это не стандарт, а открытая инициатива.
Влияет ли llms.txt на позиции в Google?
Нет. Google в своём руководстве прямо пишет, что не нужно создавать машиночитаемые файлы, ИИ-текстовые файлы или Markdown, чтобы появляться в поиске, и что это не навредит и не поможет видимости, поскольку Google Поиск их игнорирует.
Помогает ли llms.txt попасть в AI Overviews?
Нет. Генеративные функции Google построены на тех же системах ранжирования, что и обычный поиск, и отдельного канала через файл в корне сайта не существует. Требование к странице то же самое: быть проиндексированной и иметь право показываться со сниппетом.
Кто вообще использует llms.txt?
Достоверно известно про публикацию: файл есть у документации Anthropic и Perplexity, его автоматически генерируют платформы документации, и его читают кодинговые агенты и ассистенты, которым его дают напрямую. Публичных обязательств использовать чужой llms.txt при формировании ответов крупные поставщики поиска не давали.
Может ли llms.txt навредить сайту?
Само по себе наличие файла — нет, Google его просто игнорирует. Вред возможен косвенный: устаревший файл со ссылками на удалённые страницы вводит в заблуждение те инструменты, которые его всё-таки читают, а время на ручное ведение тратится без измеримой отдачи.
Нужна ли разметка schema.org для попадания в ИИ-ответы?
По документации Google — нет: структурированные данные не требуются для генеративного ИИ-поиска, и специальной разметки для этого не существует. Разметка остаётся полезной для расширенных результатов обычной выдачи, но это другая задача.
Источники
Google Search Central, руководство по оптимизации под генеративные ИИ-функции поиска: формулировки про машиночитаемые файлы, структурированные данные и требования к странице.
llmstxt.org — предложение llms.txt, первая публикация 3 сентября 2024 года, автор Джереми Ховард: формат и статус инициативы.
Собственная проверка, 6 августа 2026: запрос /llms.txt по шести адресам документации, коды ответов приведены в таблице.