llms.txt: файл, который продают как обязательный. Данные говорят обратное
Коротко: llms.txt — текстовый файл в корне сайта с оглавлением для нейросетей. Его продают как обязательный пункт продвижения. Исследование 137 210 доменов показало: у 97% таких файлов ноль запросов. Google 15 июня 2026 года записал в официальном руководстве, что поиск эти файлы игнорирует. Смысл файл имеет там, где есть большая техническая документация; сайту услуг он ничего не дает.
Предложение звучит красиво. Кладете в корень сайта, рядом с robots.txt, текстовый файл: название компании, строчка о том, чем занимаетесь, список ссылок на важные страницы с пояснениями. Нейросети читают его вместо того, чтобы продираться через меню и баннеры, и начинают вас рекомендовать.
Логика в этом есть. Обычная страница — это шапка, всплывающие окна, кнопки и текст, размазанный по блокам. Модель тратит на разбор половину внимания, а файл-оглавление выглядит разумной идеей.
Проблема в том, что идея так и осталась идеей. Ниже — данные и мои собственные замеры.
Продвижение в нейросетях
Что показывают данные
Ahrefs проверил 137 210 доменов по логам за май 2026 года, исследование опубликовано 15 июня.
Файл лежит у 28% сайтов — это 38 360 доменов. Хоть какой-то трафик получили около 1 100 из них.
Дальше интереснее — кто эти файлы все-таки запрашивает.
- SEO-аудиторы — 21,7% обращений
- неопознанные боты — 14,9%
- обычные краулеры вроде Googlebot и Amazonbot — 13,1%
- сервисы анализа технологий сайта — 11,6%
- боты, изучающие сам стандарт — 12,1%
- ИИ-агенты вроде Claude-Code — 10,5%
- краулеры обучения моделей — 5,3%
- ассистенты — 2,5%
- поисковые ИИ-боты, те самые, ради которых файл и кладут, — 1,1%
Разберем эти проценты, потому что тут легко передернуть в обе стороны. ИИ-ботов суммарно 19,5% — цифра приличная. Но внутри нее почти все обращения делают программные агенты, которые ходят по документации в момент работы над кодом. Поисковые боты, те самые, что формируют ответ в чате и ради которых файл кладут на сайт услуг, дают 1,1%. А больше всего файл читают SEO-сервисы, проверяющие, есть ли у вас файл для нейросетей.
Продвижение в нейросетях
Что сказал Google
Сначала это была позиция сотрудников. Гэри Илш на Search Central Live говорил, что формат не поддерживается и поддерживать его не планируют. Джон Мюллер в июне 2025 года сравнил llms.txt с мета-тегом keywords — тем самым, который поисковики игнорируют больше десяти лет, потому что его пишет владелец сайта.
15 июня 2026 года Google вынес это в официальное руководство по оптимизации под ИИ, отдельным разделом про llms.txt. Формулировка там прямая: файлы не нужны для попадания в поиск Google, их наличие не повредит и не поможет видимости, потому что поиск их игнорирует.
У llms.txt нет статуса стандарта. Это договоренность сообщества, за ней не стоит ни W3C, ни IETF. Никто не обязан ее соблюдать, и механизма принуждения не существует.
Продвижение в нейросетях
Моя собственная проверка
Чужие исследования — это чужие исследования, и на российском рынке они могут не работать вовсе. Я взял 15 крупных российских сайтов из разных ниш — маркетплейсы, банки, поиск работы, доставка, медиа, онлайн-образование — и запросил у каждого адрес /llms.txt так, как это сделал бы краулер нейросети.
Замер от 9 сентября 2026 года: настоящий файл отдал ровно один сайт — «Нетология». У остальных четырнадцати его нет: семь отвечают 404, четыре закрыты защитой от ботов, два уводят в редирект, один отдает ошибку сервера.
Один случай стоит разобрать отдельно, потому что на нем легко ошибиться. У «ДНС» адрес /llms.txt отвечает кодом 200 — и любой чек-лист поставит галочку «файл есть». Внутри лежит страница редиректа nginx на 164 байта. Файла нет, а проверка пройдена.
И вторая деталь, у единственного, кто файл действительно сделал. Он весит 362 килобайта: туда выгружен каталог курсов целиком, ссылка за ссылкой. Смысл llms.txt в том, чтобы дать модели короткое оглавление; у самого стандарта на llmstxt.org файл занимает 637 байт. То есть даже единственный пример на рынке сделан не так, как задумано.
Отдельная деталь, которую видно только машинной проверкой. Почти все сайты на несуществующий адрес отдают вместо короткого «страницы нет» полноразмерную HTML-страницу: у одного 364 килобайта, у другого 74. Для человека это красивая заглушка. Для краулера — сотни килобайт мусора вместо ответа в одну строку. Вот это уже реальная проблема, и она не про llms.txt.
Продвижение в нейросетях
Когда файл все-таки имеет смысл
Честность требует показать и вторую сторону, иначе получится такое же передергивание, только с обратным знаком.
Anthropic рекомендует llms.txt в своем руководстве по написанию материалов для ИИ-агентов и держит такой файл у собственной документации. Perplexity замечена за тем, что подтягивает llms.txt и учитывает его при выборе страниц. OpenAI держит файл для своих Agents SDK и Agentic Commerce Protocol.
Заметьте закономерность: во всех трех случаях речь о документации, по которой ходят программные агенты. Не о поисковом трафике.
Отсюда рабочее правило. Файл имеет смысл, если у вас большая техническая документация, база знаний или API, и ваши пользователи разбираются в продукте через ИИ-ассистентов. Тогда llms.txt — удобное оглавление для агента, и оно правда работает.
Если у вас сайт услуг на десять страниц и вы ждете от файла клиентов из ChatGPT — данные выше про вас.
Продвижение в нейросетях
Типичная ошибка тех, кто файл сделал
Недавно я разбирал сайт крупного финтех-продукта. llms.txt там был — аккуратный, с восемью ссылками на документы: политика, условия, реквизиты, оферта.
Проблема оказалась в самом сайте. Пять из восьми адресов отдавали вместо документа главную страницу: сайт собран на JavaScript, а отдельные версии для роботов сделаны только для трех адресов. Остальные возвращали код 200 и все ту же главную.
Модель, честно пройдя по ссылкам, пять раз прочитала одну и ту же главную и ни одного документа.
Поэтому проверка файла — это не чтение файла. Это проход по каждой ссылке из него.
Продвижение в нейросетях
Что делать вместо
Три вещи, которые действительно влияют на то, попадете ли вы в ответы нейросетей. Все три бесспорны, в отличие от llms.txt.
- Откройте краулерам доступ: проверьте robots.txt, не закрыты ли GPTBot, ClaudeBot, PerplexityBot, YandexBot, Google-Extended
- Отдавайте текст без JavaScript: если содержимое появляется только после выполнения скриптов, часть краулеров увидит пустоту
- Отвечайте на вопросы прямо: цена, сроки, условия, что входит — абзац «мы команда профессионалов» в ответ не попадет никогда
Если после этого останется время и желание — сделайте llms.txt. Полчаса работы, вреда нет, а через год ситуация может измениться. Но ставить его в начало списка, как предлагают некоторые подрядчики, оснований нет.
Вывод
Что сделать сегодня
Откройте свой сайт по адресу /robots.txt и посмотрите, не закрыты ли там ИИ-краулеры. Это займет минуту и скажет о ваших шансах попасть в ответы нейросетей больше, чем любой новый файл.
А если подрядчик выставляет llms.txt отдельной строкой в смете — покажите ему цифру 97% и спросите, на какие данные он опирается. Разговор станет предметным.
Разборы и замеры с живых сайтов я публикую у себя в канале: t.me/safronov_ads. Больше материалов — на safronov-marketing.ru
Коротко
Ответы на частые вопросы
Чем llms.txt отличается от robots.txt?+
robots.txt говорит роботам, куда ходить нельзя, и его соблюдают все крупные краулеры. llms.txt показывает, куда стоит сходить, и его не обязан соблюдать никто. Первый — рабочий инструмент, второй — предложение сообщества без статуса стандарта.
Нам сказали, что без llms.txt мы не попадем в ChatGPT. Это правда?+
Нет. OpenAI не объявляла, что ее краулер учитывает чужие llms.txt при веб-поиске. Попадание в ответы зависит от доступа краулеров в robots.txt, читаемости страниц без JavaScript и того, отвечаете ли вы на вопрос прямо.
Стоит ли платить подрядчику за настройку llms.txt?+
Как за отдельную услугу — нет. Файл собирается за полчаса. Платить имеет смысл за то, что действительно меняет картину: доступ краулеров, отдачу текста без скриптов, структуру страниц под конкретные вопросы клиентов.
А если конкуренты сделали, а мы нет?+
По данным Ahrefs, у 97% таких файлов ноль запросов, так что преимущества он не дает. Проверьте лучше, открыты ли у конкурента ИИ-краулеры в robots.txt — вот эта разница работает.
Каким должен быть файл, если мы решили его сделать?+
Коротким. Название, одна строка о компании, от пяти до пятнадцати ссылок с пояснением, что за каждой лежит. У самого стандарта на llmstxt.org файл весит 637 байт — это и есть ориентир.
Это может измениться в будущем?+
Может. Формату меньше двух лет, доля ИИ-поиска растет. Разумная позиция такая: не вкладываться, но и не игнорировать — сделать один раз и вернуться к вопросу, когда появятся данные.
Источники: исследование Ahrefs по 137 210 доменам, май 2026, опубликовано 15 июня (ahrefs.com/blog/llmstxt-study); раздел про llms.txt в руководстве Google по оптимизации под ИИ от 15 июня 2026 года; спецификация llmstxt.org. Проверка 15 российских сайтов — собственный замер 9 сентября 2026 года.