Световая документ-пластина передаёт данные нескольким приёмникам, один из которых закрыт

llms.txt: зачем он нужен и почему Google его не читает

llms.txt подают как новый robots.txt, без которого вас не увидит ни один ИИ. Поставил его на живой проект и замерил: ChatGPT дал в 4,3 раза больше трафика, чем Bing, но сделал это не файл. Разбираю, что сработало на самом деле.

Fedir AlpatovFedir Alpatov· Founder & Tech Lead31 авг 20267 мин чтения

Про llms.txt сейчас пишут так, будто это новый robots.txt и без него вас не увидит ни один ИИ. Я поставил этот файл на реальный проект, замерил, что из этого вышло, и ниже — честный ответ: файл дешёвый, вреда не делает, но результат дало другое.

Что такое llms.txt простыми словами

Это обычный текстовый файл в формате Markdown, лежащий по адресу `/llms.txt`. Внутри — структурированный перечень того, что есть на сайте: разделы, ключевые страницы, короткое пояснение к каждой ссылке. Замысел в том, чтобы языковая модель, зашедшая на сайт, за один запрос поняла его структуру, а не собирала её по крохам из HTML.

Формально это предложение сообщества, а не стандарт. Никто из крупных поисковиков не обязывался его читать, и вот что из этого вышло на самом деле.

Кто llms.txt читает, а кто нет

СистемаИспользует ли llms.txtИсточник
Google SearchНетофициальное заявление, июнь 2026
Google AI OverviewsНеттам же
ChatGPT (режим browse)Да, при заходе на сайтповедение краулера
PerplexityДаповедение краулера
Bing / CopilotНе подтверждено

То есть половина смысла отпадает сразу: крупнейший источник ИИ-ответов — Google — файл игнорирует. Остаются ChatGPT и Perplexity, и именно там мы увидели трафик.

Что показали цифры

Проект — сайт производителя сухого льда. Замер Microsoft Clarity за 46 дней, отдельных вложений в ИИ-канал не было никаких.

ИсточникСессий за 46 днейЗа последние 30 дней
Google1 254867
Прямые заходы319137
Instagram8737
ChatGPT5229
Bing1212

ChatGPT — четвёртый источник трафика и третий внешний после Google и Instagram. В 4,3 раза больше, чем Bing. Причём 29 из 52 сессий пришлись на последние 30 дней: канал не гаснет, а растёт.

Сразу оговорка, чтобы не пересказывали неточно: Clarity даёт две разные цифры — источник «ChatGPT» показывает 52, а канал «AIPlatform» в её же классификации показывает 13. Это особенность того, как она раскладывает трафик, а не два разных измерения. Корректно ссылаться на источник.

Что на самом деле дало этот трафик

llms.txt на сайте есть, и я не буду делать вид, что он ничего не дал. Но если честно разложить работы по вкладу, порядок будет такой.

  1. Чистый HTML без JavaScript. До работ главная страница отдавала краулеру пустой контейнер с лоадером — весь контент появлялся после гидратации. GPTBot, PerplexityBot и ClaudeBot не выполняют JavaScript: они видели пустую страницу. Это была самая дорогая ошибка проекта, и починили её первой.
  2. Разметка Schema.org. Organization, WebSite, Product, ItemList, FAQPage, BreadcrumbList, LocalBusiness, Service, AggregateRating. Одиннадцать сущностей на одной главной. Модель получает факты в машиночитаемом виде, а не выгребает их из вёрстки.
  3. FAQ в формате «вопрос как его задаёт человек — ответ в первых 40 словах». Пять пар на главной, шестнадцать на отдельной странице, свои на каждой городской. Это самый удобный для цитирования формат, какой бывает.
  4. Числовые факты в тексте. −78,5 °C, потеря 10% массы в сутки, 400 кг/ч мощности, гранулы 3/16/19 мм, цены 75/60/55 грн за кг. Модель цитирует конкретику, а не «высокое качество по доступной цене».
  5. Разрешение ботам в robots.txt. Восемь краулеров явно разрешены. И тут была ловушка, о которой ниже.

llms.txt идёт шестым пунктом. Он стоит полчаса работы и не вредит — но продавать его как главный инструмент нечестно.

Ловушка в robots.txt, на которой горят почти все

По спецификации robots.txt краулер выполняет только одну группу — наиболее специфичную для себя. Если вы написали отдельную группу для GPTBot, то общая группа `User-agent: *` для него перестаёт существовать целиком, вместе со всеми вашими `Disallow`.

Выглядит это так: вы добавили `User-agent: GPTBot` и `Allow: /`, чтобы разрешить боту индексацию. А заодно, сами того не зная, сняли с него все запреты — и он пошёл в `/api/`, `/basket` и `/thanks`. Именно это мы и нашли на проекте. Лечится просто: в каждой группе для ИИ-бота дублируются свои `Disallow`.

Ставить ли llms.txt

Ставьте. Полчаса работы, вреда нет, ChatGPT и Perplexity его читают. Но не ждите от него чуда и не платите за него как за услугу: если сайт отдаёт пустой HTML, никакой llms.txt не поможет, потому что читать будет нечего. Сначала — SSR, разметка и FAQ, и только потом файл. Как устроена техническая база, с которой это всё работает, разобрали на странице SEO-продвижения.

Частые вопросы

Что такое llms.txt?
Текстовый файл в формате Markdown по адресу /llms.txt, описывающий структуру сайта для языковых моделей: разделы, ключевые страницы и короткое пояснение к каждой ссылке. Это предложение сообщества, а не официальный стандарт.
Использует ли Google llms.txt?
Нет. В июне 2026 Google официально заявил, что не использует llms.txt ни в обычном поиске, ни в AI Overviews. Файл читают ChatGPT в режиме browse и Perplexity.
Стоит ли вообще его ставить?
Да, если это полчаса работы. Вреда нет, ChatGPT и Perplexity его читают. Но не платите за него как за отдельную услугу и не делайте его первым шагом: если сайт отдаёт краулеру пустой HTML, файл не спасёт.
Что даёт трафик из ИИ на самом деле?
На нашем проекте — чистый серверный HTML (боты не выполняют JavaScript), разметка Schema.org, FAQ-блоки в формате «вопрос-ответ» и конкретные числовые факты в тексте. llms.txt идёт шестым по вкладу.
Как разрешить ИИ-ботам обход в robots.txt?
Осторожно. По спецификации краулер выполняет только одну, наиболее специфичную для себя группу — и если вы создали отдельную группу для GPTBot, общая группа с вашими Disallow для него перестаёт действовать целиком. Дублируйте нужные запреты в каждой группе.

Обсудить свой проект?

Оставьте контакт — ответим в течение 4 рабочих часов. Без спама и скриптов продаж.