Про llms.txt сейчас пишут так, будто это новый robots.txt и без него вас не увидит ни один ИИ. Я поставил этот файл на реальный проект, замерил, что из этого вышло, и ниже — честный ответ: файл дешёвый, вреда не делает, но результат дало другое.
Что такое llms.txt простыми словами
Это обычный текстовый файл в формате Markdown, лежащий по адресу `/llms.txt`. Внутри — структурированный перечень того, что есть на сайте: разделы, ключевые страницы, короткое пояснение к каждой ссылке. Замысел в том, чтобы языковая модель, зашедшая на сайт, за один запрос поняла его структуру, а не собирала её по крохам из HTML.
Формально это предложение сообщества, а не стандарт. Никто из крупных поисковиков не обязывался его читать, и вот что из этого вышло на самом деле.
Кто llms.txt читает, а кто нет
| Система | Использует ли llms.txt | Источник |
|---|---|---|
| Google Search | Нет | официальное заявление, июнь 2026 |
| Google AI Overviews | Нет | там же |
| ChatGPT (режим browse) | Да, при заходе на сайт | поведение краулера |
| Perplexity | Да | поведение краулера |
| Bing / Copilot | Не подтверждено | — |
То есть половина смысла отпадает сразу: крупнейший источник ИИ-ответов — Google — файл игнорирует. Остаются ChatGPT и Perplexity, и именно там мы увидели трафик.
Что показали цифры
Проект — сайт производителя сухого льда. Замер Microsoft Clarity за 46 дней, отдельных вложений в ИИ-канал не было никаких.
| Источник | Сессий за 46 дней | За последние 30 дней |
|---|---|---|
| 1 254 | 867 | |
| Прямые заходы | 319 | 137 |
| 87 | 37 | |
| ChatGPT | 52 | 29 |
| Bing | 12 | 12 |
ChatGPT — четвёртый источник трафика и третий внешний после Google и Instagram. В 4,3 раза больше, чем Bing. Причём 29 из 52 сессий пришлись на последние 30 дней: канал не гаснет, а растёт.
Сразу оговорка, чтобы не пересказывали неточно: Clarity даёт две разные цифры — источник «ChatGPT» показывает 52, а канал «AIPlatform» в её же классификации показывает 13. Это особенность того, как она раскладывает трафик, а не два разных измерения. Корректно ссылаться на источник.
Что на самом деле дало этот трафик
llms.txt на сайте есть, и я не буду делать вид, что он ничего не дал. Но если честно разложить работы по вкладу, порядок будет такой.
- Чистый HTML без JavaScript. До работ главная страница отдавала краулеру пустой контейнер с лоадером — весь контент появлялся после гидратации. GPTBot, PerplexityBot и ClaudeBot не выполняют JavaScript: они видели пустую страницу. Это была самая дорогая ошибка проекта, и починили её первой.
- Разметка Schema.org. Organization, WebSite, Product, ItemList, FAQPage, BreadcrumbList, LocalBusiness, Service, AggregateRating. Одиннадцать сущностей на одной главной. Модель получает факты в машиночитаемом виде, а не выгребает их из вёрстки.
- FAQ в формате «вопрос как его задаёт человек — ответ в первых 40 словах». Пять пар на главной, шестнадцать на отдельной странице, свои на каждой городской. Это самый удобный для цитирования формат, какой бывает.
- Числовые факты в тексте. −78,5 °C, потеря 10% массы в сутки, 400 кг/ч мощности, гранулы 3/16/19 мм, цены 75/60/55 грн за кг. Модель цитирует конкретику, а не «высокое качество по доступной цене».
- Разрешение ботам в robots.txt. Восемь краулеров явно разрешены. И тут была ловушка, о которой ниже.
llms.txt идёт шестым пунктом. Он стоит полчаса работы и не вредит — но продавать его как главный инструмент нечестно.
Ловушка в robots.txt, на которой горят почти все
По спецификации robots.txt краулер выполняет только одну группу — наиболее специфичную для себя. Если вы написали отдельную группу для GPTBot, то общая группа `User-agent: *` для него перестаёт существовать целиком, вместе со всеми вашими `Disallow`.
Выглядит это так: вы добавили `User-agent: GPTBot` и `Allow: /`, чтобы разрешить боту индексацию. А заодно, сами того не зная, сняли с него все запреты — и он пошёл в `/api/`, `/basket` и `/thanks`. Именно это мы и нашли на проекте. Лечится просто: в каждой группе для ИИ-бота дублируются свои `Disallow`.
Ставить ли llms.txt
Ставьте. Полчаса работы, вреда нет, ChatGPT и Perplexity его читают. Но не ждите от него чуда и не платите за него как за услугу: если сайт отдаёт пустой HTML, никакой llms.txt не поможет, потому что читать будет нечего. Сначала — SSR, разметка и FAQ, и только потом файл. Как устроена техническая база, с которой это всё работает, разобрали на странице SEO-продвижения.


