Про llms.txt зараз пишуть так, ніби це нова robots.txt і без нього вас не побачить жоден ШІ. Я поставив цей файл на реальний проєкт, заміряв, що з цього вийшло, і нижче — чесна відповідь: файл дешевий, шкоди не робить, але результат дало інше.
Що таке llms.txt простими словами
Це звичайний текстовий файл у форматі Markdown, який лежить за адресою `/llms.txt`. Всередині — структурований перелік того, що є на сайті: розділи, ключові сторінки, коротке пояснення до кожного посилання. Задум у тому, щоб мовна модель, яка зайшла на сайт, за один запит зрозуміла його структуру, а не збирала її по крихтах з HTML.
Формально це пропозиція спільноти, а не стандарт. Ніхто з великих пошуковиків не зобов'язувався його читати, і от що з цього вийшло насправді.
Хто llms.txt читає, а хто ні
| Система | Чи використовує llms.txt | Джерело |
|---|---|---|
| Google Search | Ні | офіційна заява, червень 2026 |
| Google AI Overviews | Ні | там же |
| ChatGPT (режим browse) | Так, при заході на сайт | поведінка краулера |
| Perplexity | Так | поведінка краулера |
| Bing / Copilot | Не підтверджено | — |
Тобто половина сенсу відпадає одразу: найбільше джерело ШІ-відповідей — Google — файл ігнорує. Залишаються ChatGPT і Perplexity, і саме там ми побачили трафік.
Що показали цифри
Проєкт — сайт виробника сухого льоду. Замір Microsoft Clarity за 46 днів, окремих вкладень у ШІ-канал не було жодних.
| Джерело | Сесій за 46 днів | За останні 30 днів |
|---|---|---|
| 1 254 | 867 | |
| Прямі заходи | 319 | 137 |
| 87 | 37 | |
| ChatGPT | 52 | 29 |
| Bing | 12 | 12 |
ChatGPT — четверте джерело трафіку і третє зовнішнє після Google та Instagram. У 4,3 раза більше за Bing. Причому 29 з 52 сесій припали на останні 30 днів: канал не згасає, а росте.
Одразу застереження, щоб не переказували неточно: Clarity дає дві різні цифри — джерело «ChatGPT» показує 52, а канал «AIPlatform» у її ж класифікації показує 13. Це особливість того, як вона розкладає трафік, а не два різні виміри. Коректно посилатися на джерело.
Що насправді дало цей трафік
llms.txt на сайті є, і я не буду вдавати, що він нічого не дав. Але якщо чесно розкласти роботи за вкладом, порядок буде такий.
- Чистий HTML без JavaScript. До робіт головна сторінка віддавала краулеру порожній контейнер із лоадером — весь контент з'являвся після гідратації. GPTBot, PerplexityBot і ClaudeBot не виконують JavaScript: вони бачили порожню сторінку. Це була найдорожча помилка проєкту, і полагодили її першою.
- Розмітка Schema.org. Organization, WebSite, Product, ItemList, FAQPage, BreadcrumbList, LocalBusiness, Service, AggregateRating. Одинадцять сутностей на одній головній. Модель отримує факти в машиночитаному вигляді, а не вигрібає їх із верстки.
- FAQ у форматі «питання як його ставить людина — відповідь у перших 40 словах». П'ять пар на головній, шістнадцять на окремій сторінці, свої на кожній міській. Це найзручніший для цитування формат, який взагалі буває.
- Числові факти в тексті. −78,5 °C, втрата 10% маси на добу, 400 кг/год потужності, гранули 3/16/19 мм, ціни 75/60/55 грн за кг. Модель цитує конкретику, а не «висока якість за доступною ціною».
- Дозвіл ботам у robots.txt. Вісім краулерів явно дозволені. І тут була пастка, про яку нижче.
llms.txt іде шостим пунктом. Він коштує пів години роботи і не шкодить — але продавати його як головний інструмент нечесно.
Пастка в robots.txt, на якій горять майже всі
За специфікацією robots.txt краулер виконує тільки одну групу — найбільш специфічну для себе. Якщо ви написали окрему групу для GPTBot, то загальна група `User-agent: *` для нього перестає існувати цілком, разом з усіма вашими `Disallow`.
Виглядає це так: ви додали `User-agent: GPTBot` і `Allow: /`, щоб дозволити ботові індексацію. А заодно, самі того не знаючи, зняли з нього всі заборони — і він пішов у `/api/`, `/basket` і `/thanks`. Саме це ми й знайшли на проєкті. Лікується просто: у кожній групі для ШІ-бота дублюються свої `Disallow`.
Чи ставити llms.txt
Ставте. Півгодини роботи, шкоди немає, ChatGPT і Perplexity його читають. Але не чекайте від нього дива і не платіть за нього як за послугу: якщо сайт віддає порожній HTML, ніякий llms.txt не допоможе, бо читати буде нічого. Спершу — SSR, розмітка і FAQ, і тільки потім файл. Як улаштована технічна база, з якої це все працює, розібрали на сторінці SEO-просування.


