Світлова документ-пластина передає дані до кількох приймачів, один із яких закритий

llms.txt: навіщо він потрібен і чому Google його не читає

llms.txt подають як новий robots.txt, без якого вас не побачить жоден ШІ. Поставив його на живий проєкт і заміряв: ChatGPT дав у 4,3 раза більше трафіку за Bing, але зробив це не файл. Розбираю, що спрацювало насправді.

Fedir AlpatovFedir Alpatov· Founder & Tech Lead31 сер 20267 хв читання

Про llms.txt зараз пишуть так, ніби це нова robots.txt і без нього вас не побачить жоден ШІ. Я поставив цей файл на реальний проєкт, заміряв, що з цього вийшло, і нижче — чесна відповідь: файл дешевий, шкоди не робить, але результат дало інше.

Що таке llms.txt простими словами

Це звичайний текстовий файл у форматі Markdown, який лежить за адресою `/llms.txt`. Всередині — структурований перелік того, що є на сайті: розділи, ключові сторінки, коротке пояснення до кожного посилання. Задум у тому, щоб мовна модель, яка зайшла на сайт, за один запит зрозуміла його структуру, а не збирала її по крихтах з HTML.

Формально це пропозиція спільноти, а не стандарт. Ніхто з великих пошуковиків не зобов'язувався його читати, і от що з цього вийшло насправді.

Хто llms.txt читає, а хто ні

СистемаЧи використовує llms.txtДжерело
Google SearchНіофіційна заява, червень 2026
Google AI OverviewsНітам же
ChatGPT (режим browse)Так, при заході на сайтповедінка краулера
PerplexityТакповедінка краулера
Bing / CopilotНе підтверджено

Тобто половина сенсу відпадає одразу: найбільше джерело ШІ-відповідей — Google — файл ігнорує. Залишаються ChatGPT і Perplexity, і саме там ми побачили трафік.

Що показали цифри

Проєкт — сайт виробника сухого льоду. Замір Microsoft Clarity за 46 днів, окремих вкладень у ШІ-канал не було жодних.

ДжерелоСесій за 46 днівЗа останні 30 днів
Google1 254867
Прямі заходи319137
Instagram8737
ChatGPT5229
Bing1212

ChatGPT — четверте джерело трафіку і третє зовнішнє після Google та Instagram. У 4,3 раза більше за Bing. Причому 29 з 52 сесій припали на останні 30 днів: канал не згасає, а росте.

Одразу застереження, щоб не переказували неточно: Clarity дає дві різні цифри — джерело «ChatGPT» показує 52, а канал «AIPlatform» у її ж класифікації показує 13. Це особливість того, як вона розкладає трафік, а не два різні виміри. Коректно посилатися на джерело.

Що насправді дало цей трафік

llms.txt на сайті є, і я не буду вдавати, що він нічого не дав. Але якщо чесно розкласти роботи за вкладом, порядок буде такий.

  1. Чистий HTML без JavaScript. До робіт головна сторінка віддавала краулеру порожній контейнер із лоадером — весь контент з'являвся після гідратації. GPTBot, PerplexityBot і ClaudeBot не виконують JavaScript: вони бачили порожню сторінку. Це була найдорожча помилка проєкту, і полагодили її першою.
  2. Розмітка Schema.org. Organization, WebSite, Product, ItemList, FAQPage, BreadcrumbList, LocalBusiness, Service, AggregateRating. Одинадцять сутностей на одній головній. Модель отримує факти в машиночитаному вигляді, а не вигрібає їх із верстки.
  3. FAQ у форматі «питання як його ставить людина — відповідь у перших 40 словах». П'ять пар на головній, шістнадцять на окремій сторінці, свої на кожній міській. Це найзручніший для цитування формат, який взагалі буває.
  4. Числові факти в тексті. −78,5 °C, втрата 10% маси на добу, 400 кг/год потужності, гранули 3/16/19 мм, ціни 75/60/55 грн за кг. Модель цитує конкретику, а не «висока якість за доступною ціною».
  5. Дозвіл ботам у robots.txt. Вісім краулерів явно дозволені. І тут була пастка, про яку нижче.

llms.txt іде шостим пунктом. Він коштує пів години роботи і не шкодить — але продавати його як головний інструмент нечесно.

Пастка в robots.txt, на якій горять майже всі

За специфікацією robots.txt краулер виконує тільки одну групу — найбільш специфічну для себе. Якщо ви написали окрему групу для GPTBot, то загальна група `User-agent: *` для нього перестає існувати цілком, разом з усіма вашими `Disallow`.

Виглядає це так: ви додали `User-agent: GPTBot` і `Allow: /`, щоб дозволити ботові індексацію. А заодно, самі того не знаючи, зняли з нього всі заборони — і він пішов у `/api/`, `/basket` і `/thanks`. Саме це ми й знайшли на проєкті. Лікується просто: у кожній групі для ШІ-бота дублюються свої `Disallow`.

Чи ставити llms.txt

Ставте. Півгодини роботи, шкоди немає, ChatGPT і Perplexity його читають. Але не чекайте від нього дива і не платіть за нього як за послугу: якщо сайт віддає порожній HTML, ніякий llms.txt не допоможе, бо читати буде нічого. Спершу — SSR, розмітка і FAQ, і тільки потім файл. Як улаштована технічна база, з якої це все працює, розібрали на сторінці SEO-просування.

Часті питання

Що таке llms.txt?
Текстовий файл у форматі Markdown за адресою /llms.txt, який описує структуру сайту для мовних моделей: розділи, ключові сторінки і коротке пояснення до кожного посилання. Це пропозиція спільноти, а не офіційний стандарт.
Чи використовує Google llms.txt?
Ні. У червні 2026 Google офіційно заявив, що не використовує llms.txt ні в звичайному пошуку, ні в AI Overviews. Файл читають ChatGPT у режимі browse і Perplexity.
Чи варто взагалі його ставити?
Так, якщо це півгодини роботи. Шкоди немає, ChatGPT і Perplexity його читають. Але не платіть за нього як за окрему послугу і не робіть його першим кроком: якщо сайт віддає краулеру порожній HTML, файл не врятує.
Що дає трафік із ШІ насправді?
На нашому проєкті — чистий серверний HTML (боти не виконують JavaScript), розмітка Schema.org, FAQ-блоки у форматі «питання-відповідь» і конкретні числові факти в тексті. llms.txt іде шостим за вкладом.
Як дозволити ШІ-ботам обхід у robots.txt?
Обережно. За специфікацією краулер виконує тільки одну, найбільш специфічну для себе групу — і якщо ви створили окрему групу для GPTBot, загальна група з вашими Disallow для нього перестає діяти цілком. Дублюйте потрібні заборони в кожній групі.

Обговорити свій проєкт?

Залиште контакт — відповімо протягом 4 робочих годин. Без спаму і скриптів продажів.