Перейти к содержанию
GET-GEO.AI
/
Все руководства

// руководство

Что такое llms.txt — и нужен ли он вашему сайту?

Обновлено: 2026-08-19

// краткий ответ

llms.txt — предложенный стандарт: markdown-карта ключевых страниц сайта для AI-систем, размещённая по адресу /llms.txt. Ключевое слово здесь «предложенный»: ни один крупный AI-вендор не обязался его читать, а по замерам 97% опубликованных файлов не получают за месяц ни одного запроса. Публикуйте, если ваша архитектура генерирует его бесплатно, но пока ничего от него не ждите.

Что такое llms.txt

Предложение принадлежит Джереми Ховарду из Answer.AI и опубликовано 3 сентября 2024 года на llmstxt.org. Идея такая: HTML-страницы для языковых моделей тяжелы и перегружены, поэтому сайту стоит отдавать курированную markdown-карту по адресу /llms.txt — один H1 с названием сайта, блок цитаты с «ключевой информацией, необходимой для понимания остальной части файла», затем разделы со ссылками, каждая из которых — markdown-ссылка с необязательной пометкой в одну строку. Раздел Optional помечает ссылки, которые агент может пропустить, когда нужен более короткий контекст. Спецификация советует держать и чистые markdown-двойники страниц — по тому же адресу с добавленным .md.

Две вещи, которыми llms.txt не является. Он не управляет доступом — ничего не разрешает и не запрещает; это работа robots.txt, и переключатели всех AI-краулеров мы разобрали в гайде по robots.txt. А llms-full.txt — единый файл с полным текстом сайта — в спецификации отсутствует вовсе: это соглашение экосистемы, ставшее популярным в ноябре 2024 года, когда Mintlify начала автоматически генерировать оба файла для каждого документационного сайта на своём хостинге.

Читает ли кто-нибудь llms.txt на самом деле?

Это тот вопрос, вокруг которого большинство гайдов ходит кругами — обращаются ли AI-краулеры к llms.txt? — и ответ по замерам прямолинеен: почти никто.

Ни один AI-вендор не взял на себя обязательство его читать. Ни OpenAI, ни Anthropic, ни Google, ни Perplexity: ни в одной официальной документации не сказано, что их системы загружают или разбирают llms.txt. Google высказывается откровенно пренебрежительно. Джон Мюллер в апреле 2025 года написал: «Насколько мне известно, ни один AI-сервис не заявлял, что использует LLMs.TXT (и по логам сервера видно, что они даже не проверяют его наличие). По мне, это сопоставимо с мета-тегом keywords». Гэри Илш в июле 2025 года подтвердил: Google файл не поддерживает и не планирует.

Логи сервера говорят то же. Ahrefs проверила 137 000 доменов в июне 2026 года: 97% опубликованных файлов llms.txt не получили за предыдущий месяц ни одного запроса, а у тех 3%, к которым обращались, лишь около 1% обращений пришёлся на боты AI-поиска. Evil Martians прочесали логи собственного сайта за два месяца: из примерно 770 загрузок файла 37 пришлись на известных AI-агентов. Otterly наблюдала 62 100 визитов AI-ботов за 90 дней — на /llms.txt пришлось 84, треть от того, что получает средняя контентная страница. А SE Ranking проверила 300 000 доменов на связь между наличием файла и цитированием в AI-ответах: связи нет.

При этом внедрение продолжает расти — с примерно 4 100 опубликованных файлов в июне 2025 года до 36 100 годом позже: почти девятикратный рост числа файлов, которые почти никто не читает. Список публикующих впечатляет и иронизирует в равной мере: Anthropic, Cloudflare, Zapier, Stripe и Vercel отдают такой файл, в основном на доменах документации, — а Perplexity публикует собственный llms.txt, ни разу не заявив, что читает чужие.

Один настоящий сигнал скрыт в тех же логах, и указывает он на другую часть предложения: Evil Martians обнаружили, что Claude Code запрашивает markdown через content negotiation в 76% своих загрузок. Машины действительно предпочитают чистый markdown вместо HTML — игнорируют они файл-указатель, а не идею.

llms.txt в августе 2026 года — утверждение за утверждением
УтверждениеСтатусОснование
AI-вендоры читают llms.txtНет — никто не обязалсяНи в одной документации вендора это не заявлено; Google отказывается прямо (Мюллер, Илш)
AI-боты загружают файл на практикеЕдва измеримо97% файлов — ноль запросов (Ahrefs, 137 тыс. доменов); 37 загрузок известными агентами за 2 месяца (Evil Martians)
Наличие файла улучшает AI-цитированиеЭффекта не найденоSE Ranking, 300 тыс. доменов: связи с частотой цитирования нет
Издатели всё равно его внедряютДа — быстро4,1 тыс. → 36,1 тыс. файлов за год (Ahrefs); среди них Anthropic, Stripe, Cloudflare, Zapier
Машины предпочитают markdown вместо HTMLДа — измереноClaude Code запрашивает markdown в 76% загрузок (Evil Martians)
llms.txt в августе 2026 года — утверждение за утверждением

Почему мы всё равно его держим

Наш сайт отдаёт /llms.txt и файлы llms-full по локалям, и никакого эффекта мы им не приписываем: у нас нет данных, что хоть один ассистент нашёл наш контент через карту, а не через краулинг и поисковые индексы, и мы исходим из того, что наш файл живёт не лучше измеренного среднего. Так зачем его держать?

Потому что в нашей архитектуре он ничего не стоит и не может устареть. Файл генерируется из того же реестра контента, из которого собираются страницы, sitemap и хаб гайдов: выходит или меняется гайд — llms.txt обновляется тем же коммитом. Карта, которая поддерживает себя сама, — бесплатный опцион на будущее, в котором какой-нибудь агент её всё-таки прочитает. Карта, которую нужно поддерживать руками, — обязательство, которое тихо разойдётся с сайтом.

Живой файл в продакшене вскрывает ещё и реальные инженерные ограничения, мимо которых проходят статьи-рассуждения. Наш экспорт llms-full дважды перерастал ограничение размера с тех пор, как появилась локаль на хинди: деванагари в UTF-8 занимает около трёх байт на символ, и даже при более коротких текстах на хинди те же гайды весят примерно вдвое больше английских, поэтому предел теперь стоит на 300 килобайтах — втрое выше исходного. Если ваш llms-full.txt больше контекстного бюджета модели, вы воспроизвели ту самую проблему, которую файл должен был решить.

Такова честная форма этого решения: мы публикуем файл как ставку с нулевой ценой и описываем его именно так — как часть технического слоя, задокументированного в гайде о том, как мы делаем GEO на собственном сайте, а не как рычаг ранжирования. Что действительно измеримо влияет на цитирование, разобрано там же: доступ для краулеров, извлекаемые страницы, работа с сущностью.

Как сделать его так, чтобы не было стыдно

Если llms.txt достаётся вам бесплатно — плагином, хуком статического генератора, шаблоном CMS, — вот формат llms.txt прямо из спецификации.

Минимальный пример llms.txt: один H1 с названием сайта, затем блок цитаты, который в двух-трёх предложениях описывает, что это за сайт, — так, чтобы агент мог их процитировать. Разделы H2 — страницы, гайды, документация — каждый со списком markdown-ссылок и пометкой в одну строку на каждую ссылку. Раздел Optional для того, что агент может пропустить. Это весь стандарт.

Три ошибки, из-за которых файл становится хуже, чем его отсутствие:

  • Публиковать его за сплошным Disallow. Если robots.txt блокирует бота, карту он не увидит никогда. Сначала доступ, потом навигация — проверьте переключатели краулеров, прежде чем рисовать карты.
  • Сваливать в него все свои URL. Единственная теоретическая ценность файла — курирование; сотня неразличимых ссылок — это sitemap, а sitemap.xml и так существует. Десять ключевых страниц с честными однострочными пометками бьют всё остальное.
  • Позволять ему расходиться с сайтом. Написанный руками llms.txt, описывающий страницы, которые вы с тех пор переписали, — это и есть тот самый мета-тег keywords, с которым его сравнил Мюллер: самоописание, которое никто не проверяет. Генерируйте его из того же источника, что и страницы, — или не держите вовсе.

Смежные вопросы

Чем llms.txt отличается от robots.txt?

Это совершенно разные задачи. Robots.txt управляет доступом — какие краулеры могут загружать какие пути, и все крупные AI-вендоры документируют, что его соблюдают (с оговорками про фетчеры пользователя, которые разобраны в гайде по robots.txt). llms.txt не управляет ничем: это рекомендованный список для чтения, к которому послушный бот может обратиться и к которому, по текущим замерам, практически никто не обращается. Сначала настройте доступ; карта — необязательное украшение.

Помогает ли llms.txt SEO или AI-видимости сегодня?

Измеримого эффекта нет: SE Ranking проверила 300 000 доменов и не нашла связи между наличием файла и цитированием в AI-ответах, а Google прямо заявляет, что файл не использует. Цитирование двигает то, о чём говорит остальная серия — доступ для краулеров, извлекаемые страницы с ответом впереди, внешние подтверждения, — а гайд об измерении AI-видимости показывает, как проверить любое из этого на своих числах. Относитесь к llms.txt как к эксперименту, но никогда — как к плану.

Как создать файл llms.txt?

Коротко: не пишите его руками. Если платформа генерирует файл из вашего контента — хостинги документации делают это автоматически, а плагины есть для большинства фреймворков и CMS, — включите генерацию, и файл будет оставаться синхронным бесплатно. Написать руками допустимо для сайта на десять страниц: на таком масштабе стоимость поддержки округляется до нуля. Всё, что больше, подключайте к тому же источнику, из которого собираются страницы.

Стоит ли публиковать ещё и llms-full.txt?

Только если он генерируется. В спецификации его нет — это соглашение об отдаче всего контента одним markdown-файлом, полезное в основном для того, чтобы руками вставить документацию сайта в контекст AI-инструмента. Следите за размером: после нескольких сотен килобайт вы переполняете те самые контекстные окна, ради которых файл и существует. Наш ограничен по размеру и разделён по локалям именно поэтому.

Примут ли AI-вендоры llms.txt со временем?

Неизвестно, и тренд читается в обе стороны: внедрение у издателей выросло за год почти девятикратно, а обязательства вендоров остались на нуле, и Google отказался прямо. Единственная часть предложения с измеренной тягой — сам markdown: агенты уже запрашивают .md-версии страниц, когда те есть. Если из спецификации что-то и выживет, наша ставка — на чистые машиночитаемые страницы, а не на файл-указатель.

Связанные руководства

Источники

  1. 01Наш гайд: Как настроить robots.txt для AI-краулеров?
  2. 02Наш гайд: Как делать GEO на собственном сайте на практике?
  3. 03Наш гайд: Как измерять AI-видимость и цитирования?
  4. 04llmstxt.org — предложение llms.txt (Джереми Ховард, сентябрь 2024)
  5. 05Search Engine Journal — Мюллер из Google: llms.txt сопоставим с мета-тегом keywords (апрель 2025)
  6. 06Ahrefs — исследование llms.txt: 97% файлов не получили ни одного запроса (137 000 доменов, июнь 2026)
  7. 07Evil Martians — два месяца LLM-трафика в замерах (июль 2026)
  8. 08SE Ranking — llms.txt не влияет на AI-цитирование (300 000 доменов, ноябрь 2025)
  9. 09Otterly — эксперимент с llms.txt: 90 дней логов AI-ботов (февраль 2026)
  10. 10Mintlify — автоматическая генерация llms.txt для документации на хостинге (ноябрь 2024)
  11. 11Ahrefs — что такое llms.txt и нужен ли он вам? (обновлено в июне 2026)

// поделиться

LinkedInXReddit