Медиана

llms.txt: что это и нужен ли он

llms.txt — предложенный формат файла с описанием сайта для языковых моделей. Что он делает на самом деле, как его составить и почему нельзя обещать эффект.

Обновлено 12.08.2026 · 5 мин чтения

llms.txt — текстовый файл в корне сайта, где владелец описывает структуру и ключевые страницы в расчёте на языковые модели, по аналогии с robots.txt. Формат предложен сообществом, не принят как стандарт и официально не поддержан вендорами моделей. Поставить его можно как дешёвую гигиену; включать в план работ и обещать за него трафик — нельзя.

Коротко

  • llms.txt — текстовый файл в корне сайта с картой разделов, адресованный языковым моделям.
  • Формат предложен сообществом и не принят как стандарт: обязательной поддержки со стороны вендоров у него нет.
  • Публичных подтверждений влияния файла на трафик или цитируемость нет — обещать за него результат нельзя.
  • Файл не управляет доступом ботов: обход разрешает и запрещает robots.txt, а не он.
  • Разумный статус в проекте — получасовая гигиена без строки в отчёте, а не пункт плана работ.

Файл появился как ответ на разумный вопрос: если сайт читают не только люди и поисковые роботы, но и языковые модели, — может, стоит объяснить им устройство сайта отдельно и коротко? Идея красивая. Проверять её пока не на чем, и это главное, что нужно знать до того, как ставить файл в план работ.

Что такое llms.txt

Текстовый файл в формате markdown, лежащий по адресу /llms.txt. Внутри — название проекта, одно-два предложения о том, чем он полезен, и аннотированный список ссылок на важные страницы, сгруппированный по разделам. Замысел: дать модели компактную карту сайта вместо навигации, баннеров, футера и всплывающих окон.

У формата есть расширение — llms-full.txt, куда складывают полный текст документации одним куском, чтобы его можно было целиком отдать в чат.

Ключевое отличие от robots.txt, из-за которого возникает большинство недоразумений: robots.txt запретительный, а llms.txt пояснительный. Он ничего не открывает и не закрывает. Если задача — впустить или не впустить ИИ-краулеры, решается она в robots.txt и настройках CDN; порядок разобран в как попасть в ответы нейросетей.

Чего от файла ждут и что он делает

Разрыв между ожиданием и механикой здесь больше, чем в любой другой рекомендации по видимости в нейросетях.

ОжиданиеЧто происходит на самом деле
«Модель прочитает файл и станет цитировать сайт чаще»Ссылки в ответах подбираются по содержимому страниц через поисковый слой, корневой файл в отборе не участвует
«Это стандарт, его требуют вендоры»Предложение сообщества; в документации разработчиков моделей файл не описан как учитываемый
«Файл управляет доступом ИИ-ботов»Доступ регулируют robots.txt, настройки CDN и файрвол; llms.txt ничего не запрещает
«Он заменит переписывание страниц»Ответ модель собирает из текста страницы, карта сайта не улучшает формулировку абзаца
«Установка даст измеримый прирост трафика»Публичных подтверждений связи нет, а в аналитике эффект неотделим от остальных изменений
«Файл ускорит попадание в обучающую выборку»Обучающие краулеры ходят по обычным ссылкам, отдельный список им не нужен

Ни одна строка правой колонки не означает «файл вреден». Она означает другое: за него нельзя отчитываться как за работу с результатом.

Почему формат не стал стандартом

У robots.txt была причина закрепиться: обоюдная выгода. Сервер экономит ресурсы, краулер получает предсказуемые правила и защиту от претензий. Обе стороны заинтересованы соблюдать договорённость, поэтому она пережила тридцать лет и получила статус RFC.

С llms.txt такой симметрии нет. Провайдер модели не получает из файла ничего, чего не извлечёт из HTML, зато получает риск: описание пишет владелец сайта, проверить его нечем, и любой такой канал мгновенно превращается в канал манипуляции. История уже знает похожий сюжет — мета-тег keywords умер ровно по этой причине: непроверяемое утверждение автора о собственной странице.

Поэтому формат существует, файлы лежат на тысячах сайтов, а поддержки со стороны тех, кому они адресованы, нет. Это не заговор и не временное отставание, а следствие устройства: непроверяемое вендор учитывать не станет.

Как составить файл, если решили ставить

Порядок простой, весь смысл — в дисциплине содержания.

# Медиана — блог о маркетинге, который можно посчитать

> Разборы метрик, аналитики и видимости в поиске и ответах нейросетей.
> Каждая страница отвечает на один вопрос и содержит формулу или порядок действий.

## Метрики
- [ROMI: формула и калькулятор](https://example.ru/metrics/romi/): расчёт возврата
  маркетинговых инвестиций, разбор ошибки с выручкой вместо маржи.
- [ДРР](https://example.ru/metrics/drr/): доля рекламных расходов, формула,
  границы применимости.

## ИИ-поиск
- [Как попасть в ответы нейросетей](https://example.ru/ai-search/geo-aeo/):
  четыре слоя видимости от доступа ботов до упоминаний бренда.

## Служебное
- [Методология](https://example.ru/methodology/): как проверяются цифры в материалах.

Правила, которые отличают полезный файл от мусорного:

  • H1 — название проекта, а не «Добро пожаловать».
  • Цитата под заголовком объясняет, чем сайт полезен, одним предложением. Без прилагательных.
  • Ссылки абсолютные: файл читают вне контекста домена.
  • После каждой ссылки — описание, отвечающее на вопрос «что внутри», а не «зачем нам доверять».
  • Не вываливать в файл весь sitemap. Список из тысячи URL превращает карту в свалку и перестаёт обновляться.
  • Ставить обновление файла в тот же процесс, что и правку меню. Иначе через полгода он описывает сайт, которого нет.

Чем это отличается от robots.txt и sitemap.xml

ФайлКому адресованЧто делаетКто обязан учитывать
robots.txtкраулерамразрешает и запрещает обход разделовдобросовестные краулеры, правила опубликованы вендорами
sitemap.xmlпоисковым системамперечисляет URL и даты обновленияподдерживается Google и Яндексом
llms.txtязыковым моделям, по замыслуописывает структуру и смысл разделовникто

Последняя колонка и есть ответ на вопрос «нужен ли он». Первые два файла — договор, третий — записка в бутылке.

Где этот приём перестаёт работать

Четыре ситуации, в которых файл бессмыслен
Сайт закрыт от ИИ-краулеров на уровне robots.txt или CDN — читать файл некому. Контент рендерится JavaScript и без него страница пустая — карта ведёт в пустоту. Файл ставят вместо правки первых абзацев страниц — прямой размен часа полезной работы на час бесполезной. Файл продают как отдельную услугу с обещанным приростом — это продажа непроверяемого результата.

Отдельный случай — сайт документации, который разработчики и правда копируют в чат целиком. Там llms-full.txt решает конкретную задачу пользователя, а не гипотетическую задачу вендора, и в этом единственном сценарии файл приносит наблюдаемую пользу: человек получает текст без навигации и рекламы.

Спорное место: зачем тогда вообще ставить

Рекомендация «поставьте, но ничего не ждите» плохо защищена с обеих сторон, и честно это признать.

Аргумент за: стоимость близка к нулю, риск нулевой, а если формат когда-нибудь получит поддержку — файл уже лежит. Аргумент против: тем же рассуждением оправдывается любая бесполезная работа, а список дешёвых гигиенических мер в проекте разрастается и начинает конкурировать за внимание с тем, что даёт результат.

Проверка простая. Если файл собирает один человек за полчаса и больше к нему не возвращается — пусть лежит. Если под него заводят регламент обновления, согласование и строку в ежемесячном отчёте — стоимость уже не нулевая, а обосновать её нечем. В этот момент час лучше потратить на разбор того, что видно в аналитике из ответов ассистентов, или на понимание того, как модель вообще собирает ответ — оба занятия меняют решения, а файл в корне не меняет ничего.

Частые вопросы

llms.txt — это официальный стандарт?

Нет. Это предложение сообщества, оформленное как спецификация на сайте инициативы. Ни один крупный разработчик языковых моделей не объявлял файл обязательным и не описывал в документации, что учитывает его при подготовке ответов. Статус «стандарта» ему приписывают статьи, а не вендоры.

Даёт ли llms.txt трафик из нейросетей?

Публичных подтверждений связи нет. Ссылки в ответах ассистентов подбираются по содержимому страниц через поиск, и корневой файл в этой цепочке не участвует. Если после установки трафик вырос, отделить вклад файла от остальных изменений на сайте нечем.

Чем llms.txt отличается от robots.txt?

robots.txt разрешает и запрещает обход, и его правила краулеры публично обещают соблюдать. llms.txt ничего не запрещает — он описывает устройство сайта в расчёте на то, что описание кто-то прочитает. Первый управляет доступом, второй объясняет содержание.

Нужен ли llms-full.txt?

Это расширение той же идеи — один файл со всем текстом документации, чтобы его можно было целиком загрузить в чат. Для документации продукта, которую и правда копируют в модель руками, смысл есть. Для блога или сайта услуг файл дублирует сайт и стареет быстрее, чем его обновляют.

Может ли файл навредить?

Прямого вреда нет, это статичный текст, который никто не обязан читать. Вред косвенный — время, потраченное на файл вместо переписывания первых абзацев страниц, и строка в отчёте, за которой не стоит результата.

Источники

  1. Robots exclusion standard — Wikipedia
  2. Документация по краулерам OpenAI — OpenAI
Артём Строев
Пишу про измеримый маркетинг и видимость в ИИ-поиске. Публикуюсь под псевдонимом — почему так.