Файл появился как ответ на разумный вопрос: если сайт читают не только люди и поисковые роботы, но и языковые модели, — может, стоит объяснить им устройство сайта отдельно и коротко? Идея красивая. Проверять её пока не на чем, и это главное, что нужно знать до того, как ставить файл в план работ.
Что такое llms.txt
Текстовый файл в формате markdown, лежащий по адресу /llms.txt. Внутри — название проекта, одно-два предложения о том, чем он полезен, и аннотированный список ссылок на важные страницы, сгруппированный по разделам. Замысел: дать модели компактную карту сайта вместо навигации, баннеров, футера и всплывающих окон.
У формата есть расширение — llms-full.txt, куда складывают полный текст документации одним куском, чтобы его можно было целиком отдать в чат.
Ключевое отличие от robots.txt, из-за которого возникает большинство недоразумений: robots.txt запретительный, а llms.txt пояснительный. Он ничего не открывает и не закрывает. Если задача — впустить или не впустить ИИ-краулеры, решается она в robots.txt и настройках CDN; порядок разобран в как попасть в ответы нейросетей.
Чего от файла ждут и что он делает
Разрыв между ожиданием и механикой здесь больше, чем в любой другой рекомендации по видимости в нейросетях.
| Ожидание | Что происходит на самом деле |
|---|---|
| «Модель прочитает файл и станет цитировать сайт чаще» | Ссылки в ответах подбираются по содержимому страниц через поисковый слой, корневой файл в отборе не участвует |
| «Это стандарт, его требуют вендоры» | Предложение сообщества; в документации разработчиков моделей файл не описан как учитываемый |
| «Файл управляет доступом ИИ-ботов» | Доступ регулируют robots.txt, настройки CDN и файрвол; llms.txt ничего не запрещает |
| «Он заменит переписывание страниц» | Ответ модель собирает из текста страницы, карта сайта не улучшает формулировку абзаца |
| «Установка даст измеримый прирост трафика» | Публичных подтверждений связи нет, а в аналитике эффект неотделим от остальных изменений |
| «Файл ускорит попадание в обучающую выборку» | Обучающие краулеры ходят по обычным ссылкам, отдельный список им не нужен |
Ни одна строка правой колонки не означает «файл вреден». Она означает другое: за него нельзя отчитываться как за работу с результатом.
Почему формат не стал стандартом
У robots.txt была причина закрепиться: обоюдная выгода. Сервер экономит ресурсы, краулер получает предсказуемые правила и защиту от претензий. Обе стороны заинтересованы соблюдать договорённость, поэтому она пережила тридцать лет и получила статус RFC.
С llms.txt такой симметрии нет. Провайдер модели не получает из файла ничего, чего не извлечёт из HTML, зато получает риск: описание пишет владелец сайта, проверить его нечем, и любой такой канал мгновенно превращается в канал манипуляции. История уже знает похожий сюжет — мета-тег keywords умер ровно по этой причине: непроверяемое утверждение автора о собственной странице.
Поэтому формат существует, файлы лежат на тысячах сайтов, а поддержки со стороны тех, кому они адресованы, нет. Это не заговор и не временное отставание, а следствие устройства: непроверяемое вендор учитывать не станет.
Как составить файл, если решили ставить
Порядок простой, весь смысл — в дисциплине содержания.
# Медиана — блог о маркетинге, который можно посчитать
> Разборы метрик, аналитики и видимости в поиске и ответах нейросетей.
> Каждая страница отвечает на один вопрос и содержит формулу или порядок действий.
## Метрики
- [ROMI: формула и калькулятор](https://example.ru/metrics/romi/): расчёт возврата
маркетинговых инвестиций, разбор ошибки с выручкой вместо маржи.
- [ДРР](https://example.ru/metrics/drr/): доля рекламных расходов, формула,
границы применимости.
## ИИ-поиск
- [Как попасть в ответы нейросетей](https://example.ru/ai-search/geo-aeo/):
четыре слоя видимости от доступа ботов до упоминаний бренда.
## Служебное
- [Методология](https://example.ru/methodology/): как проверяются цифры в материалах.
Правила, которые отличают полезный файл от мусорного:
- H1 — название проекта, а не «Добро пожаловать».
- Цитата под заголовком объясняет, чем сайт полезен, одним предложением. Без прилагательных.
- Ссылки абсолютные: файл читают вне контекста домена.
- После каждой ссылки — описание, отвечающее на вопрос «что внутри», а не «зачем нам доверять».
- Не вываливать в файл весь sitemap. Список из тысячи URL превращает карту в свалку и перестаёт обновляться.
- Ставить обновление файла в тот же процесс, что и правку меню. Иначе через полгода он описывает сайт, которого нет.
Чем это отличается от robots.txt и sitemap.xml
| Файл | Кому адресован | Что делает | Кто обязан учитывать |
|---|---|---|---|
| robots.txt | краулерам | разрешает и запрещает обход разделов | добросовестные краулеры, правила опубликованы вендорами |
| sitemap.xml | поисковым системам | перечисляет URL и даты обновления | поддерживается Google и Яндексом |
| llms.txt | языковым моделям, по замыслу | описывает структуру и смысл разделов | никто |
Последняя колонка и есть ответ на вопрос «нужен ли он». Первые два файла — договор, третий — записка в бутылке.
Где этот приём перестаёт работать
Отдельный случай — сайт документации, который разработчики и правда копируют в чат целиком. Там llms-full.txt решает конкретную задачу пользователя, а не гипотетическую задачу вендора, и в этом единственном сценарии файл приносит наблюдаемую пользу: человек получает текст без навигации и рекламы.
Спорное место: зачем тогда вообще ставить
Рекомендация «поставьте, но ничего не ждите» плохо защищена с обеих сторон, и честно это признать.
Аргумент за: стоимость близка к нулю, риск нулевой, а если формат когда-нибудь получит поддержку — файл уже лежит. Аргумент против: тем же рассуждением оправдывается любая бесполезная работа, а список дешёвых гигиенических мер в проекте разрастается и начинает конкурировать за внимание с тем, что даёт результат.
Проверка простая. Если файл собирает один человек за полчаса и больше к нему не возвращается — пусть лежит. Если под него заводят регламент обновления, согласование и строку в ежемесячном отчёте — стоимость уже не нулевая, а обосновать её нечем. В этот момент час лучше потратить на разбор того, что видно в аналитике из ответов ассистентов, или на понимание того, как модель вообще собирает ответ — оба занятия меняют решения, а файл в корне не меняет ничего.
Частые вопросы
llms.txt — это официальный стандарт?
Даёт ли llms.txt трафик из нейросетей?
Чем llms.txt отличается от robots.txt?
Нужен ли llms-full.txt?
Может ли файл навредить?