Что такое llms.txt

llms.txt — текстовый файл в корне сайта (по адресу вида /llms.txt), который в компактной форме описывает, что это за проект и какие страницы на нём главные. Идея предложена в 2024 году Джереми Ховардом и подхвачена частью веб-сообщества.
Логика простая. Языковой модели тяжело разбираться в сайте, где полезный текст перемешан с меню, баннерами и скриптами. llms.txt даёт ей короткую карту: вот кто мы, вот наши ключевые материалы, вот ссылки на них — всё чистым markdown без разметки интерфейса.
Формально это похоже на robots.txt по расположению, но задача принципиально другая: robots.txt запрещает или разрешает обход, а llms.txt подсказывает, что важно.
Сразу к главному вопросу. Ни OpenAI, ни Google, ни Яндекс, ни Anthropic официально не заявляли, что учитывают llms.txt при формировании ответов. Это инициатива сообщества, у которой пока нет подтверждённой поддержки со стороны крупных систем.
Стоит ли тогда его делать
Честный ответ: можно сделать, но не рассчитывайте на эффект.
Аргументы за:
- файл составляется за час-полтора, а на большом сайте — за пару часов;
- он не может навредить: ни поиск, ни ассистенты не наказывают за его наличие;
- если поддержка появится, вы окажетесь готовы заранее;
- сам процесс составления полезен — вы вынужденно формулируете, что на сайте главное.
Аргументы против того, чтобы делать его в первую очередь:
- подтверждённого влияния на видимость сегодня нет;
- файл нужно поддерживать в актуальном состоянии, иначе он начнёт вводить в заблуждение;
- время, потраченное на него, почти всегда окупилось бы лучше в других работах.
Практическое правило: занимайтесь llms.txt после того, как закрыты базовые вещи — контент доступен в HTML, структура текстов пригодна для цитирования, разметка Schema.org внедрена. Что именно входит в этот базовый набор, разбираем в статье оптимизация сайта под нейросети.
Как устроен файл
Формат — обычный markdown с предсказуемой структурой:
- Заголовок первого уровня — название проекта.
- Краткое описание одним абзацем, обычно оформляется цитатой.
- Разделы второго уровня — группы материалов.
- Списки ссылок с короткими пояснениями, что находится по каждому адресу.
Раздел с названием Optional по соглашению означает материалы, которые можно пропустить при нехватке контекста.
Как составить: порядок действий
- Определите, кто вы, одним абзацем. Чем занимается компания, для кого, в каком регионе. Без маркетинговых эпитетов — только факты, которые помогают понять профиль.
- Отберите 15–40 ключевых страниц. Услуги, важные разделы, лучшие материалы блога, контакты. Не весь сайт: смысл файла в отборе.
- Сгруппируйте их по разделам. Например: услуги, экспертиза, кейсы, о компании.
- Напишите пояснение к каждой ссылке. Одно предложение, объясняющее, что находится на странице и кому это полезно.
- Соберите файл в markdown. Заголовок, описание, разделы, списки ссылок с пояснениями.
- Разместите в корне сайта. Файл должен открываться по адресу вида /llms.txt и отдаваться как текст.
- Проверьте доступность. Откройте адрес в браузере в режиме инкогнито и убедитесь, что видите текст, а не страницу ошибки.
- Поставьте напоминание об обновлении. Раз в квартал или при заметных изменениях структуры сайта.
Пример структуры для сайта услуг
Для компании, оказывающей несколько услуг, разумная разбивка выглядит так:
| Раздел файла | Что включать | Сколько ссылок |
|---|---|---|
| Описание | Кто вы, чем занимаетесь, для кого, где работаете | абзац без ссылок |
| Услуги | Основные страницы услуг с пояснением, что входит | по числу услуг |
| Экспертиза | Лучшие материалы блога, руководства, исследования | 8–15 |
| Кейсы и результаты | Портфолио, отдельные кейсы с цифрами | 3–8 |
| О компании | Контакты, команда, реквизиты | 2–4 |
| Optional | Второстепенные материалы | сколько угодно |
Главный принцип отбора: включайте то, что вы хотели бы увидеть процитированным. Файл со всеми 200 страницами сайта бесполезен — он не помогает выбрать.
llms.txt и llms-full.txt
Помимо основного файла существует расширенный вариант — llms-full.txt, куда выносят не ссылки, а полный текст материалов.
| Критерий | llms.txt | llms-full.txt |
|---|---|---|
| Содержимое | Описание и ссылки | Полные тексты страниц |
| Размер | Единицы килобайт | Сотни килобайт и мегабайты |
| Поддержка в актуальном виде | Простая | Требует автоматической генерации |
| Кому осмысленно | Любому сайту | Документация, базы знаний |
Для сайта услуг или интернет-магазина llms-full.txt обычно избыточен: он дублирует контент и почти сразу расходится с оригиналом. Осмысленным он становится там, где содержимое само по себе является продуктом, — например, в технической документации.
Что писать в описании: разбор по типам бизнеса
Самая содержательная часть файла — вводный абзац. Именно из него система получает представление о том, кто вы. Что в нём должно быть для разных типов компаний:
Агентство или студия. Профиль услуг, специализация, регион, формат работы. Полезно указать, с каким размером бизнеса работаете: «для малого и среднего бизнеса» отсекает нерелевантные сценарии.
Интернет-магазин. Что продаёте, для кого, чем отличаетесь по ассортименту или условиям. Важна конкретика категорий, а не «широкий выбор товаров».
Производство. Что производите, для каких отраслей, мощности и география поставок.
Услуги для частных лиц. Что делаете, где, для кого, что отличает от соседей по рынку.
Общее правило: описание должно позволить ответить на вопрос «подходит ли эта компания под запрос клиента». Эпитеты вроде «динамично развивающаяся» и «индивидуальный подход» этому не помогают и занимают место.
Как поддерживать файл в актуальном состоянии
Основной риск llms.txt — не в том, что он не работает, а в том, что он устаревает и начинает вводить в заблуждение. Три способа этого избежать:
Ручное обновление по расписанию. Раз в квартал пересматривать список ссылок. Подходит для сайтов, где структура меняется редко.
Полуавтоматическая генерация. Список формируется из карты сайта или из CMS по признаку «важная страница», описания пишутся вручную. Разумный компромисс для блога, который регулярно пополняется.
Полная автоматизация. Файл собирается при сборке сайта из тех же данных, что и карта сайта. Оправдана, когда страниц много и они часто меняются, но требует контроля: автоматические описания обычно хуже написанных руками.
Практический ориентир: если на сайте меньше сотни страниц и обновления нечастые — достаточно ручного варианта с напоминанием в календаре.
Чего llms.txt не делает
- Не управляет доступом. Он ничего не запрещает и не разрешает; за это отвечает robots.txt и настройки сервера.
- Не гарантирует цитирование. Даже если файл прочитан, решение о включении в ответ принимается по другим признакам.
- Не заменяет разметку. Schema.org работает на уровне конкретной страницы и понятен поисковым системам сегодня, а не гипотетически.
- Не улучшает позиции в поиске. Влияния на классическое ранжирование у файла нет.
Откуда взялся формат и почему споры не утихают
Идея появилась из практической проблемы: языковые модели ограничены объёмом текста, который могут обработать за раз, а типичная веб-страница на 80 % состоит из навигации, скриптов и оформления. Предложение состояло в том, чтобы дать машинам чистый markdown-срез сайта — как карта сайта, только не для поисковых роботов, а для моделей.
Сообщество разделилось. Сторонники говорят, что формат дешёв, безвреден и решает реальную проблему. Скептики возражают, что современные системы и так неплохо извлекают содержимое страниц, а неподдерживаемый никем файл — это лишняя сущность, которую придётся сопровождать.
Прагматичная позиция посередине: относиться к llms.txt как к недорогой ставке. Час работы сейчас — на случай, если формат получит поддержку. Но строить на нём стратегию видимости нельзя, и уж точно нельзя делать его вместо работ, которые дают эффект сегодня.
Типовые ошибки при составлении
- Перечислили весь сайт. Файл со всеми страницами не помогает выбрать главное и теряет смысл.
- Относительные ссылки. Нужны абсолютные адреса с доменом — иначе ссылка вне контекста сайта неразрешима.
- Маркетинговое описание. «Лидер рынка с индивидуальным подходом» не сообщает ничего о профиле компании.
- Файл отдаётся как HTML-страница. Тогда в нём снова появляется всё оформление, ради избавления от которого он и задумывался.
- Забыли про обновление. Через год половина ссылок ведёт на несуществующие страницы, и файл дезинформирует.
- Сделали вместо основных работ. Самая дорогая ошибка: время ушло, а причина невидимости осталась.
Сколько это занимает времени
Для ориентира по трудозатратам:
- сайт до 50 страниц — час-полтора вручную;
- сайт до 300 страниц — 2–4 часа, основное время уходит на отбор и описания;
- крупный сайт — от 4 часов плюс настройка автоматической генерации.
Обновление раз в квартал занимает 20–30 минут, если структура сайта не менялась радикально.
Как проверить, что всё сделано правильно
Четыре проверки после публикации:
- Файл открывается по адресу /llms.txt и отдаёт код 200.
- Отдаётся как текст, а не как HTML-страница с оформлением сайта.
- Все ссылки рабочие — прогоните их любой проверялкой битых ссылок.
- Ссылки абсолютные — с полным адресом сайта, а не относительные.
Пятая, неформальная проверка: дайте файл прочитать любому ассистенту и попросите пересказать, чем занимается компания. Если пересказ получился корректным, файл выполняет свою задачу.
Как llms.txt соотносится с другими файлами
На сайте уже есть несколько служебных файлов, и полезно понимать, кто за что отвечает.
| Файл | Для кого | Что делает | Обязателен |
|---|---|---|---|
| robots.txt | Поисковые и AI-краулеры | Разрешает или запрещает обход разделов | Практически да |
| sitemap.xml | Поисковые системы | Перечисляет все страницы для индексации | Да |
| llms.txt | Языковые модели | Описывает проект и выделяет главное | Нет |
Важное различие с картой сайта: sitemap.xml стремится к полноте, llms.txt — к отбору. Первый отвечает на вопрос «какие страницы существуют», второй — «какие из них важны и о чём они». Поэтому копировать карту сайта в llms.txt бессмысленно: получится файл, который не выполняет свою задачу.
Ещё одно следствие: llms.txt не заменяет robots.txt. Если краулер закрыт правилами robots.txt, наличие описания ничего не изменит — контент просто не будет получен.
Что делать вместо
Если ресурс ограничен и выбирать приходится, вложения в порядке убывания отдачи выглядят так:
- Доступность контента в HTML — если текст подгружается скриптом, его может не быть в ответе краулера.
- Структура текста под цитирование — прямой ответ в начале, самодостаточные абзацы, FAQ.
- Разметка Schema.org — Article, FAQPage, HowTo, Organization.
- Фактура и источники — цифры, которые можно проверить.
- Упоминания бренда на отраслевых площадках.
- И только потом llms.txt.
Общая картина по этим направлениям — в материале что такое GEO-продвижение.
Ответы на возражения
«Это же просто карта сайта, зачем дублировать?» Карта сайта перечисляет все адреса без объяснений и предназначена для индексации. llms.txt отбирает главное и объясняет, что где находится. Задачи разные, дублирования нет.
«Если никто не читает, зачем делать?» Формально — на случай будущей поддержки. Практически — процесс составления заставляет сформулировать, что на сайте важно, и это упражнение часто вскрывает проблемы со структурой.
«Не помешает ли это SEO?» Нет. Файл никак не влияет на классическое ранжирование: поисковые системы его не учитывают ни положительно, ни отрицательно.
«Не раскроем ли мы лишнее конкурентам?» В файл попадают только публичные страницы, которые и так доступны в поиске. Ничего закрытого туда добавлять не нужно.
«Стоит ли платить подрядчику за это отдельно?» Отдельной услугой — вряд ли: работа на час-два. Разумно включить в общий объём работ по подготовке сайта к AI-поиску.
Что делать дальше
Если базовые работы уже закрыты, сделайте файл — это недорого и на всякий случай готовит вас к возможной поддержке в будущем. Если нет — начните с базы, а llms.txt поставьте в конец очереди.
Мы в PRIMO Agency в рамках продвижения в нейросетях начинаем с замера текущей видимости бренда в ответах ассистентов и показываем, какие работы дадут эффект именно на вашем сайте. Бесплатный аудит — ответ в течение суток.




