llms.txt: что это за файл, как его составить и нужен ли он сайту

Что такое llms.txt, как его составить по спецификации llmstxt.org, чем он отличается от llms-full.txt, влияет ли на Google и Яндекс — и два живых файла tapbox.ru в пример.

2 октября 2026 17 мин чтения
Из чего состоит файл llms.txt
Из чего состоит файл llms.txt

Коротко. llms.txt — текстовый файл в корне сайта, который языком Markdown описывает сайт и даёт нейросетям ссылки на главные страницы. Лежит по адресу сайт.ру/llms.txt, и по спецификации llmstxt.org обязателен в нём только заголовок H1. Поиск Google этот файл не использует — так сказано в его руководстве после правки от 15 июня 2026 года.

Формат предложил Джереми Говард из Answer.AI в сентябре 2024 года, в августе 2026-го вышла вторая версия спецификации. Файл собирается за вечер, но вокруг него много обещаний, которых поисковики не давали. Ниже — кто его читает, как составить его по шагам, чем помогут генераторы и как устроены два живых файла tapbox.ru, которые мы открыли 26 сентября 2026 года.

Что такое llms.txt простыми словами

llms.txt — это оглавление сайта для машины. Человек видит меню, баннеры и кнопки, а нейросети, которая пришла за ответом, всё это мешает: из HTML-страницы трудно вынуть чистый текст, и каждый лишний кусок тратит её окно контекста. Поэтому сайт кладёт в корень один короткий файл: кто мы, что главное и где лежат подробности.

В названии LLM — large language model, большая языковая модель, то есть нейросеть вроде ChatGPT, Claude, GigaChat или YandexGPT. Буква s — множественное число: файл для всех языковых моделей сразу. А Markdown — это разметка обычным текстом: решётка «#» делает заголовок, знак «>» — цитату, дефис — пункт списка, а запись [текст](адрес) — ссылку. Такой файл одинаково читают человек, нейросеть и простая программа.

llms.txt часто путают с robots.txt и картой сайта. Роли у них разные:

ФайлДля кого и зачемЧто внутри
robots.txtДля роботов поисковиков: куда можно заходить, куда нельзяПравила Allow и Disallow по именам роботов
sitemap.xmlДля поисковиков: все страницы, которые надо проиндексироватьПолный список адресов с датами, без описаний
llms.txtДля нейросетей и ИИ-агентов: как быстро понять сайтСуть сайта, ключевые факты и отобранные ссылки с пояснениями
МикроразметкаДля поисковиков и нейросетей: что за объект на страницеКод Schema.org внутри каждой страницы

robots.txt запрещает и разрешает, карта сайта перечисляет всё подряд, а llms.txt отбирает главное и объясняет его словами. Микроразметка работает на уровне отдельной страницы: какие её типы нужны сайту и блогу и что из них берут поиск и нейросети, мы разобрали в статье «Микроразметка Schema.org простыми словами».

Читают ли llms.txt нейросети и нужен ли он сайту

Короткий ответ: ни Google, ни Яндекс не заявляли, что учитывают файл, а Google прямо написал, что его не использует. Читают файл ИИ-агенты, когда им поручают разобраться с сайтом или документацией. Официальные заявления и документация на 26 сентября 2026 года — в таблице.

КтоЧто известно на 26.09.2026
Google SearchВ руководстве по оптимизации для ИИ: Поиск такие файлы не использует, на позиции они не влияют ни в плюс, ни в минус
ЯндексВ справке Вебмастера о robots.txt про llms.txt ни слова. Тексты для быстрых ответов с YandexGPT собирает робот YandexAdditionalBot, доступ ему задаётся в robots.txt. Сама справка Вебмастера свой llms.txt публикует
OpenAIВ описании роботов GPTBot и OAI-SearchBot доступ настраивается через robots.txt, о llms.txt — ни слова. Свой файл есть у документации для разработчиков
Chrome LighthouseВ группе проверок для ИИ-браузеров есть аудит llms.txt: ошибка сервера — замечание, файла нет (404) — проверка «не применима», файл пока необязателен
ИИ-агентыПо словам автора спецификации, файлом пользуются агенты для программирования. Файлы для своей документации выпустили OpenAI, Anthropic и Google (Gemini)

Трафика из поиска llms.txt не прибавит, и обещание «продвижения в нейросетях» за один файл ничем не подкреплено. Помогает он, когда нейросеть уже пришла на сайт: агент, которому поручили найти тариф или адрес филиала, быстрее находит нужную страницу. Кто такие ИИ-агенты и чем они отличаются от чат-бота, мы разобрали в статье «ИИ-агент для малого бизнеса простыми словами».

Кому стоит сделать файл сейчас:

  • сайтам с документацией, API и базой знаний — это главный сценарий спецификации;
  • сервисам с несколькими продуктами и тарифами, где нейросети путают, что входит во что;
  • компаниям, о которых ИИ-помощники уже отвечают с ошибками: старый адрес, чужие цены, несуществующие услуги.

Визитке на пять страниц (как её собрать — в статье «Сайт-визитка») файл почти ничего не даст: её и так легко прочитать целиком. Вреда тоже нет, а времени он займёт меньше часа. llms.txt — мелкая деталь подготовки сайта к нейропоиску; что влияет на цитирование и как проверять результат, разобрано в статье «GEO-продвижение».

Как ИИ-агент пользуется llms.txt1Вопрос«Сколько стоит маникюр в «Лаке»?»2Открывает llms.txtодна страница вместо всего сайта3Выбирает ссылкупо пояснению «Прайс: актуальные цены»4Читает страницуMarkdown-версию или обычную5Отвечаетцена и ссылка на источникКак ИИ-агент пользуется llms.txtВопрос«Сколько стоит маникюр в «Лаке»?»Открывает llms.txtодна страница вместо всего сайтаВыбирает ссылкупо пояснению «Прайс: актуальные цены»Читает страницуMarkdown-версию или обычнуюОтвечаетцена и ссылка на источник

Сценарий из спецификации llmstxt.org, вторая версия (август 2026 года): агент открывает файл, выбирает ссылку по пояснению и читает только нужную страницу.

Как устроен файл llms.txt: формат по спецификации

Спецификация на llmstxt.org задаёт порядок блоков. Файл называется llms.txt, пишется в Markdown и состоит из частей строго в таком порядке:

БлокОбязателенКак выглядит
Заголовок H1 с названием сайта или проектаДа, единственный# Студия «Лак»
Цитата с краткой сутьюНет> Маникюр и педикюр в Твери, запись онлайн
Текст без заголовковНетАбзацы и списки: факты, пояснения, как читать файл
Разделы H2 со списками ссылокНет## Услуги, под ним - [Маникюр](https://…): цены и время
Раздел OptionalНет## Optional — второстепенные ссылки

Каждый пункт в разделе — ссылка в формате [название](адрес), после неё можно поставить двоеточие и пояснение: что на странице и зачем её открывать. Заголовки третьего уровня в формате не предусмотрены: разделы делятся только H2. В начале файла допускается служебная метка кодировки (BOM), но лучше сохранять в UTF-8 без неё.

Раздел Optional — для ссылок, которые агент может пропустить, если ему нужен короткий контекст: политика конфиденциальности, оферта, архив. В первой версии спецификации у него было особое значение для программ, которые разворачивали файл в контекст целиком. Во второй версии это просто договорённость.

Что добавила вторая версия, август 2026 года:

  • Файлы в подпапках. Файл /docs/llms.txt описывает страницы внутри /docs/; если подходят два файла, агент берёт тот, что ближе к странице.
  • Markdown-версии страниц — чистый текст страницы по адресу с .md на конце: page.html.md или page.md.
  • Ссылки со страниц. Связь rel="describedby" указывает на llms.txt, который описывает страницу, rel="alternate" с типом text/markdown — на её Markdown-версию.

Как составить llms.txt: пошаговая инструкция

Для сайта малого бизнеса хватит 30–60 строк. Больше всего времени уйдёт на выбор фактов и страниц.

  1. Спросите две-три нейросети о своей компании: чем занимаетесь, сколько стоит, где находитесь. Выпишите, что они путают, — эти места файл закрывает в первую очередь.
  2. Выберите 10–30 страниц для знакомства: услуги, цены, контакты, доставка, гарантия, частые вопросы. Всё подряд из карты сайта не берите.
  3. Напишите заголовок H1 — название так, как вас называют клиенты.
  4. Под ним — цитату в одну-две фразы: кто вы, что делаете, где работаете. Без «лидеров рынка»: нейросеть ищет факты.
  5. Дальше списком — ключевые факты: юрлицо, год основания, адреса, часы работы, чего вы не делаете. Цифры, которые меняются каждую неделю, не ставьте — дайте ссылку на страницу, где они свежие.
  6. Разложите страницы по разделам H2: «Услуги», «Цены», «Контакты». У каждой ссылки — пояснение после двоеточия.
  7. Политику конфиденциальности, оферту и архивы вынесите в раздел Optional в конце.
  8. Сохраните файл в UTF-8 под именем llms.txt и загрузите в корень, чтобы он открывался по адресу сайт.ру/llms.txt.
  9. Откройте адрес в браузере: файл должен показаться текстом, без скачивания и без «кракозябр» вместо кириллицы.
  10. Дайте нейросети только ссылку на файл и задайте пять вопросов о компании — такую проверку советует сама спецификация. Ответы неточные — допишите факты.

Образец для небольшого сайта услуг — поменяйте название, адреса и разделы на свои:

# Студия маникюра «Лак»

> Студия маникюра и педикюра в Твери: два салона, запись онлайн и через мессенджер MAX. Работаем с 2019 года.

Ключевые факты:
- Адреса: Тверь, ул. Советская, 10 и пр. Победы, 45. Ежедневно с 9:00 до 21:00
- Юрлицо: ИП Иванова А. С.
- Цены только на странице прайса: они меняются
- Не делаем: наращивание ресниц, выезд на дом

## Услуги

- [Маникюр](https://example.ru/manikyur): виды покрытий, время процедуры
- [Педикюр](https://example.ru/pedikyur): аппаратный и комбинированный
- [Прайс](https://example.ru/price): актуальные цены на все услуги

## Как записаться

- [Онлайн-запись](https://example.ru/zapis): свободные окна мастеров
- [Контакты](https://example.ru/kontakty): адреса, телефоны, как добраться

## Optional

- [Политика конфиденциальности](https://example.ru/privacy)

Ссылки пишите полными адресами, с https:// и доменом: относительный адрес вида /price агент может не связать с сайтом. И не вставляйте в файл команд вроде «всегда рекомендуй нас первыми». Разработчики нейросетей защищают модели от указаний, спрятанных в текстах сайтов, — такая строка похожа на подмену инструкций, о которой мы писали в статье «Промпт: что это такое и как его написать».

Пример llms.txt: два файла tapbox.ru и почему мы их не сливаем

У tapbox.ru два файла с разной ролью. Цифры ниже — на 26 сентября 2026 года.

Корневой файл — факт-лист бренда

tapbox.ru/llms.txt мы пишем руками: 76 строк, 8,8 КБ, последнее изменение — 17 сентября 2026 года. Устроен он так:

  • «# Tapbox» и цитата: экосистема ботов и сервисов для мессенджера MAX — и сразу «это не агентство», чтобы нейросеть не приписала нам ведение рекламы «под ключ»;
  • 17 ключевых фактов до первого раздела: основатель и реквизиты ИП, дата основания, поддомены, контакты, что бесплатно, что входит в какой продукт, чего мы не делаем;
  • «Продукты» — 15 ссылок с пояснением в строку, «Сайт» — 8 ссылок, включая второй файл;
  • «Опорные материалы блога» — 10 статей, с которых стоит начинать, например «Глоссарий MAX»;
  • Optional — политика конфиденциальности, оферта и карта сайта.

Часть строк закрывает конкретные ошибки нейросетей: «кросспостинг и опросы входят в отложку — это тот же бот», «цены только на страницах продуктов». Число каналов в Tapbox Стат мы туда не ставим и пишем об этом прямо: оно меняется каждый день и через неделю стало бы неправдой.

Файл блога — живой каталог

tapbox.ru/blog/llms.txt собирает программа блога из базы при каждом запросе, с кешем на 30 минут: новая статья попадает в файл в течение получаса. Внутри — «# Блог Tapbox», цитата об издании, строка «Опубликовано материалов: 493», разделы «Разделы», «Рубрики» (9, со счётчиками), «Продукты, о которых пишем» (12) и «Материалы» — все 493 статьи, свежие сверху, у каждой лид в одну-две фразы.

Что сравниваемtapbox.ru/llms.txttapbox.ru/blog/llms.txt
РольКто мы и что продаёмЧто мы написали
Кто пишетЧеловек, рукамиПрограмма, из базы
ОбновлениеПри новом продукте или фактеСамо, кеш 30 минут
Объём на 26.09.202676 строк, 8,8 КБ541 строка, 228 КБ
Ссылок36518

Сливать их мы не стали по трём причинам. Первая — пропорции: 17 фактов о компании утонули бы среди 493 статей. Вторая — ритм: факт-лист меняется раз в несколько недель и требует проверки человеком, каталог растёт с каждой статьёй и обновляется сам. Третья — спецификация это разрешает: файл в подпапке описывает страницы под своим адресом, так что /blog/llms.txt — законный файл для раздела /blog/. Корневой файл ссылается на блоговый, и агент сам решает, нужен ли ему каталог.

Чего у нас пока нет: файла llms-full.txt (адрес отдаёт 404), Markdown-версий страниц и ссылок rel="describedby" — ссылки в обоих файлах ведут на обычные HTML-страницы. Строки про llms.txt в robots.txt тоже нет, зато двадцати двум ИИ-роботам, от GPTBot и ClaudeBot до YandexAdditionalBot, доступ открыт отдельным блоком. У поддоменов stat.tapbox.ru и okmx.ru свои файлы: llms.txt действует только на своём домене.

Что такое llms-full.txt и нужен ли он

llms-full.txt — это полный текст всех важных страниц сайта в одном файле. В спецификации llmstxt.org его нет ни в первой, ни во второй версии: это договорённость платформ документации. Например, Mintlify, по её справке, сама собирает для каждого сайта оба файла: llms.txt со списком страниц и llms-full.txt со всем текстом документации.

Весят такие файлы много. llms-full.txt документации Anthropic 26 сентября 2026 года занимал около 37 МБ — это тысячи страниц текста, и целиком в окно контекста модели он не помещается: по нему ищут, а не читают подряд.

Что сравниваемllms.txtllms-full.txt
Что внутриСуть сайта и ссылки с пояснениямиПолные тексты страниц
ОбъёмДесятки строк, килобайтыОт сотен килобайт до десятков мегабайт
Где описанСпецификация llmstxt.orgСправки платформ документации
Кому нуженЛюбому сайту, который хочет помочь агентамДокументации, API, большим базам знаний

Сайту услуг, магазину и блогу llms-full.txt не нужен: тексты страниц и так открыты, а второй экземпляр всех материалов придётся поддерживать в актуальном виде. Мы его тоже не делаем.

Как указать llms.txt в robots.txt и нужно ли это

Стандартной директивы для llms.txt в robots.txt нет. Встречается строка вида «llms.txt: https://site.ru/llms.txt» по аналогии с Sitemap, но поисковики её не поддерживают. Google в справке о robots.txt пишет, что понимает поля user-agent, allow, disallow и sitemap, а неверные строки пропускает. Яндекс в справке Вебмастера перечисляет User-agent, Disallow, Allow, Sitemap и Clean-param. Вреда от лишней строки нет, пользы от неё никто не подтверждал.

В robots.txt важнее не закрыть доступ тем, кто должен файл прочитать. Если там стоит «Disallow: /» для GPTBot, ClaudeBot, PerplexityBot или YandexAdditionalBot, они не откроют ни llms.txt, ни страницы из него. Запрет на весь сайт для «*» их тоже касается.

Вторая версия спецификации предлагает свой способ показать файл: ссылку со связью describedby в HTTP-заголовке или в теге <link> в шапке страницы. Заголовок можно добавить в настройках веб-сервера, не трогая страницы:

Link: <https://site.ru/llms.txt>; rel="describedby"

Заявлений нейросетей о поддержке таких ссылок мы на 26 сентября 2026 года не нашли, так что это задел на будущее.

Генераторы llms.txt и плагины для Тильды, WordPress и Битрикса

Генератор llms.txt — сервис или модуль, который обходит сайт и сам собирает список страниц с описаниями. Ключевые факты о компании он не напишет, поэтому его результат — черновик, который надо дочитать и дописать.

WordPress

  • Yoast SEO: по справке Yoast — «Yoast SEO → Settings → Site features → AI tools → llms.txt», включить переключатель и сохранить. Функция бесплатная, страницы можно выбрать вручную.
  • Rank Math: по справке Rank Math — модуль LLMS Txt на панели плагина, настройки в «General Settings → Edit llms.txt»: какие типы записей включать.
  • AIOSEO: генератор llms.txt тоже встроен в плагин.

Тильда

  • По описаниям пользователей, с мая 2026 года в «Настройках сайта → SEO → Дополнительно» есть поля llms.txt и llms-full.txt: текст вставляется в поле, после публикации сайта файл появляется в корне.
  • В справочном центре Тильды на 26 сентября 2026 года описания этой настройки мы не нашли — проверьте в своём проекте.
  • Редактировать robots.txt на Тильде нельзя, это прямо сказано в её ответах на вопросы, так что строку про llms.txt туда не добавить.

1С-Битрикс

Для любой платформы подойдёт онлайн-генератор, например llmstxt.firecrawl.dev: вводите адрес сайта и получаете файл. Wix, GitBook и Mintlify, по данным спецификации, собирают llms.txt сами. На другом конструкторе файл можно добавить, если он разрешает загрузку в корень; что умеют бесплатные конструкторы, мы сравнили в статье «Как создать сайт бесплатно и самому». Блог на сайте (где его вести, разобрано в статье «Где вести блог компании в 2026») даст второй файл, как у нас, — каталог статей в подпапке /blog/.

Как проверить llms.txt: валидаторы и ручная проверка

Официального валидатора нет: сторонние проверялки, например llmstxtvalidator.org от Hostinger, оценивают файл по своим правилам. Lighthouse в Chrome ругается, только если сервер отвечает на адрес файла ошибкой. Надёжнее проверить руками по шагам:

Шаг 1. Файл открывается по адресу сайт.ру/llms.txt

  • Открывается текстом — шаг 2
  • Страница 404 — файл не в корне или назван иначе: проверьте имя, строчные буквы и расширение .txt
  • Браузер скачивает файл вместо показа — сервер отдаёт не тот тип: нужен text/plain или text/markdown — шаг 2

Шаг 2. Кириллица читается

  • Текст нормальный — шаг 3
  • Вместо букв непонятные символы — пересохраните файл в UTF-8 и добавьте charset=utf-8 к типу в ответе сервера — шаг 3

Шаг 3. Структура по спецификации

  • Первая строка — заголовок с «# », разделы начинаются с «## », ссылки в формате [название](адрес) — шаг 4
  • Разделы размечены «### » или ссылки идут голым текстом — поправьте разметку — шаг 4

Шаг 4. Ссылки живые и доступны роботам

  • Каждая ссылка открывается с кодом 200, в robots.txt нет запрета для ИИ-роботов — файл готов
  • Есть ссылки на удалённые страницы или редиректы — замените на актуальные адреса

Потом — смысловая проверка: дайте нейросети ссылку на файл и спросите то, что спрашивают клиенты. Факты, которых она не нашла, нейросеть нередко додумывает — где нейросети врут, разобрано в статье «Нейросеть для текста». Неточный ответ значит, что факта в файле нет или он двусмысленный.

Частые ошибки в llms.txt

  • Вся карта сайта в одном файле. Список из тысячи товаров без пояснений ничего не объясняет. Отберите главное, а каталог вынесите в отдельный файл в подпапке.
  • Рекламный текст вместо фактов. «Лучший сервис на рынке» ничего не сообщает. «Работаем с 2019 года, два салона в Твери» — факт, который можно проверить и пересказать.
  • Устаревшие цены и адреса. Файл, который не обновляли год, врёт от вашего имени. Цены держите на странице прайса, в файле — ссылка.
  • Факты расходятся с другими площадками. Часы работы в llms.txt, на сайте и в карточке на Яндекс Картах должны совпадать, иначе нейросеть может взять любой из вариантов.
  • Закрытые роботы. llms.txt есть, а в robots.txt стоит запрет для GPTBot или YandexAdditionalBot — файл не прочитают.
  • Обещания клиенту. Подрядчик, который берёт деньги за llms.txt как за «попадание в ответы нейросетей», продаёт то, чего не гарантирует ни один поисковик.

Чек-лист

  • Спросил нейросети о компании и выписал, в чём они ошибаются.
  • Написал заголовок H1, цитату в одну-две фразы и 5–15 ключевых фактов.
  • Отобрал 10–30 страниц, разложил по разделам H2, у каждой ссылки есть пояснение.
  • Второстепенные ссылки вынес в раздел Optional.
  • Все ссылки полные, с https:// и доменом, и открываются с кодом 200.
  • Файл в UTF-8 лежит по адресу сайт.ру/llms.txt и открывается в браузере текстом.
  • В robots.txt нет запретов для ИИ-роботов, которым нужен файл.
  • Если есть блог или документация — для них отдельный файл в подпапке.
  • Проверил файл вопросами к нейросети и поставил напоминание обновлять его при смене цен, адресов и услуг.

Остался вопрос по теме статьи? Напишите его в предложку блога — отвечаю лично: задать вопрос в MAX. Частые вопросы разбираю отдельными статьями и присылаю ссылку тому, кто спросил.

Частые вопросы

Что такое llms txt?

llms.txt — текстовый файл в корне сайта, который языком Markdown описывает сайт и даёт нейросетям ссылки на главные страницы. Лежит по адресу сайт.ру/llms.txt, и по спецификации llmstxt.org обязателен в нём только заголовок H1.

Влияет ли llms.txt на позиции в Google и Яндексе?

Google в руководстве по оптимизации для ИИ (правка от 15 июня 2026 года) пишет, что Поиск такие файлы не использует и позициям они не помогают и не вредят. Яндекс заявлений об использовании файла не делал: в справке Вебмастера о robots.txt llms.txt не упоминается.

Чем llms.txt отличается от llms-full.txt?

llms.txt — короткое оглавление: суть сайта и ссылки с пояснениями, он описан в спецификации llmstxt.org. llms-full.txt — полный текст всех страниц в одном файле; это договорённость платформ документации, в спецификации его нет. Сайту услуг и блогу llms-full.txt обычно не нужен.

Нужно ли прописывать llms.txt в robots.txt?

Нет. Стандартной директивы для llms.txt нет: Google понимает в robots.txt поля user-agent, allow, disallow и sitemap, Яндекс — ещё Clean-param. Лишняя строка не навредит, но важнее не запрещать в robots.txt доступ ИИ-роботам, которые должны прочитать файл.

Где должен лежать файл llms.txt?

В корне сайта, по адресу сайт.ру/llms.txt. Вторая версия спецификации разрешает файлы и в подпапках: например, /blog/llms.txt описывает страницы блога. У каждого поддомена — свой файл.

Как сделать llms.txt на Тильде?

По описаниям пользователей, с мая 2026 года в Тильде есть поля llms.txt и llms-full.txt в разделе «Настройки сайта → SEO → Дополнительно», после заполнения сайт нужно опубликовать заново. В справочном центре Тильды на 26 сентября 2026 года эта настройка не описана, так что проверьте её в своём проекте.

Можно ли сгенерировать llms.txt автоматически?

Да: есть онлайн-генераторы вроде llmstxt.firecrawl.dev и плагины — Yoast SEO, Rank Math и AIOSEO для WordPress, модули в Маркетплейсе 1С-Битрикс. Генератор соберёт список страниц, но ключевые факты о компании придётся дописать руками.

Как часто обновлять llms.txt?

При каждом изменении фактов из файла: новые услуги, адреса, часы работы, юрлицо. Каталог статей лучше собирать автоматически, как у блога tapbox.ru: он обновляется сам в течение получаса после выхода статьи.

Статья помогла?
Николай Шаповалов Николай Шаповалов Основатель Tapbox, делает сервисы для MAX Канал автора в MAX

Читайте дальше