llms.txt · техническое SEO

Файл llms.txt в 2026: новый стандарт llms.txt для AI или миф

Файл llms.txt — текстовый файл в формате Markdown, который лежит в корневой папке сайта и кратко описывает для языковых моделей, о чём сайт и какие страницы на нём главные. В 2026 году его часто называют «новым стандартом», но формально это добровольное предложение сообщества, а не утверждённая норма. Не путать с файлом, который управляет доступом роботов (robots), и с sitemap.xml, который перечисляет все страницы для индексации.

Данные актуальны на сентябрь 2026 года. Позиции AI-компаний по llms.txt меняются, поэтому даты заявлений указаны в тексте.

Содержание статьи
  1. Главное за 30 секунд
  2. Что такое файл llms.txt и откуда взялся стандарт llms.txt
  3. Кто читает llms.txt: Google, OpenAI, Anthropic и данные логов
  4. Когда llms.txt стоит сделать
  5. Как написать файл llms.txt: структура в формате Markdown
  6. Пример llms.txt для онлайн-школы
  7. llms-full.txt: нужен ли полный текст одним файлом
  8. Как опубликовать и проверить файл
  9. robots.txt для AI-ботов: кого пускать на ваш сайт
  10. Как сайт читается большими языковыми моделями: индекс, краулеры и RAG
  11. Разметка Schema.org: что работает в Google и Яндексе
  12. Как писать контент под LLM: практика
  13. Мифы технической GEO-оптимизации
  14. Технический чек-лист под ИИ-поиск
  15. FAQ: частые вопросы о llms.txt

Главное за 30 секунд

  • llms.txt почти никто не читает. По данным Ahrefs, 97% таких файлов в мае 2026 года не получили ни одного запроса.
  • Google, OpenAI и Anthropic его не используют для поиска. Google прямо пишет, что он не нужен для AI Overviews и AI Mode; AI-компании для управления доступом отправляют к привычному файлу для роботов.
  • Файл не вредит и делается за 20 минут. Его есть смысл завести сайтам с документацией, API или большим каталогом — и как аккуратную «визитку» для агентов.
  • Что влияет на ИИ-поиск на самом деле: индексация, доступ AI-ботов, контент без обязательного JavaScript, разметка Schema.org и структура страницы, из которой легко извлечь ответ.
  • В Яндексе за ответы Алисы AI отвечает отдельный робот — YandexAdditional. Случайный запрет для него убирает сайт из источников нейроответов.

Что такое файл llms.txt и откуда взялся стандарт llms.txt

Формат llms.txt предложил Джереми Ховард (Jeremy Howard), сооснователь Answer.AI и fast.ai, в сентябре 2024 года. Идея простая: большим языковым моделям трудно разбирать HTML-страницы с меню, баннерами и скриптами, поэтому сайт может положить рядом короткую текстовую карту в формате Markdown — со ссылками на главные материалы и их описанием.

Предложение описано на сайте llmstxt.org. На середину 2026 года у llms.txt нет признания W3C, IETF или schema.org, нет обязательной спецификации и нормативного валидатора. Поэтому корректнее говорить не о стандарте, а о договорённости, которую каждый AI-сервис может поддерживать или игнорировать.

ДокументДля когоЧто делает
robots.txtпоисковые роботы и AI-краулерыразрешает или запрещает обход разделов
sitemap.xmlпоисковые роботыперечисляет страницы для индексации
llms.txtязыковые модели и агентыкратко описывает сайт и главные страницы
llms-full.txtязыковые модели и агентыотдаёт полный текст ключевого контента одним файлом

Кто читает llms.txt: Google, OpenAI, Anthropic и данные логов

Официальная поддержка llms.txt у крупных AI-компаний в 2026 году отсутствует, а серверные логи показывают, что его почти не запрашивают.

Google. В руководстве по генеративным функциям поиска Google пишет, что llms.txt и другие специальные «AI-файлы» не нужны для появления в поиске, включая AI Overviews и AI Mode, потому что Google Search их не использует. 15 июня 2026 года компания ещё раз добавила эту пометку в документацию. Джон Мюллер из Google сравнивал llms.txt с метатегом keywords (meta tag keywords) — классическим примером разметки, которую заполняют владельцы сайтов, но не читают поисковые системы.

OpenAI и Anthropic. В документации OpenAI по краулерам llms.txt не упоминается: управлять доступом компания предлагает через robots.txt. Anthropic придерживается той же позиции. При этом обе компании публикуют файл для собственной документации для разработчиков — там он полезен ассистентам для программистов.

Perplexity — заметное исключение: компания сообщает, что загружает llms.txt, чтобы расставлять приоритеты страниц.

Яндекс официальной позиции по llms.txt не публиковал. Утверждения, что Алиса AI «быстрее понимает сайт» благодаря llms.txt, ничем не подтверждены.

ИсследованиеЧто показало
Ahrefs, логи 137 000 доменов, май 202697% файлов llms.txt не получили ни одного запроса; из запросов, которые были, на поисковых AI-ботов пришлось 1,1%
Ahrefs, там жеоколо 22% обращений к файлу — SEO-аудиторы, которые проверяют его наличие
SE Ranking, ~300 000 доменовнет статистически значимой связи между наличием llms.txt и частотой цитирования в AI-ответах
Ahrefs, там жена доменах без файла AI-боты его даже не запрашивали — то есть не ищут его

Вывод для практики: llms.txt не является фактором видимости в чат-ботах, Алисе или Google AI Overviews и Google AI Mode. Время, которое уходит на его «оптимизацию», лучше потратить на тексты и технические основы.

Когда llms.txt стоит сделать

Внедрение llms.txt оправдано там, где сайт используют не только поисковые системы, но и агенты и инструменты разработчиков, которые загружают файл по запросу.

Тип сайтаНужен ли llms.txt
Документация, API, SaaSда, llms.txt и llms-full.txt вместе: их читают ассистенты для программистов
Большой каталог товаров или курсовжелательно: короткая карта разделов для агентов
Корпоративный сайт, блог, онлайн-школапо желанию: 20 минут работы без ожиданий роста трафика
Лендинг из одной страницыне нужен

Главная ошибка — считать llms.txt пунктом, который «включает» видимость в нейросетях. Файл не заменяет индексацию, тексты и ссылки, и SEO-аудиторы, которые снижают оценку сайта за его отсутствие, проверяют сам факт наличия файла, а не его влияние.

Как написать файл llms.txt: структура в формате Markdown

Файл llms.txt — обычный документ в формате Markdown с фиксированным порядком блоков. Пишется он вручную за 15–20 минут.

  1. H1-заголовок — название сайта или компании. Единственный обязательный элемент.
  2. Цитата (строка с символом >) — одно-два предложения: кто вы и чем полезен сайт.
  3. Абзац с деталями — по желанию: для кого сайт, ключевые факты.
  4. Разделы H2 со списками ссылок в формате - [Название](URL): короткое описание.
  5. Раздел ## Optional — второстепенные ссылки, которые модель может пропустить при нехватке контекста.

Правила, которые делают документ полезным:

  • Только главное. 10–20 ссылок, а не копия sitemap.
  • Описание — факт, а не реклама. «Курс по нейросетям для маркетологов: 5 модулей, 1 месяц» полезнее, чем «Лучший курс по ИИ в России».
  • Абсолютные URL с протоколом https.
  • Живые ссылки. Каждая ссылка отдаёт код 200, без редиректов и страниц 404.
  • Язык сайта. Для русскоязычного сайта описания пишутся по-русски.
  • Обновлять при изменениях — новые разделы, закрытые курсы, смена адресов.

Пример llms.txt для онлайн-школы

Ниже — пример файла для Digital Skills Academy. Его можно взять как шаблон и заменить ссылки и описания на свои.

# Digital Skills Academy

> Онлайн-школа цифровых профессий: интернет-маркетинг, SEO, SMM, трафик, нейросети для маркетинга. Лицензированные программы профессиональной переподготовки и повышения квалификации.

Курсы рассчитаны на новичков и практикующих специалистов, включают практические задания, кейсы и проекты для портфолио. Обучение онлайн, в потоковом и асинхронном формате.

## Курсы

- [Интернет-маркетолог + ИИ](https://digitalskillsacademy.ru/internetmarketer): 18 модулей за 3 месяца — стратегия, performance-каналы, SEO, веб-аналитика, CRM-маркетинг
- [Нейросети для маркетинга](https://digitalskillsacademy.ru/courses/nejroseti-v-marketinge): 5 модулей за 1 месяц — ChatGPT, Claude, Алиса AI, автоматизация, собственный ИИ-агент
- [SEO-продвижение](https://digitalskillsacademy.ru/seo): курс по поисковой оптимизации
- [SMM-менеджер](https://digitalskillsacademy.ru/smm): курс по продвижению в социальных сетях
- [Трафик-менеджер](https://digitalskillsacademy.ru/trafficmanager): курс по платному трафику
- [Каталог курсов](https://digitalskillsacademy.ru/catalog): все программы школы

## О школе

- [Эксперты](https://digitalskillsacademy.ru/experts): преподаватели и их опыт
- [Сведения об образовательной организации](https://digitalskillsacademy.ru/information): лицензия и документы
- [Контакты](https://digitalskillsacademy.ru/contacts): телефон, почта, мессенджеры

## Optional

- [Блог](https://digitalskillsacademy.ru/blog): статьи о маркетинге, SEO и нейросетях
- [Словарь терминов](https://digitalskillsacademy.ru/glossary): расшифровка иностранных терминов

Что сделано правильно: у каждой ссылки есть фактическое описание, контакты вынесены в отдельный раздел, второстепенные материалы помечены как Optional, а юридические страницы и формы оплаты в файл не попали.

llms-full.txt: нужен ли полный текст одним файлом

llms-full.txt — расширенная версия, в которой лежит не список ссылок, а сам текст ключевых страниц. Формат полезен для документации: ассистент для программистов загружает один файл вместо десятков страниц.

Для большинства коммерческих сайтов расширенная версия не нужна. У неё есть и оборотная сторона: она отдаёт весь ваш контент в удобном для копирования виде любому, кто его запросит, — это важно, если бизнес зависит от визитов на страницы.

Как опубликовать и проверить файл

  1. Сохраните документ в кодировке UTF-8 под именем llms.txt.
  2. Загрузите его в корневой каталог сайта, чтобы он открывался по адресу https://ваш-домен/llms.txt.
  3. Откройте адрес в браузере: страница должна отдаваться с кодом 200 и читаться как текст.
  4. Проверьте все ссылки внутри файла на коды ответа.
  5. Настройте в логах отдельный отчёт по обращениям к /llms.txt, чтобы видеть, кто его запрашивает.

На Tilda, 1С-Битрикс и WordPress llms.txt загружается через файловый менеджер, SFTP или плагин. Нормативного валидатора нет: сторонние сервисы проверяют доступность и формальную структуру, а не «соответствие стандарту».

robots.txt для AI-ботов: кого пускать на ваш сайт

Доступ AI-сервисов к сайту управляется правилами для роботов, а не llms.txt. Поисковыми роботами классических систем и AI-ботами управляют одинаково — директивами User-agent и Disallow. У крупных компаний несколько ботов с разными задачами, и запрет одного из них не означает запрета остальных.

КомпанияБотЗадача
OpenAIGPTBotсбор данных для обучения моделей
OAI-SearchBotиндекс для поиска в чате
ChatGPT-Userзагрузка страниц по запросу пользователя
AnthropicClaudeBotсбор данных для обучения
Claude-SearchBot, Claude-Userпоиск и загрузка страниц по запросу пользователя
PerplexityPerplexityBot, Perplexity-Userиндекс и загрузка по запросу
GoogleGoogle-Extendedиспользование контента для Gemini; не влияет на Google Поиск и AI Overviews
ЯндексYandexAdditional, YandexAdditionalBotиспользование контента в ответах Алисы AI

Правило для сайтов, которым нужна видимость в ИИ-поиске: не блокируйте поисковых ботов и ботов, которые загружают страницы по запросу пользователя. Запрет ботов для обучения — отдельное бизнес-решение, на показ в поисковых ответах он влиять не должен.

Яндекс. По справке Вебмастера, запрет для YandexAdditional или YandexAdditionalBot убирает информацию с сайта из ответов Алисы AI, а изменение учитывается за 2–14 дней. Правила для этих роботов задаются отдельной секцией по имени, поэтому проверяйте их в анализаторе в Вебмастере.

Пример фрагмента, который закрывает только обучение, но оставляет сайт доступным для поиска и ответов:

User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: OAI-SearchBot
Allow: /

User-agent: YandexAdditionalBot
Allow: /

Cloudflare. Если сайт работает через Cloudflare, проверьте настройки управления AI-краулерами: блокировка на уровне CDN срабатывает раньше правил в файле для роботов, и сайт может быть закрыт для AI-ботов без вашего ведома.

Как сайт читается большими языковыми моделями: индекс, краулеры и RAG

ИИ-поиск не читает сайт целиком в момент вопроса. Алиса AI, Google AI Overviews и поиск в чат-ботах работают по схеме RAG: находят подходящие страницы в своём индексе, извлекают из них фрагменты и собирают ответ со ссылками. Поэтому техническая часть сводится к трём вопросам: попадает ли страница в индекс, читается ли её текст и можно ли из него вырезать точный ответ.

Рендеринг. Боты вроде GPTBot, ClaudeBot и PerplexityBot читают HTML напрямую. Если текст статьи, цена или характеристики подгружаются JavaScript после загрузки, часть ботов их не увидит. Главный контент должен быть в исходном HTML.

Доступность. Страницы отдают код 200, не закрыты авторизацией, не требуют действий пользователя, чтобы показать текст.

Разметка Schema.org: что работает в Google и Яндексе

Google для AI Overviews и AI Mode специальной разметки не требует: там работает та же разметка, что и для обычного поиска. Для Яндекса прямого требования нет, но в практике разметку называют полезным сигналом для Алисы AI.

Минимальный набор для контентного сайта: Organization — для компании, Article — для статей с автором и датами, FAQPage — для блока вопросов, BreadcrumbList — для хлебных крошек. Для курсов — Course, для товаров — Product с Offer. Проверка — валидатор структурированных данных в Яндекс Вебмастере и Rich Results Test в Google.

Разметка не заменяет контент: без содержательного ответа на странице она ничего не даст.

Как писать контент под LLM: практика

LLM извлекает из страницы фрагменты, поэтому текст должен состоять из блоков, которые понятны без соседних абзацев. Ниже — четыре приёма с примерами «до и после».

Прямой ответ под заголовком

Было: «В последние годы всё больше компаний задумываются о том, как нейросети влияют на поиск. Разберёмся, что с этим делать.»

Стало: «llms.txt — текстовый файл в формате Markdown в корне сайта, который описывает главные страницы для языковых моделей. На видимость в ChatGPT и Google AI Overviews он не влияет.»

Первое предложение раздела отвечает на вопрос из заголовка. Контекст и детали — после.

Сущность вместо местоимения

Было: «Он появился недавно и быстро стал популярным.»

Стало: «Формат llms.txt предложил Джереми Ховард из Answer.AI.»

Абзац, который начинается с «он» или «это», теряет смысл, если нейросеть вырежет его отдельно.

Факт вместо оценки

Было: «Этот инструмент очень важен для современного сайта.»

Стало: «По данным Ahrefs, 97% файлов llms.txt в мае 2026 года не получили ни одного запроса.»

Фраза с цифрой, источником и датой может быть процитирована как есть; оценочная — нет.

Таблица для сравнений

Если в тексте сравниваются варианты, параметры или сроки, вынесите их в таблицу. Сравнение трёх служебных файлов в начале этой статьи — пример блока, который удобно извлечь целиком.

Мифы технической GEO-оптимизации

GEO (Generative Engine Optimization) — оптимизация под генеративный поиск на основе искусственного интеллекта. Вокруг неё быстро сложился «обязательный» набор советов, часть которого не подтверждается документацией самих AI-компаний.

МифЧто на самом деле
«llms.txt — новый стандарт, без него нейросети вас не увидят»файл не признан стандартом, Google его не использует, 97% файлов никто не запрашивает
«OpenAI официально поддерживает llms.txt»в документации OpenAI по краулерам llms.txt не упоминается
«Нужна специальная AI-разметка»Google: специальной разметки для AI-функций нет
«Закрыл GPTBot — пропал из ChatGPT»для поиска используется OAI-SearchBot; GPTBot отвечает за обучение
«GEO заменяет SEO»ИИ-поиск берёт источники из поискового индекса, SEO остаётся основой

Технический чек-лист под ИИ-поиск

Обязательное

Опциональное

Отмечено 0 из 12

Отметки помогают организовать проверку. Они помогают спланировать доработки и сбрасываются при обновлении страницы.

FAQ: частые вопросы о llms.txt

Что такое llms.txt простыми словами?

llms.txt — текстовый файл в формате Markdown в корне сайта, который коротко описывает сайт и перечисляет главные страницы для языковых моделей. Формат предложил Джереми Ховард (Answer.AI).

llms.txt — это стандарт?

Нет. У llms.txt нет признания W3C, IETF или schema.org и нет обязательной спецификации. Это добровольная договорённость, которую AI-сервисы могут поддерживать или игнорировать.

Влияет ли llms.txt на попадание в ответы ChatGPT и Алисы?

Подтверждений нет. Крупные AI-компании не используют llms.txt для поиска, Яндекс позицию не публиковал, а исследование SE Ranking не нашло связи между наличием llms.txt и частотой цитирования.

Чем llms.txt отличается от robots.txt?

Файл robots.txt разрешает или запрещает роботам обход сайта. llms.txt ничего не запрещает — он только описывает главные страницы. Управлять доступом AI-ботов нужно через правила для роботов.

Нужен ли llms-full.txt?

Только для документации, API и SaaS-продуктов. Коммерческому сайту он не нужен и отдаёт все тексты одним файлом любому, кто его запросит.

Как убрать сайт из ответов Алисы AI?

Добавьте запрет для YandexAdditional или YandexAdditionalBot в правила для роботов. По справке Яндекса, изменение учитывается за 2–14 дней, а сайт остаётся в обычной выдаче.

Экспертные статьи