Файл llms.txt — текстовый файл в формате Markdown, который лежит в корневой папке сайта и кратко описывает для языковых моделей, о чём сайт и какие страницы на нём главные. В 2026 году его часто называют «новым стандартом», но формально это добровольное предложение сообщества, а не утверждённая норма. Не путать с файлом, который управляет доступом роботов (robots), и с sitemap.xml, который перечисляет все страницы для индексации.
Данные актуальны на сентябрь 2026 года. Позиции AI-компаний по llms.txt меняются, поэтому даты заявлений указаны в тексте.
Формат llms.txt предложил Джереми Ховард (Jeremy Howard), сооснователь Answer.AI и fast.ai, в сентябре 2024 года. Идея простая: большим языковым моделям трудно разбирать HTML-страницы с меню, баннерами и скриптами, поэтому сайт может положить рядом короткую текстовую карту в формате Markdown — со ссылками на главные материалы и их описанием.
Предложение описано на сайте llmstxt.org. На середину 2026 года у llms.txt нет признания W3C, IETF или schema.org, нет обязательной спецификации и нормативного валидатора. Поэтому корректнее говорить не о стандарте, а о договорённости, которую каждый AI-сервис может поддерживать или игнорировать.
| Документ | Для кого | Что делает |
|---|---|---|
| robots.txt | поисковые роботы и AI-краулеры | разрешает или запрещает обход разделов |
| sitemap.xml | поисковые роботы | перечисляет страницы для индексации |
| llms.txt | языковые модели и агенты | кратко описывает сайт и главные страницы |
| llms-full.txt | языковые модели и агенты | отдаёт полный текст ключевого контента одним файлом |
Официальная поддержка llms.txt у крупных AI-компаний в 2026 году отсутствует, а серверные логи показывают, что его почти не запрашивают.
Google. В руководстве по генеративным функциям поиска Google пишет, что llms.txt и другие специальные «AI-файлы» не нужны для появления в поиске, включая AI Overviews и AI Mode, потому что Google Search их не использует. 15 июня 2026 года компания ещё раз добавила эту пометку в документацию. Джон Мюллер из Google сравнивал llms.txt с метатегом keywords (meta tag keywords) — классическим примером разметки, которую заполняют владельцы сайтов, но не читают поисковые системы.
OpenAI и Anthropic. В документации OpenAI по краулерам llms.txt не упоминается: управлять доступом компания предлагает через robots.txt. Anthropic придерживается той же позиции. При этом обе компании публикуют файл для собственной документации для разработчиков — там он полезен ассистентам для программистов.
Perplexity — заметное исключение: компания сообщает, что загружает llms.txt, чтобы расставлять приоритеты страниц.
Яндекс официальной позиции по llms.txt не публиковал. Утверждения, что Алиса AI «быстрее понимает сайт» благодаря llms.txt, ничем не подтверждены.
| Исследование | Что показало |
|---|---|
| Ahrefs, логи 137 000 доменов, май 2026 | 97% файлов llms.txt не получили ни одного запроса; из запросов, которые были, на поисковых AI-ботов пришлось 1,1% |
| Ahrefs, там же | около 22% обращений к файлу — SEO-аудиторы, которые проверяют его наличие |
| SE Ranking, ~300 000 доменов | нет статистически значимой связи между наличием llms.txt и частотой цитирования в AI-ответах |
| Ahrefs, там же | на доменах без файла AI-боты его даже не запрашивали — то есть не ищут его |
Вывод для практики: llms.txt не является фактором видимости в чат-ботах, Алисе или Google AI Overviews и Google AI Mode. Время, которое уходит на его «оптимизацию», лучше потратить на тексты и технические основы.
Внедрение llms.txt оправдано там, где сайт используют не только поисковые системы, но и агенты и инструменты разработчиков, которые загружают файл по запросу.
| Тип сайта | Нужен ли llms.txt |
|---|---|
| Документация, API, SaaS | да, llms.txt и llms-full.txt вместе: их читают ассистенты для программистов |
| Большой каталог товаров или курсов | желательно: короткая карта разделов для агентов |
| Корпоративный сайт, блог, онлайн-школа | по желанию: 20 минут работы без ожиданий роста трафика |
| Лендинг из одной страницы | не нужен |
Главная ошибка — считать llms.txt пунктом, который «включает» видимость в нейросетях. Файл не заменяет индексацию, тексты и ссылки, и SEO-аудиторы, которые снижают оценку сайта за его отсутствие, проверяют сам факт наличия файла, а не его влияние.
Файл llms.txt — обычный документ в формате Markdown с фиксированным порядком блоков. Пишется он вручную за 15–20 минут.
Правила, которые делают документ полезным:
Ниже — пример файла для Digital Skills Academy. Его можно взять как шаблон и заменить ссылки и описания на свои.
# Digital Skills Academy
> Онлайн-школа цифровых профессий: интернет-маркетинг, SEO, SMM, трафик, нейросети для маркетинга. Лицензированные программы профессиональной переподготовки и повышения квалификации.
Курсы рассчитаны на новичков и практикующих специалистов, включают практические задания, кейсы и проекты для портфолио. Обучение онлайн, в потоковом и асинхронном формате.
## Курсы
- [Интернет-маркетолог + ИИ](https://digitalskillsacademy.ru/internetmarketer): 18 модулей за 3 месяца — стратегия, performance-каналы, SEO, веб-аналитика, CRM-маркетинг
- [Нейросети для маркетинга](https://digitalskillsacademy.ru/courses/nejroseti-v-marketinge): 5 модулей за 1 месяц — ChatGPT, Claude, Алиса AI, автоматизация, собственный ИИ-агент
- [SEO-продвижение](https://digitalskillsacademy.ru/seo): курс по поисковой оптимизации
- [SMM-менеджер](https://digitalskillsacademy.ru/smm): курс по продвижению в социальных сетях
- [Трафик-менеджер](https://digitalskillsacademy.ru/trafficmanager): курс по платному трафику
- [Каталог курсов](https://digitalskillsacademy.ru/catalog): все программы школы
## О школе
- [Эксперты](https://digitalskillsacademy.ru/experts): преподаватели и их опыт
- [Сведения об образовательной организации](https://digitalskillsacademy.ru/information): лицензия и документы
- [Контакты](https://digitalskillsacademy.ru/contacts): телефон, почта, мессенджеры
## Optional
- [Блог](https://digitalskillsacademy.ru/blog): статьи о маркетинге, SEO и нейросетях
- [Словарь терминов](https://digitalskillsacademy.ru/glossary): расшифровка иностранных терминов
Что сделано правильно: у каждой ссылки есть фактическое описание, контакты вынесены в отдельный раздел, второстепенные материалы помечены как Optional, а юридические страницы и формы оплаты в файл не попали.
llms-full.txt — расширенная версия, в которой лежит не список ссылок, а сам текст ключевых страниц. Формат полезен для документации: ассистент для программистов загружает один файл вместо десятков страниц.
Для большинства коммерческих сайтов расширенная версия не нужна. У неё есть и оборотная сторона: она отдаёт весь ваш контент в удобном для копирования виде любому, кто его запросит, — это важно, если бизнес зависит от визитов на страницы.
На Tilda, 1С-Битрикс и WordPress llms.txt загружается через файловый менеджер, SFTP или плагин. Нормативного валидатора нет: сторонние сервисы проверяют доступность и формальную структуру, а не «соответствие стандарту».
Доступ AI-сервисов к сайту управляется правилами для роботов, а не llms.txt. Поисковыми роботами классических систем и AI-ботами управляют одинаково — директивами User-agent и Disallow. У крупных компаний несколько ботов с разными задачами, и запрет одного из них не означает запрета остальных.
| Компания | Бот | Задача |
|---|---|---|
| OpenAI | GPTBot | сбор данных для обучения моделей |
| OAI-SearchBot | индекс для поиска в чате | |
| ChatGPT-User | загрузка страниц по запросу пользователя | |
| Anthropic | ClaudeBot | сбор данных для обучения |
| Claude-SearchBot, Claude-User | поиск и загрузка страниц по запросу пользователя | |
| Perplexity | PerplexityBot, Perplexity-User | индекс и загрузка по запросу |
| Google-Extended | использование контента для Gemini; не влияет на Google Поиск и AI Overviews | |
| Яндекс | YandexAdditional, YandexAdditionalBot | использование контента в ответах Алисы AI |
Правило для сайтов, которым нужна видимость в ИИ-поиске: не блокируйте поисковых ботов и ботов, которые загружают страницы по запросу пользователя. Запрет ботов для обучения — отдельное бизнес-решение, на показ в поисковых ответах он влиять не должен.
Яндекс. По справке Вебмастера, запрет для YandexAdditional или YandexAdditionalBot убирает информацию с сайта из ответов Алисы AI, а изменение учитывается за 2–14 дней. Правила для этих роботов задаются отдельной секцией по имени, поэтому проверяйте их в анализаторе в Вебмастере.
Пример фрагмента, который закрывает только обучение, но оставляет сайт доступным для поиска и ответов:
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: OAI-SearchBot
Allow: /
User-agent: YandexAdditionalBot
Allow: /
Cloudflare. Если сайт работает через Cloudflare, проверьте настройки управления AI-краулерами: блокировка на уровне CDN срабатывает раньше правил в файле для роботов, и сайт может быть закрыт для AI-ботов без вашего ведома.
ИИ-поиск не читает сайт целиком в момент вопроса. Алиса AI, Google AI Overviews и поиск в чат-ботах работают по схеме RAG: находят подходящие страницы в своём индексе, извлекают из них фрагменты и собирают ответ со ссылками. Поэтому техническая часть сводится к трём вопросам: попадает ли страница в индекс, читается ли её текст и можно ли из него вырезать точный ответ.
Рендеринг. Боты вроде GPTBot, ClaudeBot и PerplexityBot читают HTML напрямую. Если текст статьи, цена или характеристики подгружаются JavaScript после загрузки, часть ботов их не увидит. Главный контент должен быть в исходном HTML.
Доступность. Страницы отдают код 200, не закрыты авторизацией, не требуют действий пользователя, чтобы показать текст.
Google для AI Overviews и AI Mode специальной разметки не требует: там работает та же разметка, что и для обычного поиска. Для Яндекса прямого требования нет, но в практике разметку называют полезным сигналом для Алисы AI.
Минимальный набор для контентного сайта: Organization — для компании, Article — для статей с автором и датами, FAQPage — для блока вопросов, BreadcrumbList — для хлебных крошек. Для курсов — Course, для товаров — Product с Offer. Проверка — валидатор структурированных данных в Яндекс Вебмастере и Rich Results Test в Google.
Разметка не заменяет контент: без содержательного ответа на странице она ничего не даст.
LLM извлекает из страницы фрагменты, поэтому текст должен состоять из блоков, которые понятны без соседних абзацев. Ниже — четыре приёма с примерами «до и после».
Было: «В последние годы всё больше компаний задумываются о том, как нейросети влияют на поиск. Разберёмся, что с этим делать.»
Стало: «llms.txt — текстовый файл в формате Markdown в корне сайта, который описывает главные страницы для языковых моделей. На видимость в ChatGPT и Google AI Overviews он не влияет.»
Первое предложение раздела отвечает на вопрос из заголовка. Контекст и детали — после.
Было: «Он появился недавно и быстро стал популярным.»
Стало: «Формат llms.txt предложил Джереми Ховард из Answer.AI.»
Абзац, который начинается с «он» или «это», теряет смысл, если нейросеть вырежет его отдельно.
Было: «Этот инструмент очень важен для современного сайта.»
Стало: «По данным Ahrefs, 97% файлов llms.txt в мае 2026 года не получили ни одного запроса.»
Фраза с цифрой, источником и датой может быть процитирована как есть; оценочная — нет.
Если в тексте сравниваются варианты, параметры или сроки, вынесите их в таблицу. Сравнение трёх служебных файлов в начале этой статьи — пример блока, который удобно извлечь целиком.
GEO (Generative Engine Optimization) — оптимизация под генеративный поиск на основе искусственного интеллекта. Вокруг неё быстро сложился «обязательный» набор советов, часть которого не подтверждается документацией самих AI-компаний.
| Миф | Что на самом деле |
|---|---|
| «llms.txt — новый стандарт, без него нейросети вас не увидят» | файл не признан стандартом, Google его не использует, 97% файлов никто не запрашивает |
| «OpenAI официально поддерживает llms.txt» | в документации OpenAI по краулерам llms.txt не упоминается |
| «Нужна специальная AI-разметка» | Google: специальной разметки для AI-функций нет |
| «Закрыл GPTBot — пропал из ChatGPT» | для поиска используется OAI-SearchBot; GPTBot отвечает за обучение |
| «GEO заменяет SEO» | ИИ-поиск берёт источники из поискового индекса, SEO остаётся основой |
Отмечено 0 из 12
Отметки помогают организовать проверку. Они помогают спланировать доработки и сбрасываются при обновлении страницы.
llms.txt — текстовый файл в формате Markdown в корне сайта, который коротко описывает сайт и перечисляет главные страницы для языковых моделей. Формат предложил Джереми Ховард (Answer.AI).
Нет. У llms.txt нет признания W3C, IETF или schema.org и нет обязательной спецификации. Это добровольная договорённость, которую AI-сервисы могут поддерживать или игнорировать.
Подтверждений нет. Крупные AI-компании не используют llms.txt для поиска, Яндекс позицию не публиковал, а исследование SE Ranking не нашло связи между наличием llms.txt и частотой цитирования.
Файл robots.txt разрешает или запрещает роботам обход сайта. llms.txt ничего не запрещает — он только описывает главные страницы. Управлять доступом AI-ботов нужно через правила для роботов.
Только для документации, API и SaaS-продуктов. Коммерческому сайту он не нужен и отдаёт все тексты одним файлом любому, кто его запросит.
Добавьте запрет для YandexAdditional или YandexAdditionalBot в правила для роботов. По справке Яндекса, изменение учитывается за 2–14 дней, а сайт остаётся в обычной выдаче.