BLKHT

llms.txt: что это за файл и нужен ли он вашему сайту

llms.txt что это: разбираем формат по спецификации v2, как составить файл для сайта услуг и что о нём сказано в документации Google, OpenAI и Chrome.

Связаться с BLKHT - в Telegram: t.me/billioniks.

llms.txt: что это за файл и откуда он взялся

Коротко: llms.txt - это markdown-файл в корне сайта с кратким описанием проекта и списком ссылок для ИИ-агентов. Его предложил разработчик Джереми Ховард в 2024 году, действующая версия - v2. Статус у файла - предложение одного автора, не стандарт наподобие robots.txt.

Файл называется по аналогии с robots.txt и sitemap.xml, но статус у него другой. Спецификация llmstxt.org описывает его так:

«We propose adding a /llms.txt markdown file to websites to provide LLM-friendly content».

- llmstxt.org (перевод: «Мы предлагаем добавлять на сайты markdown-файл /llms.txt, чтобы предоставлять содержимое, удобное для языковых моделей»), https://llmstxt.org/

Автор предложения - Джереми Ховард, разработчик из компании Answer.AI. Первая версия опубликована 3 сентября 2024 года, текущая - v2. Ни один поисковик и ни одна организация по стандартизации файл не утверждали: это добровольное соглашение сообщества разработчиков, которое отдельные сайты, платформы и плагины CMS решили поддержать по своей инициативе.

Чем llms.txt отличается от robots.txt и sitemap.xml?

Коротко: три файла решают разные задачи. robots.txt разрешает или запрещает обход страниц роботам. sitemap.xml перечисляет все страницы для индексации. llms.txt - краткий гид с описанием сайта и ссылками, который агент читает по запросу, когда ищет ответ на конкретный вопрос.

Сравнение трёх файлов (назначение llms.txt и sitemap.xml - по спецификации llmstxt.org):

Признакrobots.txtsitemap.xmlllms.txt
Что делаетразрешает/запрещает обход страниц роботамперечисляет все страницы для индексациикраткое описание сайта + ссылки для ИИ-агента
Кто читаетпоисковые и другие роботыпоисковые системыИИ-агенты и чат-ассистенты по запросу пользователя
Обязательный статусчасть Robots Exclusion Protocol, поддерживается поисковикамиобщепринятый формат для поисковых системпредложение одного автора, не стандарт
Когда используетсяпри каждом обходе роботапри индексациикогда агенту нужен ответ на конкретный вопрос, без просмотра всего сайта

Спецификация описывает разницу так: robots.txt сообщает автоматическим инструментам, какой доступ к сайту считается приемлемым, а llms.txt используется по требованию - когда агенту при работе с пользователем нужна информация по теме. Это два файла с разными задачами, не замена друг друга.

Что обязательно должно быть в файле по спецификации v2?

Коротко: обязателен только один элемент - заголовок H1 с названием сайта или проекта. Всё остальное - строка-цитата (начинается с >) с кратким описанием, разделы H2 со списками ссылок, раздел Optional - необязательно.

Формат описан в спецификации предельно конкретно:

«An H1 with the name of the project or site. This is the only required section».

- llmstxt.org (перевод: «H1 с названием проекта или сайта. Это единственный обязательный раздел»), https://llmstxt.org/

Полный порядок разделов по спецификации:

  1. Опциональный BOM (метка кодировки) - можно не ставить.
  2. H1 с названием сайта - единственный обязательный раздел.
  3. Строка-цитата (начинается с >) с коротким описанием - ключевая информация, которая нужна, чтобы понять остальной файл.
  4. Произвольные абзацы или списки без заголовков - подробности о сайте и о том, как читать файл.
  5. Разделы H2 - каждый со списком ссылок вида название: пояснение.
  6. Раздел Optional (по соглашению, отдельным пунктом порядка в спецификации не значится) - необязательные ссылки, которые агент может пропустить при нехватке места в контексте.

Формат читаем и человеком, и языковой моделью одновременно - это markdown, не XML и не JSON, но с фиксированным порядком разделов, который можно разобрать обычной программой.

Что изменилось в версии v2 (август 2026)?

Коротко: v2 добавила стандартные ссылки для обнаружения файла (rel="alternate" и rel="describedby"), разрешила две формы адреса markdown-версии страницы и сняла механический смысл с раздела Optional.

Страница изменений описывает несколько перемен, для владельца сайта главные три. Первая - обнаружение: раньше агенту приходилось искать llms.txt наугад, теперь можно указать его явно.

«v2 answers with standard link relations: rel="alternate" type="text/markdown" points to a page's markdown version, and rel="describedby" points to the llms.txt file that covers it».

- llmstxt.org/changes.md (перевод: «v2 отвечает стандартными атрибутами связи ссылок: rel="alternate" type="text/markdown" указывает на markdown-версию страницы, а rel="describedby" - на файл llms.txt, который её описывает»), https://llmstxt.org/changes.md

Вторая перемена - гибкость адреса markdown-версии страницы: раньше признавалась только форма page.html.md, теперь допустима и page.md. Третья - раздел Optional в файле остался, но потерял механический смысл: раньше по нему специальный инструмент понимал, что можно пропустить при сборке контекста, теперь этот инструмент из предложения убран, и Optional - просто условность для второстепенных ссылок. На странице изменений версия v2 датирована только месяцем - «август 2026», а на главной странице спецификации указана дата изменения - 10 августа 2026 года.

Владелец сайта может составить такой файл сам, по шагам ниже. BLKHT GEO - продвижение бренда в ответах ИИ, по формулировке страницы BLKHT GEO.

Как составить свой llms.txt для сайта услуг: шаблон по шагам

Коротко: файл собирается за один проход по пяти шагам - заголовок, короткое описание, список основных страниц, при необходимости раздел Optional, публикация в корне сайта.

Для сайта услуг малого бизнеса (мастерская, студия, локальный сервис) файл обычно короткий - без документации API и без десятков подразделов, которые нужны крупному продукту.

  1. Заголовок H1. Название сайта или компании, без слоганов.
  2. Строка-цитата с описанием (начинается с >). Одно-два предложения: чем занимается сайт и что на нём есть.
  3. Раздел со ссылками на ключевые страницы. Главная, услуги, контакты - с кратким пояснением после двоеточия.
  4. При необходимости - раздел Optional. Второстепенные страницы: блог, вакансии, юридические документы.
  5. Публикация файла по адресу example.com/llms.txt (корень сайта) обычным текстовым файлом в кодировке UTF-8.

Пример минимального файла для сайта услуг (домен условный):

```text

Локальная мастерская: ремонт бытовой техники, выезд мастера на дом, гарантия на работы.

Основное

  • Услуги: полный список видов ремонта и ориентировочные сроки
  • Контакты: адрес, телефон, форма заявки
  • Гарантия: условия гарантии на выполненные работы

Optional

  • Блог: статьи о правилах ухода за техникой ```

Файл не должен содержать ссылок на будущие страницы или на страницы, которых ещё нет: агент, который пройдёт по такой ссылке, получит 404 вместо содержимого.

Есть ли директива «llms.txt» в robots.txt?

Коротко: нет. В справке Яндекс.Вебмастера по robots.txt такой директивы не описано. Формулировка «llms.txt в robots.txt» смешивает два разных файла - это не строчка внутри robots.txt, а отдельный файл рядом с ним.

Справка Яндекс.Вебмастера перечисляет поддерживаемые директивы robots.txt - User-agent, Disallow, Allow, Sitemap и Clean-param (Crawl-delay Яндекс не учитывает с 22 февраля 2018 года) - и упоминания llms.txt среди них нет. Robots.txt может как угодно ограничивать обход страниц, но сделать из llms.txt его директиву нельзя - таких правил протокол не предусматривает. Если хочется связать два файла явно, для этого в v2 спецификации есть свой механизм - ссылка rel="describedby" на странице или в HTTP-заголовке, вне текста robots.txt.

Как проверить, что файл действительно отдаётся?

Коротко: три быстрые проверки - файл открывается по прямому адресу и возвращает код 200, содержимое отдаётся обычным текстом без HTML-обёртки, и агент, которому дали только этот файл, может ответить на базовый вопрос о сайте.

Проверка по шагам:

  1. Открыть в браузере или через curl -I https://example.com/llms.txt - должен вернуться код ответа 200 (не 404).
  2. Убедиться, что содержимое отдаётся как обычный текст (Content-Type: text/plain или text/markdown), без HTML-обёртки с навигацией и футером сайта - спецификация называет именно захламлённость HTML-обвязкой причиной, по которой агентам неудобно работать с обычными страницами напрямую.
  3. Проверить формат: H1 на месте, дальше - строка-цитата (начинается с >), дальше - разделы H2 со списками ссылок.
  4. Спецификация прямо советует практическую проверку: дать ИИ-агенту только этот файл и задать вопрос о содержимом сайта - если ответ по существу, файл работает как описание.

Chrome Lighthouse в аудитах агентного просмотра запрашивает файл и отмечает страницу, если сервер отвечает ошибкой; если файла нет (404), аудит помечается как неприменимый (N/A). Это не проверка позиций и не проверка цитирования.

Что говорят Google, OpenAI и Chrome про влияние llms.txt на ответы ИИ?

Коротко: ни один из трёх источников не называет llms.txt условием попадания в свои ИИ-ответы. Google говорит, что для его ИИ-функций не нужны дополнительные требования к материалам сайта. Доступ ботов OAI-SearchBot и GPTBot владелец сайта настраивает через robots.txt; llms.txt как отдельный канал влияния в этом документе OpenAI не описан. Chrome называет файл «пока необязательным».

Три источника не сводятся в одно общее мнение - у каждого своя формулировка и свой предмет.

ИсточникЧто именно сказаноО чём это (не о чём)
Google Search Central (ru)для появления в кратком пересказе от ИИ и режиме ИИ дополнительных требований к материалам сайта нет (цитата ниже)о требованиях к материалам сайта для функций Google вообще; llms.txt на странице не упомянут ни разу
OpenAI, документация по ботамOAI-SearchBot (поиск ChatGPT) и GPTBot (обучение моделей) управляются независимо друг от друга через теги в robots.txtо доступе именно этих двух ботов; llms.txt как сигнал для них не назван
Chrome Lighthouse«providing the file is optional at the moment» (перевод: «предоставление файла пока необязательно»)о собственном аудите Lighthouse для агентного просмотра, не о позициях в поиске или ИИ-ответах

Прямая цитата Google:

«Рекомендации по поисковой оптимизации актуальны и в контексте ИИ-функций Google Поиска, таких как краткий пересказ от ИИ и режим ИИ. Чтобы они использовались, не нужно соблюдать дополнительные требования и особым образом дорабатывать контент».

- Google Search Central, «Оптимизация сайта для ИИ-функций», https://developers.google.com/search/docs/appearance/ai-features?hl=ru

Из этого не следует, что файл бесполезен - Google его просто не упоминает в числе требований к материалам сайта вообще, ни в плюс, ни в минус. Точно так же с OpenAI: компания подробно описывает, как управлять доступом OAI-SearchBot и GPTBot через robots.txt, а llms.txt как отдельный канал влияния на выдачу ChatGPT в этом документе не фигурирует.

Кто уже публикует свой llms.txt и что это доказывает?

Коротко: свои файлы llms.txt для документации публикуют, например, справка Яндекс.Вордстата, разработческие порталы OpenAI, Anthropic и Google Gemini API. Это подтверждает, что формат применяется на практике для документации - и не подтверждает, что от него зависят ответы моделей на пользовательские запросы.

Публикацию этих файлов проверили в день написания статьи - все возвращают код 200. Справка Яндекс.Вордстата отдаёт свой файл прямо с указанием на расширенную версию (о работе с самим Вордстатом для оценки спроса - отдельная статья «Как проверить спрос на услугу в своём городе через Вордстат»):

«For more comprehensive documentation, see llms-full.txt».

- справка Яндекс.Вордстата (перевод: «Более полную документацию см. в llms-full.txt»), https://yandex.ru/support2/wordstat/ru/llms.txt

Два факта не совпадают. Первый - эти компании публикуют llms.txt для собственных разделов документации, чтобы агентам-разработчикам было удобнее находить справочные материалы по API. Второй - ни в одном из документов, проверенных для этой статьи, эти компании не заявляют, что используют чужие файлы llms.txt при формировании ответов своих моделей на обычные пользовательские запросы. Публикация файла для своих же документов - не то же самое, что чтение чужих файлов при ответе.

Какие ошибки чаще всего допускают при составлении файла?

Коротко: три частые ошибки - путать llms.txt с директивой внутри robots.txt, обещать в тексте файла эффект, которого источники не подтверждают, и ссылаться на страницы, которых на сайте ещё нет.

Директивы «llms.txt» в robots.txt не существует - это два независимых файла. Вторая ошибка - в описании самого файла или в материалах о нём писать что-то вроде «сайт с этим файлом быстрее попадёт в ответы ИИ»: ни спецификация, ни Google, ни OpenAI такого не утверждают, и добавлять это от себя не стоит. Третья - генерировать раздел со ссылками на страницы, которые ещё не опубликованы, или на разделы, которые CMS сайта не отдаёт: агент пройдёт по ссылке и получит 404 вместо ответа. Отдельно стоит проверять кодировку и формат - файл должен оставаться обычным markdown-текстом, без разметки темы сайта.

Что делать дальше

Проверить свой сайт можно в любом порядке: посмотреть, есть ли уже файл по адресу <ваш домен>/llms.txt, и если нет - собрать его по шагам выше за один проход. Файл простой, требований к оформлению немного, а единственное, чего с ним делать не стоит - обещать себе или клиентам конкретный эффект в ответах нейросетей, которого не обещает ни один источник выше.

Разбор метода замера присутствия бренда в ответах ИИ - на BLKHT Labs. Про смежный инструмент - бесплатный отчёт Яндекс.Вебмастера по упоминаниям сайта в Алисе AI - есть отдельная статья: «Видимость сайта в Алисе AI». Про метатеги страницы (title и description, тоже читаемые и людьми, и роботами, но другая задача) - статья «Как правильно написать title и description для сайта».

Источники

- llmstxt.org, «The /llms.txt file, v2» - https://llmstxt.org/ (проверено 26.09.2026)

- llmstxt.org, «Changes» (v2, August 2026) - https://llmstxt.org/changes.md (проверено 26.09.2026)

- Answer.AI, Jeremy Howard, «/llms.txt - a proposal to provide information to help LLMs use websites» - https://www.answer.ai/posts/2024-09-03-llmstxt.html (проверено 26.09.2026)

- Chrome for Developers, Lighthouse, «llms.txt» (агентный просмотр) - https://developer.chrome.com/docs/lighthouse/agentic-browsing/llms-txt (обновлено 2026-05-05, проверено 26.09.2026)

- Google Search Central, «Оптимизация сайта для ИИ-функций» - https://developers.google.com/search/docs/appearance/ai-features?hl=ru (проверено 26.09.2026)

- OpenAI, «Overview of OpenAI Crawlers» - https://developers.openai.com/api/docs/bots (проверено 26.09.2026)

- OpenAI, документация, индекс - https://developers.openai.com/llms.txt (проверено 26.09.2026)

- Anthropic, документация, индекс - https://docs.anthropic.com/llms.txt (проверено 26.09.2026)

- Google, Gemini API, документация, индекс - https://ai.google.dev/gemini-api/docs/llms.txt (проверено 26.09.2026)

- Яндекс.Вебмастер, «Использование файла robots.txt» - https://yandex.ru/support/webmaster/ru/controlling-robot/robots-txt (проверено 26.09.2026)

- Яндекс.Вебмастер, «Директива Crawl-delay» - https://yandex.ru/support/webmaster/ru/robot-workings/crawl-delay (проверено 26.09.2026)

- Яндекс.Вордстат, llms.txt - https://yandex.ru/support2/wordstat/ru/llms.txt (проверено 26.09.2026)

- BLKHT GEO, страница продукта - https://blkht.ru/geo

Начать проект с BLKHT - в Telegram: t.me/billioniks.

Ещё статьи
Приветственное сообщение в Telegram-канале: как включить и что писатьПриветственное сообщение в Telegram-канале: как включить в профиле чата и что написать новым подписчикам, чем оно отличается от приветствия в личке и от бота.Как проверить товарный знак по названию до заказа логотипаКак проверить товарный знак по названию бесплатно: где искать по слову, а где реестр отвечает только на номер документа, и что решает не самопроверка.Сколько стоит реклама в Яндекс Директе в месяц в 2026: считаем бюджетСколько стоит реклама в Яндекс Директе в месяц: как работает аукцион, зачем НДС 22% сверху сумм в кабинете, какие минимумы и как прикинуть бюджет через Прогноз.