llms.txt
- title
- llms.txt
- type
- concept
- summary
- Предлагаемая конвенция /llms.txt для передачи LLM структурированного markdown-обзора сайта
- tags
- ai-agents, documentation, web-standards
- created
- 2026-04-07
- updated
- 2026-05-31
- lang
- ru
- translation_of
- llms-txt
- source_updated
- 2026-05-31
- translated
- 2026-09-01
- translator
- lllm/antigravity/gemini-3.7-flash-medium
Предлагаемая конвенция по размещению markdown-файла по адресу /llms.txt на любом веб-сайте, чтобы давать языковым моделям краткий структурированный обзор содержимого сайта. Спецификация находится на llmstxt.org.
Какую проблему это решает
У LLM ограниченное контекстное окно. Сбросить весь сайт документации в промпт не выйдет - контента слишком много, и большая его часть не относится к текущей задаче. Sitemap существует, но это просто XML-списки URL без семантической информации. Robots.txt сообщает краулерам, чего следует избегать, а не что читать в первую очередь.
/llms.txt заполняет этот пробел: это подготовленный человеком markdown-файл, который говорит LLM: "вот о чём этот сайт, а вот важные страницы в формате markdown".
Формат
Файл представляет собой обычный markdown с определённой структурой:
- Заголовок H1 - название проекта или сайта (единственная обязательная часть)
- Цитата (blockquote) - краткая выжимка с необходимым контекстом
- Основной текст - подробная информация о проекте
- Разделы H2 - отобранные списки markdown-ссылок с описаниями, указывающие на важные страницы
- Раздел "Optional" - второстепенная информация, которую можно опустить, если контекстное окно ограничено
Предполагается, что сайты предоставляют .md-версии своих страниц наряду с HTML (например, добавляя .html.md к URL). Это даёт LLM чистый текст без необходимости парсить HTML.
Как это используют агенты
Агент, попадая на незнакомый сайт, первым делом запрашивает /llms.txt, чтобы понять, что доступно и где искать. Вместо того чтобы обходить весь сайт или угадывать шаблоны URL, он получает структурированное оглавление с прямыми ссылками на markdown-версии ключевых страниц.
Это особенно полезно для:
- Сайтов документации (SDK, API, фреймворки)
- Главных страниц проектов с разрозненными техническими деталями
- Любых сайтов, где агенту нужно найти конкретную информацию без ручного просмотра страниц
Внедрение
Существуют интеграции для VitePress, Docusaurus, Drupal и других генераторов статических сайтов. Несколько каталогов отслеживают сайты, у которых есть файлы /llms.txt. Инструменты вроде llms_txt2ctx парсят файл и разворачивают страницы по ссылкам в единый блок контекста.
Бенчмарк agent-reading-test использует /llms.txt в качестве машиночитаемого индекса сайта, проверяя, способны ли агенты ориентироваться в документации по этой конвенции.
Связь с другими стандартами
/llms.txt не заменяет robots.txt (контроль доступа) или sitemap.xml (исчерпывающий список URL). Он существует параллельно с ними для другой цели: не "что существует" или "что разрешено", а "что важно и как это читать". Он рассчитан на использование во время инференса, а не для сбора данных для обучения.
В specification-website-checklist файл /llms.txt рассматривается как часть более широкого стека agent-readiness - /llms-full.txt для полного тела в markdown, исходники в markdown, доступные по .md-адресам наряду с HTML, и HTTP-заголовок Link, объявляющий обо всех трёх, чтобы агенты, которые вообще не парсят HTML, всё равно могли их найти.