Полный дамп контента сайта для AI-ассистентов в одном файле — есть ли он и насколько полон.
Если llms.txt — оглавление со ссылками, то llms-full.txt — весь текст целиком, собранный в один markdown-документ. Некоторые модели и AI-агенты предпочитают загрузить один большой файл вместо обхода сайта постранично — это быстрее и не зависит от того, доступны ли отдельные страницы для краулинга в моменте запроса.
Он оправдан для сайтов с документацией, базой знаний или большим блогом — там, где ценность в полноте, а не в отборе. Для простого лендинга из нескольких страниц отдельный llms-full.txt обычно избыточен: весь контент и так уместится в llms.txt или будет прочитан по ссылкам оттуда.
Все ссылки внутри файла должны отдавать 200 и не должны блокироваться в robots.txt для AI-краулеров — иначе часть контента, заявленного в файле, окажется недоступной по факту. Размер файла стоит держать в разумных пределах — мегабайты текста снижают шанс, что модель дочитает его целиком.
В отличие от статических файлов, llms-full.txt быстро устаревает при активном изменении контента. Лучшая практика — генерировать его автоматически при сборке сайта или публикации нового материала, а не редактировать вручную от случая к случаю.
Особенно полезно, когда у сайта много связанных страниц, которые логично читать как единое целое.
Можно генерировать автоматически на этапе сборки — не требует ручной поддержки при наличии пайплайна.
Хороший индикатор зрелости AI-стратегии сайта — помогает показать прогресс за пределами базового llms.txt.
Не обязателен всем — оправдан там, где реально много контента, а не как галочка «для порядка».
Проверяйте, что все ссылки внутри файла отдают 200 — сломанные ссылки обесценивают весь дамп.
Не блокируйте AI-краулеры в robots.txt, если публикуете llms-full.txt — иначе файл будет недоступен тем, для кого он создан.
Держите размер файла разумным — постоянно растущий текст снижает вероятность, что модель дочитает его целиком.
Ссылайтесь на llms-full.txt из основного llms.txt, чтобы модель знала о его существовании.
Не всегда — это дополнение для сайтов с большим объёмом контента (документация, база знаний). Для небольшого сайта обычно достаточно llms.txt со ссылками.
Нет, у них разные роли: llms.txt — компактная навигация и приоритеты, llms-full.txt — полный текст для загрузки целиком. Обычно они работают вместе, второй файл указывается ссылкой из первого.
Разбейте контент по значимости и оставьте в llms-full.txt только то, что действительно нужно модели целиком — архивные или второстепенные страницы можно оставить только в llms.txt как ссылки.
Лучше автоматизировать генерацию при сборке или публикации — вручную поддерживать актуальность полного дампа контента на активно обновляемом сайте практически нереально.
Кто из 8 AI-ботов (GPTBot, ClaudeBot, PerplexityBot и другие) может заходить на ваш сайт, а кто заблокирован.
Проверить →Есть ли у сайта llms.txt и правильно ли он оформлен: заголовок, структура разделов, ссылки, MIME-тип.
Проверить →Соберём корректный по структуре llms.txt из названия сайта, описания и ссылок на ключевые разделы.
Проверить →Аудит разбирает все сигналы сразу: техническую доступность, разметку, репутацию и Entity-сигналы бренда — и даёт приоритетный план действий.
Заказать аудит