Есть ли у сайта llms.txt и правильно ли он оформлен: заголовок, структура разделов, ссылки, MIME-тип.
Конвенция, предложенная в 2024 году: markdown-файл в корне сайта с курируемым набором ссылок на самое важное. В отличие от sitemap.xml, где перечислены все URL без приоритетов, llms.txt — это редакторский выбор: вы сами решаете, что модель должна прочитать в первую очередь, в чистом формате без HTML-шума.
Файл начинается с заголовка «# Название сайта», дальше — строка «>» с кратким описанием (модели используют её как первичный контекст), затем разделы «##» со списками markdown-ссылок по категориям. Инструмент проверяет именно эти элементы — заголовок, описание, ссылки — и MIME-тип ответа.
Модели с ограниченным контекстным окном не могут прочитать весь сайт целиком за один проход. llms.txt — сжатая карта, которая направляет модель сразу на приоритетные страницы вместо того, чтобы она угадывала структуру по HTML. Без файла модель опирается на менее надёжные сигналы — внутреннюю перелинковку и sitemap.
Файл без заголовка H1 или без вступительной цитаты формально существует, но не даёт модели нужного контекста. Ещё одна ошибка — отдавать файл с неверным Content-Type (например text/html вместо text/plain или text/markdown). Третья — не обновлять файл при изменении структуры сайта, тогда ссылки начинают вести на устаревшие страницы.
Один из немногих технических файлов, адресованных именно языковым моделям, а не поисковым роботам.
Простой в реализации формат — markdown-файл без необходимости менять архитектуру сайта.
Помогает расставить приоритеты — какие статьи и страницы модель должна прочитать в первую очередь.
Дешёвый и быстрый шаг в сторону GEO — не требует переписывания сайта, только структурирования того, что уже есть.
Начинайте файл с одного заголовка H1 и короткой цитаты-описания — модели используют именно её как первичный контекст.
Группируйте ссылки по смыслу (документация, ключевые страницы, опциональный контент), а не просто списком.
Отдавайте файл с корректным Content-Type (text/plain или text/markdown), иначе часть парсеров его не примет.
Обновляйте файл при структурных изменениях сайта — устаревшие ссылки обесценивают весь смысл файла.
Sitemap.xml — техническая полная опись всех URL для индексации поисковыми роботами. llms.txt — краткий, курируемый вручную список самого важного для языковых моделей с человекочитаемым описанием, а не просто список ссылок.
Да, по спецификации файл должен быть чистым markdown — без вёрстки, скриптов и навигации, чтобы модель не тратила контекстное окно на HTML-шум.
Нет, наоборот — суть файла в отборе. Перечислите то, что действительно должно попасть в ответы модели: ключевые страницы, документацию, самые ценные статьи.
Нет, это не гарантия, а сигнал. Модели, которые вообще учитывают этот файл, используют его как подсказку о приоритетах — итоговое решение всё равно зависит от релевантности и качества контента.
Кто из 8 AI-ботов (GPTBot, ClaudeBot, PerplexityBot и другие) может заходить на ваш сайт, а кто заблокирован.
Проверить →Полный дамп контента сайта для AI-ассистентов в одном файле — есть ли он и насколько полон.
Проверить →Соберём корректный по структуре llms.txt из названия сайта, описания и ссылок на ключевые разделы.
Проверить →Аудит разбирает все сигналы сразу: техническую доступность, разметку, репутацию и Entity-сигналы бренда — и даёт приоритетный план действий.
Заказать аудит