Файл llms.txt — это текстовый файл в корне сайта, который помогает нейросетям (ChatGPT, Perplexity, Яндекс Нейро и другим) быстро понять, о чём ваш ресурс: чем занимается компания, какие страницы главные и что на них важно. В этом гайде разберём, как устроен файл, покажем готовый рабочий пример, пройдём создание по шагам — вручную и генератором, — а в конце проверим, что всё работает.
Что такое llms.txt простыми словами
llms.txt — «карта смысла» сайта для больших языковых моделей. Если robots.txt говорит роботам, куда можно заходить, а sitemap.xml перечисляет все URL, то llms.txt отвечает на вопрос «что здесь важно и как это понимать»: краткое описание компании, ключевые разделы со ссылками и пояснениями к ним.
Идея в том, что нейросети читают сайты иначе, чем поисковые роботы. Модель не будет обходить тысячи страниц — ей нужен концентрат: кто вы, что предлагаете, где искать подробности. llms.txt отдаёт этот концентрат в предсказуемом месте и в удобном для модели формате (обычный markdown).
Не менее важно, чем llms.txt не является:
- это не инструмент индексации — файл не добавит страницы в поиск и не ускорит их обход;
- это не управление доступом — запретить нейросети читать сайт файл не может (для этого есть robots.txt и правила для AI-краулеров);
- это не микроразметка — schema.org он не заменяет, а дополняет.
Читают ли нейросети llms.txt на самом деле
Честный ответ важнее маркетингового, поэтому по порядку. llms.txt — предложенный стандарт: идею осенью 2024 года сформулировал Джереми Ховард, сооснователь Answer.AI, и она быстро разошлась по индустрии. Но «предложенный» — значит, что обязательной поддержки от всех AI-платформ нет: это не официальный протокол вроде robots.txt, закреплённый десятилетиями практики.
Что известно на сегодня:
- файл активно используют платформы документации — разработчики публикуют llms.txt, чтобы AI-ассистенты точнее отвечали по их продуктам; у многих технологических компаний файл уже лежит в корне;
- часть AI-краулеров и сервисов читает файл при обращении к сайту — особенно когда пользователь спрашивает о конкретной компании;
- крупные поисковики официально поддержку не подтверждали — представители Google прямо говорили, что их системы файл пока не используют. Яндекс публичных заявлений о llms.txt тоже не делал.
А теперь живой пример того, зачем это всё. Мы спросили Perplexity о нашей компании — и нейросеть уверенно приписала нам услугу, которую мы не оказываем: ведение рекламы в Google Ads. Модель собрала ответ из старых упоминаний и додумала остальное:
Ровно эту проблему и решает llms.txt: вы отдаёте нейросети проверенные формулировки — название, услуги, условия, — вместо того чтобы она собирала факты по крупицам.
Почему мы рекомендуем сделать файл, несмотря на неофициальный статус: цена вопроса — 30–60 минут работы, никаких рисков он не создаёт, а спрос на ответы нейросетей растёт. Это часть той же логики, что и GEO-продвижение: вы не можете заставить нейросеть себя процитировать, но можете сильно упростить ей задачу.
Кто уже использует llms.txt
Стандарт быстрее всего прижился там, где точность ответов ИИ критична, — в документации технологических компаний:
- Anthropic (разработчик Claude) публикует llms.txt для своей документации — чтобы AI-ассистенты отвечали разработчикам по API без искажений;
- Mintlify, платформа для документации, генерирует llms.txt автоматически для всех размещённых на ней проектов — так файл разом появился у тысяч продуктов, включая популярные инструменты для разработчиков;
- проекты экосистемы Answer.AI — автора стандарта — используют его с первого дня;
- в сети есть публичные каталоги внедрений, где счёт сайтов с llms.txt идёт на тысячи — от стартапов до крупных SaaS-продуктов.
Что это значит для коммерческого сайта в рунете: волна идёт от документации к бизнесу, и пока файл есть у единиц конкурентов. Размещение занимает час и даёт фору — когда AI-сервисы начнут использовать стандарт шире, ваш файл уже будет лежать и работать, а нейросети уже сейчас найдут в нём проверенные факты вместо догадок.
llms.txt и llms-full.txt: в чём разница
Стандарт описывает два файла, и путают их постоянно:
- llms.txt — короткий каталог: описание сайта и аннотированные ссылки на ключевые страницы. Модель читает его и решает, куда идти за подробностями. Нужен практически любому сайту, который хочет быть понятным для ИИ.
- llms-full.txt — полная выгрузка: весь значимый контент сайта одним markdown-файлом, чтобы модель получила материал целиком без обхода страниц. Актуален в первую очередь для документации и баз знаний; коммерческому сайту услуг он обычно не нужен — начните с llms.txt.
Если сомневаетесь, нужен ли вам второй файл, — не нужен. Сначала базовый llms.txt, а llms-full.txt — когда появится задача скармливать ИИ большой объём контента целиком.
llms.txt, robots.txt и sitemap.xml: кто за что отвечает
Три файла в корне сайта решают три разные задачи и не заменяют друг друга:
| Файл | Вопрос, на который отвечает | Формат | Для кого |
|---|---|---|---|
| robots.txt | «Куда роботам можно, куда нельзя» | Директивы | Краулеры поисковиков и ИИ |
| sitemap.xml | «Какие страницы есть на сайте» | XML-список URL | Поисковые роботы |
| llms.txt | «О чём сайт и что здесь важно» | Markdown с пояснениями | Языковые модели |
Частый вопрос — надо ли прописывать llms.txt в robots.txt. Нет: файл не является служебным ресурсом для поисковых роботов, и директив для него не существует. Достаточно, чтобы он был доступен по стандартному адресу /llms.txt и не был закрыт от обхода. Подробнее о первых двух файлах — в статье robots.txt и sitemap.xml: настройка для SEO.
Структура файла: разбор по секциям
Формат намеренно простой — обычный markdown с фиксированным порядком блоков:
- Заголовок H1 (
#) — название компании или проекта. Единственный обязательный элемент. - Цитата (
>) — краткое описание сути в одно-два предложения: кто вы, что делаете, ключевые условия. Это самая важная строка файла: её модель прочитает точно. - Свободные абзацы — контекст, который не влез в цитату: подход, география, особенности. Коротко, без маркетинговой воды.
- Секции (
##) — тематические группы ссылок. Внутри каждой — список вида- [название](URL): пояснение, что на странице. Пояснение после двоеточия — обязательная часть смысла: именно оно говорит модели, что найдётся по ссылке. - Секция
## Optional— особый блок для второстепенных ссылок: спецификация разрешает моделям пропускать его, если контекст ограничен. Сюда — то, без чего суть не теряется.
Здравый смысл важнее полноты: файл — концентрат, а не зеркало сайта. Отберите 5–15 страниц, которые дают максимум понимания бизнеса: услуги, цены, ключевые разделы. Перечислять все страницы не нужно — для этого есть sitemap.
Отдельно про цитату — самую читаемую строку файла. Рабочая формула: кто вы + что делаете + для кого или где + ключевые условия цифрами. Сравните: «Компания N — лидер в своей отрасли с индивидуальным подходом» не даёт модели ни одного факта для цитирования, а «Компания N — производство корпусной мебели на заказ в Казани, срок изготовления от 10 дней, замер бесплатно» — целых четыре. Нейросеть пересказывает то, что можно пересказать; дайте ей факты.
Готовый пример llms.txt
Лучше один рабочий образец, чем три абзаца теории. Вот действующий файл нашего сайта — он лежит по адресу seoreach.ru/llms.txt, можете открыть и посмотреть полную версию в оригинале (здесь приводим с небольшими сокращениями):
# SEO Reach — SEO-агентство
> SEO-продвижение сайтов, GEO-продвижение в нейросетях (Generative Engine
> Optimization), контекстная реклама (Яндекс Директ) и разработка сайтов
> под ключ. Работаем по всей России, программное покрытие 30 городов.
> Тарифы на SEO от 30 000 ₽/мес, бесплатный экспресс-аудит перед стартом.
SEO Reach помогает бизнесу расти в поиске Яндекса и Google. Ориентируемся
на бизнес-результат — трафик, заявки и выручку. Только белое SEO.
## Услуги
- [SEO-продвижение сайта](https://seoreach.ru/services/seo-prodvizhenie/): комплексное продвижение, тарифы от 30 000 ₽/мес
- [GEO-продвижение в нейросетях](https://seoreach.ru/services/geo-prodvizhenie/): попадание бренда в ответы Яндекс Нейро, Алисы, Google AI Overviews, ChatGPT и Perplexity
- [Контекстная реклама](https://seoreach.ru/services/kontekstnaya-reklama/): настройка и ведение Яндекс Директ от 15 000 ₽/мес
- [SEO-аудит сайта](https://seoreach.ru/services/audit-sayta/): детальный аудит с отчётом от 5 000 ₽
- [Разработка сайта](https://seoreach.ru/services/razrabotka-sayta/): статические сайты с заложенной SEO-основой
## Города
- [Услуги в городах России](https://seoreach.ru/cities/): SEO и реклама в Москве, Санкт-Петербурге и других городах
## Материалы
- [Блог](https://seoreach.ru/blog/): статьи о SEO, контекстной рекламе и веб-аналитике
- [Кейсы](https://seoreach.ru/cases/): реальные результаты клиентов
Так файл выглядит в браузере — обычный текст, доступный по прямому адресу:
Обратите внимание на три вещи. Во-первых, цитата в начале содержит главные факты — чем занимаемся, география, цены: даже если модель прочитает только её, она уже сможет корректно рассказать о компании. Во-вторых, у каждой ссылки есть пояснение после двоеточия — это не декор, а подсказка модели, когда переходить именно сюда. В-третьих, файл короткий: услуги и ключевые разделы, а не все двести страниц сайта.
Скелет под другую нишу: интернет-магазин
Чтобы показать, что формат универсален, — каркас файла для интернет-магазина. Логика та же, меняется наполнение секций:
# {Название магазина}
> Интернет-магазин {категория товаров}: {N} товаров в каталоге, доставка
> по {география}, {ключевое условие — например, возврат 30 дней}.
## Каталог
- [{Категория 1}](URL): {что внутри, ценовой диапазон}
- [{Категория 2}](URL): {что внутри}
## Покупателям
- [Доставка и оплата](URL): способы, сроки, стоимость
- [Возврат](URL): условия и сроки возврата
## Optional
- [Блог](URL): обзоры и подборки товаров
Для магазина в секции каталога достаточно родительских категорий — тянуть в файл тысячи карточек товаров не нужно: модель, которой понадобится конкретный товар, дойдёт до него по ссылке категории.
Как создать llms.txt вручную: пошагово
Весь процесс занимает 30–60 минут:
- Выберите страницы. Выпишите 5–15 URL, которые лучше всего объясняют бизнес: главные услуги, цены, «о компании», ключевые разделы каталога. Критерий простой: если бы человек мог прочитать только эти страницы — понял бы он, что вы предлагаете?
- Сгруппируйте по смыслу. Услуги отдельно, контент отдельно, второстепенное — в
## Optional. Обычно получается 2–4 секции. - Напишите описания. Заголовок-название, цитату с сутью (кто вы, что делаете, ключевые условия) и пояснение к каждой ссылке. Пишите фактами, а не лозунгами: «тарифы от N», «отчёт за 3 дня» полезнее, чем «лидер рынка».
- Соберите файл. Обычный текстовый редактор, кодировка UTF-8, разметка markdown как в примере выше. Имя файла — строго
llms.txt, строчными. - Положите в корень сайта. Файл должен открываться по адресу
https://ваш-домен.ru/llms.txt. Как это сделать на разных платформах — ниже.
Генераторы llms.txt: когда автоматика уместна
Онлайн-генераторы и плагины собирают файл автоматически: обходят сайт, берут заголовки и мета-описания страниц и складывают их в шаблон. Из известных инструментов:
- генератор Writesonic — бесплатный онлайн-сервис: вводите домен, получаете черновик файла по страницам сайта;
- SiteSpeakAI — аналогичный генератор от сервиса AI-чатботов, умеет и llms-full.txt;
- русскоязычные онлайн-генераторы — есть и локальные сервисы, работающие по тому же принципу (найдутся по запросу «генератор llms txt»);
- плагины для WordPress — в официальном каталоге есть плагины вроде «Website LLMs.txt», которые не только создают файл, но и обновляют его при изменении контента.
Автоматика уместна как черновик: она быстро даст каркас со списком страниц, особенно на большом сайте. Но у сгенерированных файлов типовые слабости: описания-обрубки из мета-тегов, случайные страницы в списке, отсутствие главного — внятной цитаты о том, чем компания отличается. Модель прочитает ровно то, что написано, поэтому редактура руками обязательна: уберите лишние ссылки, перепишите описания фактами, добавьте цитату-суть. Генератор экономит 20 минут на разметке — но думать за вас не будет.
Как добавить файл на сайт
WordPress
Два пути. Быстрый — плагин: в каталоге WordPress есть плагины, которые создают и обновляют llms.txt автоматически (ищите по запросу «llms.txt»). Ручной — загрузить файл по FTP или через файловый менеджер хостинга в корневую директорию сайта, туда же, где лежит robots.txt. После загрузки проверьте адрес ваш-домен.ru/llms.txt.
Tilda
В Тильде файл добавляется через настройки сайта: раздел загрузки файлов позволяет разместить документ в корневой директории. Загрузите llms.txt — и он станет доступен по стандартному адресу. Если тариф не даёт загружать файлы в корень, вариант обходной: экспорт сайта или прокси-настройка на своём домене.
Bitrix
Загрузите файл в корень через административную панель («Контент» → файловый менеджер) или по FTP — рядом с robots.txt. На Битриксе часто работает связка сайт + личный кабинет на поддомене: llms.txt кладите в корень основного домена, по которому вас ищут клиенты.
Статический сайт
Проще всего: положите llms.txt в папку статических файлов проекта — при сборке он окажется в корне. Наш сайт статический, и файл из примера выше добавлен именно так: одно действие при сборке, никаких плагинов. Это, кстати, общий плюс статики: «сделал и забыл», без обновлений плагинов и патчей безопасности.
AI-краулеры и robots.txt: кого пускать на сайт
llms.txt бесполезен, если роботы нейросетей вообще не могут зайти на сайт. Прежде чем ждать эффекта, проверьте robots.txt: многие сайты блокируют AI-краулеров, даже не подозревая об этом, — например, правилом «запретить всем, кроме Яндекса и Google». Основные боты, которых стоит знать:
| User-agent | Чей | Зачем приходит |
|---|---|---|
| GPTBot | OpenAI | Сбор данных для обучения моделей |
| OAI-SearchBot | OpenAI | Индекс для поиска ChatGPT |
| ChatGPT-User | OpenAI | Заходит, когда пользователь спрашивает о сайте |
| ClaudeBot | Anthropic | Сбор данных для Claude |
| PerplexityBot | Perplexity | Индекс AI-поисковика Perplexity |
| Google-Extended | Управляет использованием контента для Gemini | |
| Meta-ExternalAgent | Meta | Данные для моделей Llama |
Практическое правило: если цель — присутствие бренда в ответах нейросетей, пускайте как минимум поисковых AI-ботов (OAI-SearchBot, ChatGPT-User, PerplexityBot). Блокировать ли ботов, собирающих данные для обучения (GPTBot, ClaudeBot), — вопрос политики: для коммерческого сайта услуг открытость обычно выгоднее, ведь именно из этих данных модель узнаёт о вашем существовании. Яндекс отдельного AI-краулера не заявлял — Нейро и Алиса опираются на общий поисковый индекс, так что для них решает обычная индексация в Яндексе.
Как проверить, что файл работает
Проверка в пять шагов, от простого к содержательному:
-
Доступность. Откройте
ваш-домен.ru/llms.txtв браузере. Файл должен отдаваться как обычный текст с кодом ответа 200 — без редиректов на главную и без ошибки 404. -
Структура. Сверьте с форматом: один
#-заголовок, цитата>, секции##, у ссылок есть пояснения. Существуют онлайн-валидаторы формата llms.txt — они отловят грубые ошибки разметки. -
Тест в нейросетях. Самая показательная проверка: составьте протокол из 5–7 вопросов о вашей компании и задавайте их регулярно в ChatGPT, Perplexity и Алисе. Рабочий набор вопросов:
- «Чем занимается {компания}?» — проверяет базовые факты;
- «Какие услуги предлагает {компания} и сколько они стоят?» — проверяет, дошли ли цены и условия;
- «{Ваша услуга} в {вашем городе} — кого посоветуешь?» — проверяет попадание в рекомендации;
- «Чем {компания} отличается от конкурентов?» — проверяет, какие УТП модель считывает.
Зафиксируйте ответы до размещения файла и повторяйте тест раз в несколько недель: смотрите, стали ли формулировки точнее и появились ли ссылки на ваши страницы. Гарантий здесь нет и быть не может — нейросети сами решают, что цитировать, — но динамику ответов вы увидите.
-
Логи сервера. Если есть доступ к логам, поищите заходы AI-краулеров из таблицы выше — обращаются ли они к
/llms.txtи к страницам сайта вообще. Закрытый для ИИ сайт в ответы нейросетей не попадёт, какой бы файл вы ни сделали. -
AI-трафик в аналитике. Переходы из нейросетей уже видны в счётчиках: источники вида chatgpt.com и perplexity.ai появляются в Яндекс Метрике и Google Analytics в отчётах по переходам с сайтов. Выделите их в отдельный сегмент и следите за динамикой — это и есть конечная метрика всей работы: не «бот прочитал файл», а «человек пришёл из ответа нейросети и оставил заявку».
Частые ошибки
- Весь сайт в файле. Сто ссылок без приоритетов — модель утонет так же, как человек. Концентрат, а не карта сайта.
- Маркетинговая вода вместо фактов. «Динамично развивающаяся компания с индивидуальным подходом» не даёт модели ничего. Цены, услуги, география, условия — вот что цитируемо.
- Файл не в корне.
/files/llms.txtили llms.txt на поддомене модель искать не будет — только стандартный адрес. - Неактуальные ссылки. Битые URL и старые цены хуже отсутствия файла: вы сами кормите нейросеть дезинформацией о себе.
- Сделал и забыл навсегда. Изменились услуги или тарифы — обновите файл. Разумный ритм — сверка раз в квартал.
- Спам ключевыми словами. Набивать файл запросами в надежде «оптимизировать» его — путь в никуда: модели ценят связный фактический текст, а не перечень фраз.
Чек-лист: llms.txt за час
Сверьтесь перед тем, как считать задачу закрытой:
- Выбраны 5–15 страниц, которые объясняют бизнес, — не весь сайт.
- Цитата написана по формуле: кто + что делаете + для кого/где + условия цифрами.
- Ссылки сгруппированы в 2–4 секции, у каждой ссылки есть пояснение после двоеточия.
- Второстепенное вынесено в
## Optional. - Файл в UTF-8, имя строчными —
llms.txt, лежит в корне. - Открывается по адресу
ваш-домен.ru/llms.txtс кодом 200, без редиректов. - AI-краулеры не заблокированы в robots.txt.
- Ответы нейросетей о компании зафиксированы «до» — будет с чем сравнивать.
- В календаре стоит ревизия файла раз в квартал.
llms.txt — маленькая, но показательная часть большой темы: как сайту быть видимым там, где пользователь уже не листает выдачу, а читает готовый ответ нейросети. Файлом эта работа начинается, но не заканчивается — все семь шагов, от доступа AI-краулерам до измерения результата, мы разобрали в большом гайде как попасть в ответы нейросетей. Всё это мы делаем в рамках GEO-продвижения в нейросетях — оно входит в SEO-продвижение (тарифы от 30 000 ₽/мес). Начать проще всего с бесплатного экспресс-аудита: посмотрим, как ваш сайт сейчас выглядит для поисковиков и нейросетей, и скажем честно, что стоит менять.