01 Простыми словами
llms.txt — простой текстовый файл, который владелец сайта кладёт в корневую папку рядом с robots.txt и sitemap.xml, только адресован он языковой модели вместо поискового робота. Внутри — заголовок сайта, короткое описание в одну-две строки и список ссылок на главные разделы с кратким пояснением, что на каждой странице.
Формат физически прост — обычный Markdown, без специальной разметки и вложенных данных, — завести такой файл способна и небольшая компания без отдельной команды разработки.
02 Как это работает
Файл живёт по прямому адресу /llms.txt в корне домена — так же, как /robots.txt, — и состоит из нескольких простых частей.
- Заголовок первого уровня с названием компании или продукта.
- Короткая цитата-абзац с сутью того, чем занимается сайт, — буквально пара предложений.
- Один или несколько разделов со списком ссылок: название страницы, сам URL и короткое пояснение в одну строку, о чём она.
- Иногда отдельно выделяют менее важные или вспомогательные страницы в конце файла — так модель сразу видит, что это материал на втором плане.
- Рядом иногда кладут
/llms-full.txt— тот же список страниц, но вместо короткого пояснения к ссылке в нём даётся полный текст каждой страницы одним файлом.
Ключевая идея формата — сжатость: вместо десятков тысяч строк sitemap.xml со всеми URL сайта llms.txt держит на виду лишь то, что действительно важно для понимания сайта, и объясняет это простыми словами вместо голого списка адресов. Это один из практических инструментов более широкой работы над GEO — видимостью сайта в ответах ИИ-поисковиков.
03 Где применяется
- Документация и SaaS-продукты. Ссылки на разделы документации, API-справочник и гайды по подключению с кратким описанием каждого.
- Медиа и блоги. Список ключевых рубрик и самых цитируемых статей вместо всего архива публикаций.
- Интернет-магазины. Категории товаров и страницы с политиками — доставка, возврат, гарантия.
- Консалтинг и агентства. Услуги, кейсы и страница контактов — то, что чаще всего спрашивают клиенты в диалоге с ИИ-ассистентом.
- Открытые проекты и библиотеки кода. Ссылки на README, документацию по API и примеры использования.
- Корпоративные сайты. Структура компании, направления бизнеса и контакты для B2B-запросов.
04 Что видно построчно
Небольшая консалтинговая компания публикует у себя в корне такой фрагмент:
# Марка Групп> Консалтинг по внедрению ИИ для среднего бизнеса в России.- [Услуги](/uslugi/): что делаем и как строим проект- [Кейсы](/keysy/): три реализованных проекта с результатами- [Контакты](/kontakty/): как связаться и заказать аудит
Первая строка — заголовок первого уровня с названием компании: модель сразу понимает, о ком вообще идёт речь. Вторая строка, начинающаяся с >, — короткая цитата-описание: одно предложение о сути бизнеса вместо долгого чтения главной страницы целиком.
Дальше идёт список ссылок. Каждая строка — это название страницы, сам адрес и краткое пояснение через двоеточие: модель получает сразу три вещи — что это за страница, где она лежит и зачем на неё стоит заходить, — вместо того чтобы переходить по ссылке вслепую и разбираться на месте.
Порядок строк в списке тоже несёт смысл: услуги и кейсы стоят раньше контактов — так модель понимает, что для ответа на вопрос про суть работы компании эти две страницы важнее, чем контактная форма.
05 Ограничения и ошибки
- Официального подтверждения от крупных поставщиков моделей, что они читают файл при обычном ответе пользователю, пока нет — поддержку заявляют в основном инструменты для разработчиков и агентские системы, а обычный чат-бот с равной вероятностью файл вообще пропускает.
- Файл — это подсказка для модели вместо прямой команды: модель ориентируется на описание страницы, но окончательное решение о том, что показать в ответе, остаётся за самой моделью.
- Устаревшее описание страницы в файле способно ввести модель в заблуждение сильнее, чем устаревшая обычная страница, — её саму хотя бы можно открыть и перепроверить визуально.
- Обязательного для всех сайтов стандарта здесь нет — это добровольная договорённость части индустрии, и для маленького сайта эффект от файла остаётся недоказанным.
- Для крупного сайта с миллионами страниц один компактный файл — это только один из элементов системной работы над видимостью сайта для моделей: над тем, как работает агентный поиск и как модели вообще извлекают и цитируют контент сайта через RAG-системы поверх сайта.
Файл llms.txt остаётся лишь одним из элементов работы над видимостью сайта для моделей — сами страницы, на которые он ссылается, всё равно нужно писать и структурировать для живого читателя, разбор такого подхода — в статье про нейросеть для SEO-текстов копирайтера. Завести такой файл в рамках системной работы над сайтом помогает внедрение ИИ в бизнес.