Сгенерируйте llms.txt вашего сайта.
llms.txt это индекс в Markdown в корне домена: он сообщает модели, что представляет собой сайт и какие страницы стоит читать. Инструмент читает ваш sitemap и собирает файл, готовый к публикации.
- Модуль
- AEO/GEO
- Ввод
- Домен
- Где работает
- Сервер Rovemark
- Стоимость
- Бесплатно, без регистрации
Индекс, написанный для читателя, который не открывает браузер
Когда ассистенту нужно понять ваш сайт, он начинает с исходного HTML: меню, баннера, подвала, скриптов. Контент там, вперемешку со всем остальным. llms.txt это альтернатива: файл Markdown в корневом каталоге с названием сайта, одной строкой о том, что это за сайт, и списком важных страниц, сгруппированных по разделам.
Предложение появилось в сентябре 2024 года, его выдвинул Jeremy Howard, и его используют прежде всего сайты документации и продуктов. Это не официальный стандарт, и ни одна модель не обязана его читать. Публикация стоит одного статического файла, а выгода в том, что решение о важном больше не остаётся на усмотрение парсера.
- 01
Инструмент находит вашу карту сайта
Она читает robots.txt в поисках директивы Sitemap и, если не находит её, пробует стандартные пути. Индекс sitemap обрабатывается вплоть до вложенных файлов.
- 02
Страницы группируются по разделам
Первый сегмент URL становится разделом, это иерархия, которую уже объявил сам сайт. Сначала идут более короткие пути, а каждый раздел получает квоту, чтобы ни один не занял весь файл.
- 03
Вы копируете файл и публикуете его в корне
Файл создаётся готовым в Markdown. Опубликуйте его как /llms.txt в корне домена, так же, как robots.txt.
- 01
Что такое llms.txt?
- Файл Markdown в /llms.txt, который описывает сайт для языковых моделей: заголовок, строка с кратким описанием и ссылки на основные страницы, сгруппированные по разделам. Идея в том, чтобы дать готовую карту, а не позволять модели выводить её из HTML.
- 02
Это то же самое, что sitemap.xml?
- Нет. sitemap перечисляет URLs для поискового робота, машина говорит с машиной, без контекста. llms.txt написан для чтения: в нём есть название, описание и группировка, и он помещается в окно контекста. Одно не заменяет другое.
- 03
Модели правда читают этот файл?
- Гарантии нет, и это честно: ни один крупный поставщик не подтвердил использование llms.txt в production. Есть растущее принятие со стороны сайтов и почти нулевая стоимость публикации. Это недорогая ставка, не уверенность.
- 04
Где публиковать файл?
- В корне домена, как /llms.txt, с типом text/plain или text/markdown. Если ваш сайт статический, достаточно разместить его в публичной папке. Некоторые проекты также публикуют /llms-full.txt с полным содержимым, а не только ссылками.
- 05
На сайте несколько языков. Файл не станет огромным?
- Инструмент распределяет квоту между разделами, поэтому в каждом языке будет примерно одинаковое число страниц вместо того, чтобы один из них занял весь файл. Если вы предпочитаете отдельный файл для каждого языка, сгенерируйте его и вырежьте нужный раздел.
- 06
Нужно ли обновлять его при публикации новой страницы?
- Да, так же, как sitemap. Файл, это снимок сайта на момент его создания. Если вы часто публикуете материалы, стоит генерировать его при build, а не вручную.
Файл опубликован. А ответ изменился?
llms.txt улучшает то, что читает модель. Измерять, что она отвечает о вашем бренде, в нескольких ассистентах и с течением времени, это другая работа, и её выполняет платформа.
