llms.txt: 97% от тези файлове не получиха нито една заявка за цял месец
Някъде през последната година и половина добавянето на файл llms.txt се превърна в задача, която стои във всеки чеклист за AI видимост, без някой да пита какво точно прави. Евтино е, отнема половин ден, прилича на работа. Затова доста сайтове имат такъв файл.
През юни 2026 г. Ahrefs публикува първото голямо измерване дали изобщо някой иска този файл, върху собствените си данни за обхождане и трафик. Отговорът се оказа достатъчно неудобен, за да заслужава внимателен прочит, включително частите, които обикновено отпадат в преразказа.
Какво точно беше измерено
Изследването на Луиз Лайнън и Сибейджия Гуан обхваща 137 210 домейна, получили трафик през май 2026 г. От тях 38 360 домейна, около 28%, публикуват валиден llms.txt. Основният извод се отнася до втората група, не до първата: от приблизително 38 хиляди домейна, които са публикували файл, 97% не са получили нито една заявка за него през целия месец. Каквато и да е заявка са видели около 1100 домейна.
Тази разлика има значение и точно тя се чупи постоянно при преразказа. Твърдението не е „97% от 137 хиляди сайта“, а „97% от сайтовете, които изобщо са си направили труда да го създадат“. Ако цитирате числото на среща, цитирайте го така: сгрешената версия завишава извадката около три пъти и половина и рано или късно някой ще провери.
Авторите сами изброяват три ограничения и трите вървят заедно с числото:
- Панелът не е мрежата. Ahrefs пише, че клиентите му са технически по-подготвени от средния сайт, затова 28% разпространение трябва да се приема като горна граница. В реалната мрежа делът е по-нисък.
- Съответствието със спецификацията не е проверявано. Изследването отчита наличието на файл, не неговата коректност.
- Изтеглено не значи прочетено. Формулировката е на самите автори: много ботове може да са взели файла, без изобщо да са използвали съдържанието му. Тоест дори онези 3% са оптимистичен таван на реалната употреба.
Добавете и още едно ограничение, което следва от устройството на изследването: това е един месец от клиентската база на един доставчик. Това е най-доброто налично доказателство и не е преброяване.
Кой всъщност иска този файл
По-интересната половина от изследването е разпределението на заявителите. Почти всички заявки, 96%, идват от ботове. Картината изглежда така.
| Категория | Дял от заявките | Какво е това в действителност |
|---|---|---|
| SEO одит инструменти | 21,7% | Вашият собствен и конкурентните обхождащи ботове проверяват дали файлът съществува |
| Неразпознати | 14,9% | Без използваем потребителски агент |
| Общи обхождащи ботове | 13,1% | Безразборно изтегляне на всичко на познат адрес |
| Профилиращи технологии | 11,6% | Инструменти, които описват на какво работи сайтът |
| AI агенти | 10,5% | Асистенти за код, които дърпат документация в работна сесия |
| GEO и AEO инструменти | 5,8% | Индустрията на AI видимостта одитира сама себе си |
| Обучаващи ботове | 5,3% | Събиране на корпус |
| AI асистенти | 2,5% | Живи сесии с асистент |
| Ботове за извличане | 1,1% | Точно системите, които сглобяват отговора с цитати |
Последният ред заслужава втори прочит. Категорията ботове, от която зависи дали марката ви ще се появи вътре в генериран отговор, е около един процент от заявките към и без това нищожен обем. Сред именуваните агенти начело са GPTBot с 4,51% и Claude-Code, който е асистент за програмиране, а не търсещ продукт.
Честният извод не е „llms.txt никой не го чете“. Той е по-остър и по-полезен: файлът се чете от неща, различни от онези, заради които обикновено се създава. Четат го асистентите за код. Четат го одитните инструменти. Слоят за извличане зад AI отговорите почти никога.
Какво пише Google, дословно
Google най-после записа позицията си и място за тълкуване не остана. В наръчника за оптимизация към генеративните функции на търсенето има раздел за разпространени митове, в който пише: не е нужно да създавате нови машинночетими файлове, AI текстови файлове, маркиране или Markdown, за да се появите в Google Search, защото самото търсене на Google не ги използва. Следва изречението, което затваря спора: поддържането на такива файлове нито ще навреди, нито ще помогне на видимостта и класирането ви в Google Search, защото Google Search ги игнорира.
С датите тук трябва да сме точни, защото те се движат в изкривен вид. Абзацът за llms.txt е добавен към наръчника на 15 юни 2026 г. и това се проверява в собствения дневник на промените на Google Search Central, където има датиран запис със заглавие за изясняване на насоките относно файловете llms.txt. Самият наръчник излиза по-рано същата година и последно е обновяван през юли; на страницата се вижда само датата на последното обновяване, затова дата на публикуване няма да твърдим.
Неофициално Google казва същото доста по-рано. През април 2025 г. Джон Мюлер сравнява llms.txt с мета тага keywords, с довода, че това е твърдение на собственика за собствения му сайт, което потребителят така или иначе трябва да провери срещу самия сайт, и оттогава това сравнение върви заедно с формата. Обърнете внимание на датата: това е реплика от 2025 г., четиринайсет месеца преди да съществуват данните за обхождане, и се цитира като позиция, не като доказателство.
За какво е замислен форматът
По-голямата част от объркването идва от подмяна на категорията. Прочетете първоначалното предложение и мотивът е формулиран направо: контекстните прозорци са твърде малки, за да поемат цял сайт, а HTML страниците са пълни с навигация, скриптове и обвивка, които изяждат тези токени. Файлът е подбран указател, който агент може да зареди в момента на работа.
Това е задача на инструментариума за разработка, а не на търсенето. И данните за заявките показват точно това: файлът се тегли от асистенти за код и потребители на документация, защото за тях е правен. Затова и най-видимите му ползватели са сайтове с документация. Anthropic, OpenAI, Stripe, Vercel и Cloudflare публикуват llms.txt за разработческите си раздели. Струва си да се отбележи, че част от тях работят на една и съща платформа за документация, която генерира файла автоматично, тоест част от „разпространението“ е поведение по подразбиране, а не съзнателно решение. Cloudflare отиде по-далеч и обяви автоматично генериран llms.txt за клиентските домейни през септември 2025 г., но това тръгна като закрита бета и потвърждение за общо пускане не намерихме.
Малка подробност, която казва много: самият Ahrefs, който проведе изследването, не поддържа llms.txt.
Тези файлове се вкисват. Нашият също
Режимът на отказ, който никой не планира, е остаряването. Написан на ръка указател на сайт се разминава със сайта за месеци и нищо не сигнализира. Техническата писателка Дачери Кери направи малък инструмент, който сверява записите в llms.txt със картата на сайта, и го пусна върху десет сайта с документация. Четири покриват документацията си напълно. Три се провалят. Файлът на Stripe изброява 468 от 3037 страници с документация, тоест около 15% покритие; при Supabase излиза около 22%. Десет сайта са сонда, а не изследване, но посоката е показателна.
Тъй като тази статия е за честност с данните, ето и нашата. Към момента на публикуване dextora.agency отдава llms.txt в корена на домейна. Той уверено описва агенция, която прави брандинг, перформанс реклама, криейтиви за Meta Ads и Google Ads и оптимизация на конверсията. Нищо от това не правим. Същевременно в него липсват две услуги, които наистина предлагаме, телеграм ботове и мигриране на сайтове, и той не сочи към нито една статия в този сайт.
Никой не го е саботирал. Генериран е веднъж, от описание на бизнеса, което вече тогава е било приблизително, после сайтът се е променял, а файлът не. Това е обичайният жизнен цикъл на такъв формат и е добра илюстрация защо самопровъзгласен указател е по-слабо доказателство от самия сайт. Машина, която чете нашия llms.txt, научава за нас неверни неща. Машина, която чете страниците ни с услуги, не.
Къде стои в таблицата на доказателствата
Прегледът на факторите за цитиране в AI търсенето, публикуван от Сайръс Шепард през май 2026 г., оценява 23 фактора по това колко последователно ги подкрепят наличните изследвания. llms.txt получава 2 и последно място, а скалата в материала върви от 9,5 до 2, тоест това е наблюдаваното дъно, а не оценка от десет. Бележката му е по-внимателна от препубликациите: той не е сигурен, че разгледаните изследвания изобщо са проверявали llms.txt, и не намира достоверно свидетелство файлът да влияе на цитирането по какъвто и да е начин.
Целият оценен списък, с цената на поправката и отговорника за всеки фактор, разгледахме в отделен материал за всичките 23 фактора.
Това е празнина в доказателствата, а не опровержение. Напълно възможно е llms.txt да прави нещо, което никой не е измервал. Просто не е основание за спринт.
Да го пазите ли
| Вашата ситуация | Решение | Защо |
|---|---|---|
| Публикувате документация за разработчици или API | Да, и го генерирайте при билда | Това е истинският сценарий, асистентите за код наистина го теглят |
| Имате бизнес сайт и вече имате файл | Поправете го или го изтрийте | Неточен файл е по-лош от липсващ, защото лъже уверено |
| Имате бизнес сайт и нямате файл | Не е приоритет | Системите, които ви интересуват, почти не го искат |
| Продават ви llms.txt като услуга за AI видимост | Попитайте какъв е планът за измерване | Няма публикуван ефект, който да бъде измерен |
| Можете да го генерирате и валидирате автоматично | Нека остане, не струва нищо | Автоматизацията маха остаряването, а то е единственият реален риск |
Какво да свършите със същия половин ден
Работата с доказателства зад гърба си е по-скучна и по-стара. Уверете се, че страницата изобщо може да бъде прочетена без JavaScript: това е честа и реална повреда, а проверката отнема десет минути и нашият разбор с команди curl я минава стъпка по стъпка. Опишете какво представлява страницата чрез структурирани данни за реални обекти, които в същата таблица на доказателствата стоят чувствително по-високо от llms.txt. И пишете страници така, че отговорът на въпрос да се побира в самостоятелен абзац, каквато е механиката в материала ни за сайт за AI търсене.
Нищо ново няма в това и точно затова е неудобно. Привлекателността на llms.txt беше, че изглеждаше като заобиколен път около скучната работа.
Накратко
От приблизително 38 хиляди сайта, публикували llms.txt, 97% не получиха нито една заявка за него през май 2026 г. Заявките, които все пак идват, са предимно от одитни инструменти и асистенти за код; на ботовете, които сглобяват AI отговорите, се падат около един процент. Google казва пряко, че игнорира файла и нито го възнаграждава, нито го наказва. Форматът е замислен, за да събере документация в контекстен прозорец, и с това се справя. Като тактика за AI видимост няма публикувани доказателства зад себе си, а вкиснал файл активно дезинформира. Ако го пазите, генерирайте го. Ако няма как да се генерира, по-добрият указател остава самият сайт, и точно натам отиват усилията, когато разработваме корпоративен сайт, който трябва да се чете и от хора, и от машини.










