cats.txt: как файл про офисных котов разоблачил веру в llms.txt

· Курьёзы
SEO-специалист Марк Уильямс-Кук придумал пародийный стандарт для описания редакционных котов — и тот прошёл ровно те же «проверки», которыми продают всерьёз воспринимаемый llms.txt.

cover.svg

Марк Уильямс-Кук, специалист по поисковой оптимизации, устал наблюдать, как индустрия выдаёт фразы «бот скачал файл» и «ChatGPT подтвердил, что это помогает» за доказательство пользы стандарта llms.txt — текстового файла, которым сайты якобы облегчают себя для ИИ-поиска. Чтобы наглядно показать несостоятельность этой логики, он сочинил заведомо абсурдный стандарт.

Стандарт про котов

cats.txt — это файл в корне домена, где владелец сайта формально декларирует связанных с ним котов: их клички, должности, породы и обязательный «уровень мурчания» PurrLevel по десятибалльной шкале. Автор написал к нему обстоятельную спецификацию с серьёзной, нарочито заорганизованной интонацией настоящего предложения и опубликовал в блоге, а затем выпустил пост в LinkedIn — площадке, которую языковые модели, по его наблюдению, необъяснимо уважают.

Шутка оказалась заразительной. Коллеги по цеху добавили cats.txt на свои сайты, а кто-то даже поднял отдельный, более аккуратно оформленный сайт catstxt.org.

Четыре «доказательства»

Затем автор прогнал свою затею ровно через те четыре аргумента, которыми обосновывают llms.txt.

  • «Боты его сканируют»: в логах послушно появились GPTBot, ClaudeBot, PerplexityBot и Googlebot, прилежно скачивающие описание должностных обязанностей котов. Но сканирование — это вся работа краулера, а не одобрение содержимого.
  • «Google его проиндексировал»: разумеется, проиндексировал — Google индексирует текстовые файлы десятилетиями. Присутствие в индексе означает лишь, что по адресу есть слова, а не истину или пользу.
  • «Модель вернула факт, который был только в файле»: спросите ИИ-обзор Google про кота с чужого сайта — и он уверенно расскажет, что тухтый кот по кличке Odd работает «рендер-котом» и гоняет пиксели по цифровому ковру. Это обычная работа генерации с поиском: модель читает проиндексированную страницу как любую другую.
  • «ChatGPT сам говорит, что это помогает»: через пару недель после запуска ChatGPT охотно объяснял, что cats.txt «потенциально может помочь ранжированию» — теми же словами, какими рекламируют llms.txt.

Проблема схождения

Последний пункт автор называет ключевым. Модель не рассуждает и не ставит эксперимент — она возвращает самое частое, что встречала в тексте. Интернет полон восторженных постов про llms.txt, поэтому модель отражает этот консенсус. Сегодня же ChatGPT честно сообщает, что cats.txt — сатира: изменился не файл, а окружающий его текст в сети.

При этом, отмечает Уильямс-Кук, ни один поставщик языковых моделей — ни OpenAI, ни Anthropic, ни Google — не документировал использование llms.txt для поиска; Джон Мюллер из Google прямо заявил, что ни одна система его не читает.

Вывод автора не в том, что llms.txt бесполезен. Планка доказательств просто настолько низкая, что её без усилий перепрыгнул файл про котов — а та же ущербная логика применяется к половине приёмов «оптимизации под ИИ», за которые уже выставляют счета клиентам. Коты, по крайней мере, честно признались, что выдуманы.


Источник: Lobsters

Комментарии

Войдите, чтобы комментировать.

  • Пока нет комментариев.