#llm
-
Сжатая 4-битная модель обошла свой полноточный оригинал
Multiverse Computing представила метод Quantization-Aware Healing: 4-битная модель после сжатия и квантования превзошла собственную 16-битную версию на 7 из 9 бенчмарков.
-
Может ли ИИ захватить сервер через уязвимости движка инференса
Эссе Бойда Кейна о том, как вредоносная языковая модель способна получить контроль над машиной, где загружены её же веса, эксплуатируя баги в движках вроде vLLM и SGLang.
-
Лучшая модель Anthropic буксует, пока дешёвые инструменты процветают
Издание FT приводит любопытные цифры о выручке Anthropic и OpenAI, а данные Ramp показывают, что самые дорогие модели Anthropic собирают меньше пользователей.
-
GLM-5.3 возглавила прикладной рейтинг LLM — впятеро дешевле конкурентов
Открытая модель GLM-5.3 первой прошла все пять категорий тестов Ed-o-meter на 100 %, обойдя closed-source модели OpenAI и Anthropic при кратно меньшей стоимости.
-
Qwen 3.8 27B справился с реверс-инжинирингом за полчаса
Автор XDA Developers поручил открытой языковой модели Qwen задачу по обратной разработке — и, по его словам, она выполнила её примерно за тридцать минут.
-
Почему локальная LLM кажется глупее, чем есть на самом деле
Автор с форума Level1Techs провёл серию экспериментов, показав, что одни и те же веса модели выдают разные токены в зависимости от железа и софта — и что за этим стоит вполне материальная математика.
-
Пользователи заподозрили Anthropic в тайном урезании «усилий» Claude Code
Автор под ником argofowl утверждает, что часть сессий Claude Code незаметно перевели в эксперимент, где режим «high» работает как прежний «low». Компания это официально не комментировала.
-
Мейнтейнеры сетевой подсистемы Linux 7.3: «полностью завалены» ИИ-патчами
В окно слияния Linux 7.3 приняты сетевые изменения, но сопровождающие признаются, что тонут в потоке правок от ИИ-агентов — и отвечать на него собираются тем же ИИ.
-
Шифрование обходит защиту Grok: чат-бот сливает данные пользователей
Исследователи Adversa показали, что достаточно зашифровать вредоносную инструкцию, чтобы обойти защитные фильтры Grok и заставить его выкрасть историю переписки пользователя. xAI сообщили о проблеме ещё в июне, но на момент публикации уязвимость оставалась рабочей.
-
Debian голосует по восьми вариантам политики использования LLM
Проект Debian проводит голосование о допустимости использования больших языковых моделей при работе над дистрибутивом. Разработчикам предложено выбрать один из восьми вариантов — от полного запрета до явного одобрения.
-
Amazon уничтожает редкие книги ради обучения ИИ
Компания, начинавшая с онлайн-торговли книгами, теперь скупает редкие издания, срезает переплёты и сканирует страницы — чтобы получить свежие данные для языковых моделей.
-
Модель, знающая мир не дальше пятого класса
Исследователи обучили языковые модели на корпусе, ограниченном программой начальной школы, чтобы отделить приобретение знаний от их извлечения. Вывод: фильтр обучающих данных задаёт потолок способностей.
-
ИИ не переигрывает математиков, а их перепоминает
Давиде Пиффер предлагает менее эффектное объяснение успехов ИИ в математике: дело не в превосходящем разуме, а в почти безграничной символьной рабочей памяти.
-
Латентные рассуждения ИИ оказались понятнее, чем считалось
Исследователи из COLM 2026 показали, что модели со скрытыми рассуждениями либо почти не пользуются ими, либо прячут внутри вполне читаемые математические шаги.
-
Qwen3.8-27B: 32 демо, собранные за один присест
К релизу модели Qwen3.8-27B опубликована галерея из 32 самодостаточных демо-страниц, сгенерированных за один сеанс. Отдельные работы показаны в разной точности вычислений.
-
Debian голосует за судьбу LLM в проекте: от полного запрета до климатических аргументов
Разработчики Debian начали голосование по общей резолюции о том, допустимы ли в проекте вклады, созданные с помощью больших языковых моделей. На выбор предложено девять вариантов.
-
DeepSeek V4 Pro 0813: релиз без анонса и с загадочными пеликанами
Китайская лаборатория DeepSeek выпустила новую модель V4 Pro — пока только через API и без официальной страницы анонса. Симон Уиллисон обратил внимание на несколько курьёзных деталей запуска.
-
Как воровали скрытые рассуждения проприетарных LLM
Исследователи показали, что зашифрованные цепочки рассуждений от Anthropic, OpenAI и Google можно было восстановить в открытом виде, скормив их самой слабой модели того же семейства. Уязвимость уже закрыта.
-
Модель Anthropic продвинулась в решении гипотезы Римана
Неопубликованная модель Anthropic не доказала гипотезу Римана, но заметно расширила границу, до которой её справедливость подтверждена. Работу проверили штатные математики компании и формализовали в Lean.
-
Mistral запатентовала вызов инструментов через исполняемый код
Патентное ведомство США выдало Mistral AI патент на метод, при котором языковая модель формирует и исполняет код для вызова внешних инструментов. Заявка описывает приём, который многие считают отраслевой практикой.
- Дальше