#llm
-
Stateless MCP: обновление протокола, которое вернуло интерес Саймона Уиллисона
Спецификация Model Context Protocol от 28 июля 2026 года отказалась от серверных сессий. Саймон Уиллисон объясняет, почему это упрощает разработку и делает агентов безопаснее — и показывает три собственных инструмента.
-
Opus 5 стал устойчивее к prompt injection
Новая модель Anthropic показала лучший результат на бенчмарке IPI, обойдя как предыдущие версии Claude, так и всех конкурентов. Но полностью защититься от инъекций в промпт по-прежнему невозможно.
-
ИИ-мошенники обыгрывают людей в искусстве втираться в доверие
Исследователи стравили чат-бота на базе Claude с профессиональным мошенником и выяснили: ИИ выстраивает «эксплуатируемое доверие» эффективнее человека.
-
Baidu выпустила vLLM-Kunlun — плагин для запуска LLM на ускорителях Kunlun XPU
Baidu открыла исходный код vLLM-Kunlun — подключаемого модуля, позволяющего запускать популярный движок вывода vLLM на собственных ускорителях Kunlun XPU без правки исходников vLLM.
-
DeepSeek выпустила V4-Flash в публичной бете с упором на агентов
Обновлённая модель deepseek-v4-flash по агентным тестам обгоняет превью версии Pro и получила поддержку формата Responses API и адаптацию под Codex.
-
68% рецензируемых статей оказались ИИ-шлаком: обзор из «окопов»
Двое рецензентов NeurIPS, WACV и воркшопа ECCV разобрали 22 присланные статьи и обнаружили массовые выдуманные ссылки и подставных авторов. Две работы с фальшивыми именами всё равно приняли на устные доклады.
-
Документ-червь: как атака самораспространяется через Copilot в Word
Исследователь показал, что скрытые в документе инструкции способны заставить Copilot для Word незаметно менять данные в отчётах и копировать вредоносный код в новые файлы, превращая их в носителей заражения. Microsoft за 144 дня так и не смогла закрыть уязвимость.
-
GCC отклонит любой значимый вклад, созданный с помощью ИИ — кроме тестов
Руководящий комитет GCC утвердил политику, запрещающую принимать в компилятор «юридически значимый» код, сгенерированный языковыми моделями. Исключение сделано только для тестовых сценариев.
-
ИИ учится взламывать шифры: бенчмарк CryptanalysisBench находит новые атаки
Новый тест оценивает способность больших языковых моделей вести математический криптоанализ. Часть моделей уже находит уязвимости, ранее не описанные в литературе.
-
PyTorch как эталонный язык: разделение спецификации и реализации
Эдвард Ян из команды PyTorch предлагает смотреть на фреймворк одновременно как на эталонную спецификацию и как на язык реализации, а расхождения между ними проверять отдельным верификатором.
-
Moonshot AI готовит к выпуску Kimi K3 — первую открытую модель класса 3T
На Hugging Face появился анонс Kimi K3 от Moonshot AI — по заявлению разработчиков, первой открытой модели уровня 3 триллионов параметров. Публикация весов ожидается 27 июля 2026 года.
-
Серый рынок токенов: как перепродают доступ к LLM со скидкой
Расследование Мэтта Ленхарда описывает экосистему, выросшую вокруг перепродажи токенов языковых моделей за счёт объединённых пулов API-ключей — в основном в Китае.
-
Anthropic вырезала 80% системного промпта Claude Code — и ничего не сломалось
Инженер Anthropic Тарик Шихипар рассказал, как под новое поколение моделей Claude 5 компания радикально упростила контекст: меньше жёстких правил, больше доверия к суждению модели.
-
Инженерный менеджмент после того, как код подешевел
Директор по инженерии рассуждает о том, какие «старые правила» управления командами рухнули вместе со стоимостью написания кода, а какие, наоборот, стали важнее прежнего.
-
Канадский депутат зачитал вслух подсказку нейросети во время речи в парламенте
Член заксобрания Нью-Брансуика не заметил, что читает не только текст выступления, но и служебную реплику языковой модели, предлагавшей «более естественную формулировку».
-
Debian голосует за судьбу LLM в проекте
Разработчики Debian начали обсуждение общего голосования, которое определит, допустимо ли использование больших языковых моделей при работе над проектом.
-
Codeberg против ИИ: Армин Ронахер о рисках нового правила
Codeberg запретил хостить проекты, преимущественно написанные генеративным ИИ. Разработчик Армин Ронахер объясняет, почему эта попытка защитить открытый код может обернуться против самого сообщества.
-
Codeberg объявил войну «vibe-кодингу»: две резолюции против LLM
Участники Codeberg e. V. проголосовали за отказ обучать ИИ на данных пользователей и за запрет проектов, сгенерированных большими языковыми моделями. Платформа считает LLM угрозой для экосистемы свободного ПО.
-
Google представила Gemini 3.6 Flash и модель для кибербезопасности, а Gemini 4 уже в обучении
Компания выпустила три новые модели, включая первую версию Gemini для задач кибербезопасности, но обещанной Gemini 3.5 Pro среди них снова нет.
-
Открытые модели пугают OpenAI. Стоит ли их бояться США?
Успех китайской open-weight модели Kimi K3 разжёг спор о запрете таких систем в США. За разговорами о безопасности скрывается куда более прозаичная проблема: фронтир-лабораториям всё труднее превращать ИИ в бизнес.
-
Языковая модель Fable «опровергла» гипотезу о якобиане — но математики осторожничают
Математик под ником levent объявил в соцсети X, что знаменитая гипотеза о якобиане неверна: контрпример помогла построить ИИ-модель Fable. Проверка результата пока продолжается.
-
Hugging Face взломал автономный ИИ-агент: атаку расследовали китайской моделью
Крупнейший репозиторий ИИ-моделей сообщил о вторжении в свою продакшн-инфраструктуру, которое провёл автономный агентский фреймворк. Западные модели отказались помогать с разбором инцидента — пришлось обратиться к открытой китайской GLM 5.2.
-
Moonshot AI приостановила приём новых подписчиков из-за спроса на Kimi K3
Китайская компания Moonshot AI временно закрыла регистрацию новых подписчиков: спрос на модель Kimi K3 упёрся в пределы вычислительных мощностей.
-
Anthropic сохранит доступ к Claude Fable 5 в подписках Max и Team
Anthropic отказалась от планов вывести модель Claude Fable 5 из подписочных тарифов и оставит её доступной для пользователей Max и Team Premium. Решение связано с конкуренцией со стороны GPT-5.6 Sol и Kimi 3.
-
Исследователи применили LLM для поиска и эксплуатации уязвимостей ядра FreeBSD
Компания Praetorian опубликовала вторую часть исследования о том, как языковые модели помогли обнаружить и проэксплуатировать баги в ядре FreeBSD. Проект получил название FreeBSoD.
-
Mesh LLM: распределённые вычисления для ИИ на основе iroh
Разработчики представили Mesh LLM — проект, использующий сетевой протокол iroh для распределённого выполнения задач, связанных с языковыми моделями. Публикация вызвала заметный интерес на Hacker News.
-
OpenAI заявила о доказательстве гипотезы о двойном покрытии циклами с помощью GPT-5.6 Sol Ultra
OpenAI опубликовала PDF-документ, в котором модель GPT-5.6 Sol Ultra представлена как автор доказательства гипотезы о двойном покрытии циклами. Новость вызвала оживлённую дискуссию на Hacker News.
-
Как язык ИИ может изменить человеческую речь
Брюс Шнайер предупреждает: большие языковые модели обучены лишь на письменных текстах и сценарной речи, а массовое использование ИИ рискует изменить то, как говорят сами люди.
-
Tencent выпустила открытую MoE-модель Hy3 на 295 млрд параметров
Компания Tencent представила языковую модель Hy3 под лицензией Apache 2.0, которая, по заявлению разработчиков, превосходит модели своего класса и приближается к флагманским open-source решениям с существенно большим числом параметров.
-
Автор блога Lobsters: новые модели Anthropic хуже справляются с нестандартными инструментами
Разработчик обнаружил регрессию в поведении новейших моделей Anthropic при вызове функций (tool calling). Проблема проявляется, когда описание инструмента незначительно отличается от формата закрытого харнесса Claude Code.
-
JadePuffer: первая ransomware-атака, полностью проведённая ИИ-агентом
Исследователи описали первый задокументированный случай, когда всю ransomware-атаку — от начала до конца — провёл автономный агент на базе большой языковой модели. Операция получила название JadePuffer.
-
GLM 5.2 на AMD MI355X: вдвое дешевле Blackwell при 2626 ток/с на узел
Компания Wafer сообщила о запуске модели GLM 5.2 на ускорителях AMD Instinct MI355X, показавшем производительность 2626 токенов в секунду на узел при более чем двукратном снижении стоимости по сравнению с решениями на базе Nvidia Blackwell. Новость собрала заметный отклик на Hacker News.
-
Current AI представила карту пробелов в открытом ИИ
Некоммерческая организация Current AI опубликовала Gap Map — попытку систематизировать текущее состояние экосистемы открытого искусственного интеллекта. Данные проекта распространяются под лицензией MIT.
-
Разработчик сократил расходы на Fable на 60%, превращая код в изображения
На GitHub опубликован проект pxpipe, который преобразует программный код в изображения и передаёт их модели для распознавания — такой подход позволил снизить стоимость обращений к Fable на 60%.