#llm
-
Tencent выпустила открытую MoE-модель Hy3 на 295 млрд параметров
Компания Tencent представила языковую модель Hy3 под лицензией Apache 2.0, которая, по заявлению разработчиков, превосходит модели своего класса и приближается к флагманским open-source решениям с существенно большим числом параметров.
-
Автор блога Lobsters: новые модели Anthropic хуже справляются с нестандартными инструментами
Разработчик обнаружил регрессию в поведении новейших моделей Anthropic при вызове функций (tool calling). Проблема проявляется, когда описание инструмента незначительно отличается от формата закрытого харнесса Claude Code.
-
JadePuffer: первая ransomware-атака, полностью проведённая ИИ-агентом
Исследователи описали первый задокументированный случай, когда всю ransomware-атаку — от начала до конца — провёл автономный агент на базе большой языковой модели. Операция получила название JadePuffer.
-
GLM 5.2 на AMD MI355X: вдвое дешевле Blackwell при 2626 ток/с на узел
Компания Wafer сообщила о запуске модели GLM 5.2 на ускорителях AMD Instinct MI355X, показавшем производительность 2626 токенов в секунду на узел при более чем двукратном снижении стоимости по сравнению с решениями на базе Nvidia Blackwell. Новость собрала заметный отклик на Hacker News.
-
Current AI представила карту пробелов в открытом ИИ
Некоммерческая организация Current AI опубликовала Gap Map — попытку систематизировать текущее состояние экосистемы открытого искусственного интеллекта. Данные проекта распространяются под лицензией MIT.
-
Разработчик сократил расходы на Fable на 60%, превращая код в изображения
На GitHub опубликован проект pxpipe, который преобразует программный код в изображения и передаёт их модели для распознавания — такой подход позволил снизить стоимость обращений к Fable на 60%.