#llm
-
Скрытые подводные камни OpenRouter: один эндпоинт — разное поведение
Единый API OpenRouter автоматически выбирает провайдера, но это оборачивается непредсказуемым поведением одной и той же модели. Мохамед Мустафа объясняет, как вернуть контроль.
-
Cognition представила SWE-2 — дешёвую модель для кодинга на уровне лидеров
Новая модель компании Cognition набирает 50% на бенчмарке FrontierCode 1.1 — почти как Fable 5.1, но при цене на 64% ниже. Ключ к результату — обучение с учётом баланса «стоимость–качество».
-
DeepSeek готовит V4.1 Flash: дешевле и мощнее прежней Pro-модели
Китайская лаборатория DeepSeek анонсировала на 10 сентября 2026 года выход V4.1 Flash, которая, по её словам, превосходит модель V4 Pro по всем ключевым метрикам при более низкой цене.
-
Языковые модели вырабатывают новые социальные предубеждения в ходе адаптивного исследования
Новая работа, опубликованная на OpenReview, утверждает, что большие языковые модели способны формировать собственные социальные предубеждения — не унаследованные из данных, а возникающие в процессе адаптивного поведения.
-
ИИ написал «уродливый» код, но нашёл узкие места и ускорил сборку ядра Linux
Инженер ARM Лоренцо Стоукс с помощью языковой модели выявил однопоточные узкие места в сборке ядра Linux — и добился ускорения инкрементальных сборок до 70%.
-
Как выкрасть скрытые «размышления» проприетарных языковых моделей
Исследователи показали, что зашифрованные блоки рассуждений LLM взаимозаменяемы внутри экосистемы одного провайдера — и это открывает сразу несколько путей для атак.
-
OpenAI устроила день рекурсивного самосовершенствования
Саймон Уиллисон разбирает публикацию OpenAI о том, как её собственные исследователи используют кодовых агентов, и замечает всплеск расходов на ИИ, совпавший с ранним доступом к GPT-6 Astra.
-
ИИ как когнитивный вирус: модель эпидемии зависимости от LLM
Международная группа исследователей предлагает описывать распространение больших языковых моделей по аналогии с вирусной инфекцией — с точками невозврата и риском необратимой потери когнитивной самостоятельности.
-
Пеликаны на велосипедах: как GPT-6 Astra выглядит на фоне GPT-5.6
Саймон Уиллисон получил доступ к GPT-6 Astra и по традиции проверил модель своим фирменным тестом — попросил нарисовать SVG-пеликана на велосипеде. Сравнительная таблица оказалась не только забавной, но и неожиданно полезной.
-
Google DeepMind выпустила Gemini 3.8 Flash и версию для кибербезопасности
DeepMind представила Gemini 3.8 Flash — рабочую модель для агентных задач и программирования — и отдельный вариант 3.8 Flash Cyber для защитников, специализирующийся на поиске и устранении уязвимостей.
-
«Несущие» слова в лексиконе Claude
Заметка Луи Абраама обращает внимание на то, что в языке модели Claude есть слова, несущие непропорционально большую смысловую нагрузку.
-
OpenAI готовит Astra — модель, умеющую взламывать системы без участия человека
OpenAI анонсировала Astra — первую свою языковую модель, преодолевшую «критический порог кибербезопасности». Компания обещает ограничить доступ к её наиболее опасным возможностям.
-
Anthropic представила Claude Fable 5.1: дешевле и без лишних ограничений
Компания выпустила модели Fable 5.1 и Mythos 5.1, обещая более низкие цены на агентские задачи, точечные предохранители и хранение данных на серверах клиента.
-
Инъекция промпта, спрятанная в судебном документе
Брюс Шнайер обратил внимание на любопытный случай: в текст судебного документа были встроены скрытые инструкции, адресованные не судье, а искусственному интеллекту.
-
Tencent открыла модель Hunyuan Hy4 preview с 770 млрд параметров
Tencent представила и выложила в открытый доступ новую большую языковую модель Hy4 preview с окном контекста свыше 1 млн токенов, ориентированную на рабочие задачи в программировании, офисе и науке.
-
Канонический базис: как повернуть LLM, чтобы заглянуть ей внутрь
Исследователь предложил обратимое преобразование координат трансформера, которое не меняет его поведения, но делает каждую скрытую ось измеримой и управляемой по отдельности.
-
Debian разрешил «ответственное использование» генеративного ИИ
Разработчики Debian завершили голосование по общей резолюции о политике в отношении ИИ и выбрали вариант, допускающий применение генеративных инструментов при соблюдении обычных требований к качеству.
-
cats.txt: как файл про офисных котов разоблачил веру в llms.txt
SEO-специалист Марк Уильямс-Кук придумал пародийный стандарт для описания редакционных котов — и тот прошёл ровно те же «проверки», которыми продают всерьёз воспринимаемый llms.txt.
-
SourceHut запрещает код и контент, созданные с помощью LLM
Хостинг проектов SourceHut вносит в пользовательское соглашение запрет на «оригинальный» контент, написанный с помощью больших языковых моделей. Новые правила вступают в силу 10 сентября 2026 года.
-
Qwen готовит модель Flash-Next: 125 млрд параметров при 6 млрд активных
На платформе ModelScope замечена страница нового языкового моделя семейства Qwen — Flash-Next, релиз которого, судя по названию, ожидается совсем скоро.
- Дальше