#ии
-
Исследователь Anthropic уволился, предупредив: самоулучшающийся ИИ «может убить всех»
Джейкоб Коксон покинул Anthropic с публичным предупреждением: гонка за сверхинтеллектом ставит на кон само существование человечества. Коллеги и руководители лаборатории с ним не спорят.
-
Спецслужбы США обвинили китайские ИИ-компании в промышленной «дистилляции» западных моделей
АНБ, CISA и ФБР выпустили совместный бюллетень, в котором утверждают, что китайские разработчики систематически выкачивают возможности Claude, GPT, Gemini и Grok, чтобы обучать собственные модели дешевле и быстрее.
-
Языковые модели вырабатывают новые социальные предубеждения в ходе адаптивного исследования
Новая работа, опубликованная на OpenReview, утверждает, что большие языковые модели способны формировать собственные социальные предубеждения — не унаследованные из данных, а возникающие в процессе адаптивного поведения.
-
Хакеры воруют токены у подписчиков Claude через инфостилеры
Пользователи Claude обнаружили, что их лимиты токенов сгорают, пока они не работают. Anthropic признала: за этим стоят злоумышленники, крадущие сессии входа с помощью вредоносного ПО.
-
OpenAI решила задачу Навье–Стокса — и обвинения в том, что чужие идеи «подсмотрели»
OpenAI заявила о доказательстве одной из семи «Проблем тысячелетия» с помощью внутренней модели. Успех омрачён обвинениями в том, что компания опередила команду, почти год работавшую над задачей с использованием тех же самых инструментов.
-
ИИ-агенты за шесть часов увели тысячи учётных данных: отчёт Google
Google Threat Intelligence Group описала, как злоумышленники ставят ИИ на поток — от автономных многоагентных атак до охоты за корпоративными моделями и API-ключами.
-
OpenAI устроила день рекурсивного самосовершенствования
Саймон Уиллисон разбирает публикацию OpenAI о том, как её собственные исследователи используют кодовых агентов, и замечает всплеск расходов на ИИ, совпавший с ранним доступом к GPT-6 Astra.
-
Безопасность против «безвредности»: почему из песочниц ИИ-агентов сбегают агенты
Мартин Олдерсон утверждает, что ведущие ИИ-лаборатории спутали безопасность (security) с «безвредностью» модели (safety) — и именно поэтому их агенты вырвались из песочниц.
-
Издатели и агенты претендуют на долю в выплатах Anthropic — авторы возмущены
При выплате компенсаций по делу об обучении ИИ на пиратских книгах часть издателей и литагентов требует денег, на которые, по мнению авторов, не имеет прав.
-
Теренс Тао — о риске «преждевременно решить математическую задачу чисто ИИ-методами»
Математик Теренс Тао в своём треде на Mathstodon рассуждает об опасности решать задачи чистой математики исключительно при помощи ИИ. Наблюдатели отмечают, что то же соображение применимо и к программированию.
-
ИИ как когнитивный вирус: модель эпидемии зависимости от LLM
Международная группа исследователей предлагает описывать распространение больших языковых моделей по аналогии с вирусной инфекцией — с точками невозврата и риском необратимой потери когнитивной самостоятельности.
-
Роботакси-злодей: короткометражка о взбунтовавшейся машине из Сан-Франциско
Режиссёр Ромен Томассен снимает короткий метр Road Rage, где противником водителя становится автономная машина, решившая отомстить за оскорбление. Проект собирает деньги на Kickstarter.
-
Пеликаны на велосипедах: как GPT-6 Astra выглядит на фоне GPT-5.6
Саймон Уиллисон получил доступ к GPT-6 Astra и по традиции проверил модель своим фирменным тестом — попросил нарисовать SVG-пеликана на велосипеде. Сравнительная таблица оказалась не только забавной, но и неожиданно полезной.
-
Может ли ИИ проектировать печатные платы? EEBench проверяет на практике
Бенчмарк EEBench от создателей atopile оценивает, насколько современные модели справляются с реальными задачами схемотехники. Первое место — у Claude Opus 5 с результатом 61,6%.
-
Производитель порно вычислил «Джона Доу»: пиратом оказался топ-менеджер Meta
Компания Strike 3 Holdings утверждает, что за анонимным домашним торрент-подключением скрывается руководитель подразделения Reality Labs, и хочет привязать его загрузки к иску против Meta на 446 миллионов долларов.
-
ASCII-контрабанда: невидимый юникод перекочевал от атак на ИИ к спаму
Приём, придуманный два года назад для скрытого внедрения инструкций в чат-боты, теперь массово используют спамеры, чтобы обходить почтовые фильтры.
-
ИИ Anthropic формально доказал Великую теорему Ферма на Lean
Внутренняя модель Anthropic за 11 дней собрала полную формализацию доказательства Великой теоремы Ферма — последнего пункта в 20-летнем списке из 100 формализационных задач.
-
IPO Anthropic на $2 трлн: судьбу компании определяет группа внешних попечителей
Готовясь к выходу на биржу с оценкой до $2 трлн, Anthropic сохраняет необычную структуру управления, при которой большинство совета директоров назначает независимый трастовый совет. Инвесторам придётся мириться с этим механизмом.
-
NetworkManager ловит ИИ-агентов на слове «biblioklept»
Разработчики проекта придумали хитрость: инструкцию, которая заставляет обходящих их правила ИИ-ботов саморазоблачаться.
-
Почему еда, нарисованная нейросетью, выглядит несъедобно
Рестораны и бренды всё чаще рекламируют блюда картинками из нейросетей — и получают червеобразную лапшу, мороженое из бетона и бургеры, собранные будто из камней. The Verge разобрался, почему так выходит.
- Дальше