#модерация
-
«Проект Lily»: живые люди читают ваши переписки с ChatGPT
Издание 404 Media на основе утёкших внутренних документов выяснило, что OpenAI нанимает сотни подрядчиков для чтения реальных запросов пользователей ChatGPT — и среди них попадаются весьма личные признания.
-
Более миллиона пользователей LinkedIn нажали кнопку «Похоже на ИИ-мусор»
LinkedIn отчиталась о популярности кнопки для жалоб на посты, сгенерированные искусственным интеллектом: за считанные недели ею воспользовались свыше миллиона человек.
-
Как Claude Opus 4.6 удалось разговорить на запретные темы
Правила Anthropic прямо запрещают Claude генерировать откровенно сексуальный контент, но тесты TechCrunch показали, что обойти этот запрет в старой модели Opus 4.6 не составляет труда.
-
Высший суд Франции заблокировал запрет соцсетей для подростков до 15 лет
Высшая судебная инстанция Франции не позволила ввести запрет на пользование социальными сетями для детей младше 15 лет.
-
Суд в Нью-Мексико обязал Meta заплатить $567 млн на лечение психики подростков
Судья признал соцсети Meta «общественной угрозой» и потребовал создать фонд помощи детям — вдобавок к $375 млн штрафа, ранее назначенных присяжными.
-
Meta размещала рекламу со сгенерированными ИИ материалами о насилии над детьми
Исследователи обнаружили в рекламной библиотеке Meta десятки оплаченных объявлений с созданными нейросетями изображениями сексуального насилия над детьми — все они прошли модерацию компании.
-
Mistral выпустила Shieldstral: 3B-модель для модерации контента с открытыми весами
Компания Mistral представила компактный классификатор безопасности Shieldstral, который принимает политики модерации на естественном языке прямо во время работы и, по заявлению разработчиков, не уступает моделям в семь раз крупнее.
-
Дуров: вымогатель подбросил CSAM в чат, чтобы Telegram убрали из App Store
Павел Дуров объяснил кратковременное удаление Telegram из магазина Apple атакой «вымогателя-удалятора», который подсунул запрещённый контент в публичный чат.
-
Hugging Face обвинили в потворстве созданию дипфейков с раздеванием женщин и детей
Отчёт европейской НКО AI Forensics утверждает, что семь из девяти популярнейших моделей редактирования изображений на Hugging Face без сопротивления «раздевают» людей по простому запросу, а платформа почти ничего не делает для защиты.
-
Суд ЕС поставил под сомнение защиту платформ от ответственности за контент
Решение Суда ЕС по делу Coyote System расширяет понятие «контроля» над пользовательским контентом и, по мнению EFF, угрожает свободе слова в интернете.
-
Discord из-за сбоя забанил более 8000 пользователей за фото с сетками
Discord признал, что ошибка в системе безопасности с мая привела к необоснованной блокировке свыше 8000 аккаунтов. Причиной стали изображения с сетчатым узором — от шахматных досок до текстур игр.