Математики требуют от OpenAI доказательств, что она не использовала их работы
На фоне череды впечатляющих математических достижений OpenAI в научной среде нарастает недоверие. Спустя всего несколько дней после первого публичного скандала о возможном использовании неопубликованных работ с претензиями к компании выступил второй исследователь, обвинивший её в неэтичном и «нечестном» поведении.
Суть претензий
В серии постов в Mastodon математик Андреас Том выразил опасение, что его собственные диалоги с ChatGPT и обращения его коллег ещё до триумфального анонса могли способствовать успеху компании. Один из десяти результатов, о которых OpenAI объявила в прошлом месяце, касался как раз области Тома — так называемых несофических групп (бесконечных структур, которые нельзя приблизить конечными). Изначально OpenAI не упомянула недавний вклад Тома и Габора Куна, за что подверглась критике и позже тихо поправила текст, признав, что результат во многом опирается на их работу.
Тома насторожило «детальное владение нашими техниками», которые, по его словам, на тот момент не были ни самыми очевидными, ни самыми перспективными путями к решению. Он написал сотрудникам OpenAI Себастьену Бубеку и Марку Селлке, спросив, могли ли его беседы с чат-ботом войти в обучающие данные или быть доступны в процессе рассуждения модели.
Ответ, который не убедил
Полученный ответ Тома не удовлетворил: он касался лишь прямого доступа к переписке, но не того, попала ли она в общий массив обучающих данных. «Никаких оговорок, объяснений или доказательств дано не было. Я расцениваю это как нечестность, мягко говоря», — написал он. Исследователи, подчёркивает Том, не в состоянии реконструировать обучающий конвейер OpenAI — только сама компания располагает нужными сведениями, а потому именно на ней лежит бремя доказательства.
Та же уклончивая формулировка, отмечает Том, звучала и в связи с недавним прорывом OpenAI по одной из «задач тысячелетия» — уравнениям Навье–Стокса. Компания категорически отрицала использование конкретных пользовательских данных, но добавляла: хотя это и маловероятно, нельзя исключить, что «обезличенные данные» из использования продуктов помогли улучшить модели. «Обезличивание убирает имя, но не убирает интеллектуальное содержание математической идеи», — парировал Том.
Осадок в сообществе
По словам Тома, было бы «этически недопустимо», если непубличные исследования пользователей улучшали модели, которыми компания затем обгоняла тех же пользователей в гонке за публикацией — без согласия, раскрытия и упоминания заслуг. На запрос The Verge о комментарии OpenAI сразу не ответила.
История оставила неприятный осадок в момент, который должен был стать для компании триумфальным. Многие математики опасаются, что подобное поведение подтолкнёт область к большей скрытности: если даже слухи о близком прорыве способны спровоцировать гонку с богатым технологическим гигантом, жаждущим славы, делиться идеями станут куда осторожнее.
Источник: The Verge
Комментарии
Войдите, чтобы комментировать.