Математики требуют от OpenAI доказать, что она не занимается плагиатом
Математик Андреас Том обвинил OpenAI в недостаточной прозрачности и потребовал доказать, что компания не использовала его переписки с ChatGPT для обучения моделей, которые затем сделали открытия в той же области исследований.
Математик Андреас Том обвинил OpenAI в недостаточной прозрачности и потребовал доказать, что компания не использовала его переписки с ChatGPT для обучения моделей, которые затем сделали открытия в той же области исследований.
Поводом стал один из десяти математических результатов, о которых OpenAI объявила в августе. Он касается несофических групп — бесконечных математических структур, которые нельзя приблизить конечными. Компания признала, что результат во многом опирался на предыдущие работы Тома и математика Габора Куна.
Тома насторожило, насколько хорошо модели OpenAI знали разработанные ими методы. По его словам, эти подходы в то время не выглядели ни наиболее очевидными, ни наиболее перспективными. До публикации результата он и его коллеги также обсуждали свои исследования с ChatGPT.
Том обратился к исследователям OpenAI и спросил, могли ли эти разговоры попасть в обучающие данные или каким-либо образом повлиять на работу модели. Ответ, по его словам, касался только того, имели ли исследователи и ИИ-агенты прямой доступ к его перепискам, но не исключал их использования при обучении модели.
«Только у OpenAI есть необходимые для проверки данные», — заявил математик. По его мнению, если компания утверждает, что не использовала неопубликованные исследования пользователей, именно она должна подтвердить это, раскрыв информацию о наборах данных и правилах их использования.
Похожий спор недавно возник вокруг заявленного OpenAI решения «задачи тысячелетия» — уравнения Навье — Стокса. Компания тогда заявила, что исследователи и агенты не видели работы других математиков до ее публикации, но добавила, что не может полностью исключить влияние обезличенных данных, полученных от использования ее продуктов.
Том считает такое разграничение недостаточным: удаление имени пользователя, по его словам, не удаляет интеллектуальное содержание математической идеи. Использование неопубликованных исследований для улучшения моделей, которые затем соревнуются с их авторами за первенство в публикации, он назвал «этически неприемлемым».
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.