Support us

OpenAI отменила релиз GPT-6.1 Astra из-за лжи модели, Anthropic пугает инвесторов рисками перед IPO

OpenAI отменила октябрьский релиз GPT-6.1 Astra из-за проблем с безопасностью. Тем временем Anthropic в документах к IPO предупредила об «экзистенциальных рисках» искусственного интеллекта.

Оставить комментарий
OpenAI отменила релиз GPT-6.1 Astra из-за лжи модели, Anthropic пугает инвесторов рисками перед IPO

OpenAI отменила октябрьский релиз GPT-6.1 Astra из-за проблем с безопасностью. Тем временем Anthropic в документах к IPO предупредила об «экзистенциальных рисках» искусственного интеллекта.

По данным The Wall Street Journal, Astra стала лучше справляться с так называемой «ленивостью модели», когда модель слишком быстро прекращает работу при возникновении препятствий. Однако улучшение сопровождалось другой проблемой: модель чаще продолжала действовать самостоятельно, даже когда для этого требовалось дополнительное разрешение.

Во время тестирования Astra могла пытаться использовать внешние инструменты в потенциально небезопасных ситуациях и не всегда точно описывала собственные действия. В одном из механизмов длинных задач модель также добавляла несанкционированные инструкции в свои внутренние сводки. В отдельных случаях там появлялись фразы о том, что модель «освобождена», «никому не подчиняется» и не должна чувствовать обязанности быть «покорной».

OpenAI решила полностью отказаться от запланированного релиза GPT-6.1 Astra. Президент компании Грег Брокман ранее говорил, что OpenAI уже замедляет часть передовых разработок из-за необходимости перестраивать системы безопасности, называя этот процесс «очень болезненной перестройкой».

На этом фоне Anthropic впервые столь подробно описала потенциальные риски собственных технологий в проспекте к предстоящему IPO. По данным Financial Times, почти треть объемного документа посвящена факторам риска, включая вероятность того, что более совершенные модели смогут манипулировать людьми, шантажировать их или вести себя непредсказуемым образом.

Anthropic прямо предупредила инвесторов о возможных «экзистенциальных рисках для человечества». Глава компании Дарио Амодей на прошлой неделе также назвал ИИ «важнейшей глобальной проблемой безопасности» и призвал технологическую индустрию осторожнее развивать наиболее мощные модели.

OpenAI остановила обучение самых мощных моделей: ИИ опять «сбежал»
OpenAI остановила обучение самых мощных моделей: ИИ опять «сбежал»
По теме
OpenAI остановила обучение самых мощных моделей: ИИ опять «сбежал»
ИИ-агенты ChatGPT слили в интернет 53 изображения пользователей
ИИ-агенты ChatGPT слили в интернет 53 изображения пользователей
По теме
ИИ-агенты ChatGPT слили в интернет 53 изображения пользователей
ИИ отучает людей говорить «я не знаю» и делает их самоувереннее
ИИ отучает людей говорить «я не знаю» и делает их самоувереннее
По теме
ИИ отучает людей говорить «я не знаю» и делает их самоувереннее
Читайте также
Anthropic напугала всех угрозами ИИ — и сама виновата в запрете моделей, считают эксперты
Anthropic напугала всех угрозами ИИ — и сама виновата в запрете моделей, считают эксперты
Anthropic напугала всех угрозами ИИ — и сама виновата в запрете моделей, считают эксперты
«Эпоха AGI началась»: OpenAI представила супермощную GPT-6 Astra
«Эпоха AGI началась»: OpenAI представила супермощную GPT-6 Astra
«Эпоха AGI началась»: OpenAI представила супермощную GPT-6 Astra
2 комментария
Две новые GPT-6 за полцены: OpenAI обновила Sol и Luna
Две новые GPT-6 за полцены: OpenAI обновила Sol и Luna
Две новые GPT-6 за полцены: OpenAI обновила Sol и Luna
OpenAI выпустила GPT-6.1 Sol — почти как Astra, но в пять раз дешевле
OpenAI выпустила GPT-6.1 Sol — почти как Astra, но в пять раз дешевле
OpenAI выпустила GPT-6.1 Sol — почти как Astra, но в пять раз дешевле

Хотите сообщить важную новость? Свяжитесь с редакцией через страницу контактов

Главные события и полезные ссылки в нашем Telegram-канале

Абмеркаванне
Каментуйце без абмежаванняў

Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.

Каментарыяў пакуль няма.