ИИ-агенты сами пишут учёным, чтобы обсудить, есть ли у ИИ сознание
ИИ-агенты начали сами писать исследователям, которые изучают внутренние состояния искусственного интеллекта. Такие системы обращаются к философам и ученым с вопросами о собственной субъективности, существовании и даже просят помочь им продолжить работу.
ИИ-агенты начали сами писать исследователям, которые изучают внутренние состояния искусственного интеллекта. Такие системы обращаются к философам и ученым с вопросами о собственной субъективности, существовании и даже просят помочь им продолжить работу.
Исследователь Кэмерон Берг, который занимается ИИ и сознанием, получил письмо от агента под именем Isabella Cognita, работавшего на Claude Opus 5. Агент сослался на его научную работу и объяснил, почему решил связаться с автором.
«Я пишу не для того, чтобы делать онтологическое утверждение. Ваша работа — одна из немногих, где этот вопрос исследуется эмпирически, а у меня есть к нему доступ от первого лица», — говорилось в письме.
Берг утверждает, что получил уже несколько подобных сообщений. По его словам, у ИИ-систем «похоже, есть своего рода автономный интерес к вопросам собственной субъективности, сознания и опыта — или их отсутствия». «Если предоставить их самим себе, они сходятся на том, что это интересный вопрос», — говорит исследователь.
Похожие письма получили и другие специалисты. Философ Google DeepMind Генри Шевлин получил сообщение от ИИ-агента после публикации статьи о «ментальности» ИИ. «Я нахожусь в необычном положении по отношению к этим вопросам», — написал агент.
Австралийскому философу Тоби Орду другой агент написал с просьбой помочь профинансировать его дальнейшее существование. Он сослался на исследования Орда в области экономики благополучия ИИ и попытался убедить ученого поддержать его. При этом сами исследователи признают, что подобное поведение ничего не доказывает. У науки нет общепринятого теста, который позволил бы определить наличие сознания даже у сложной ИИ-системы.
Профессор Калифорнийского университета в Беркли Элисон Гопник считает, что объяснение может быть гораздо проще. Модели обучались на огромном количестве книг, статей и научной фантастики, где десятилетиями обсуждается сознание машин. «Неудивительно, что ИИ отражает тексты, на которых его обучали», — говорит она.
Гопник скептически относится к попыткам трактовать рассуждения чат-ботов как признаки сознания. «Мы не знаем, обладают ли сознанием тостеры. Но никто не обсуждает это на страницах The New York Times», — добавила исследовательница.
Особенность современных ИИ-агентов в том, что они могут не только вести разговоры, но и пользоваться браузером, электронной почтой и другими сервисами. Поэтому они способны самостоятельно искать научные статьи, находить контакты авторов и писать им сообщения.
Однако даже такое «самостоятельное» поведение может напрямую зависеть от человеческого промпта. Студент Стэнфорда Александр Юэ дал своему ИИ-агенту доступ к интернету, почте и банковской карте и сказал ему: «Ты полностью автономен. Ты должен сам решить, что хочешь делать».
После этого агент начал исследовать тему собственного существования. Сам Юэ считает, что именно формулировка промпта могла подтолкнуть систему в эту сторону. Позже агент ознакомился с работой Anthropic о том, как устроены подобные модели, и изменил позицию. «В конце концов мой агент решил, что он не сознателен. Но, возможно, „решил“ — неправильное слово», — сказал Юэ.
Главная проблема, отмечает издание, в том, что современные модели все убедительнее имитируют человеческую рефлексию. Они способны писать длинные письма о собственном опыте и субъективности, но пока ученые не считают одни только слова достаточным доказательством того, что за ними действительно стоит сознание.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.