Никакого мата: Anthropic запретила обижать Claude — чат-бот оборвёт общение
Компания запретит пользователям постоянно оскорблять свой чат-бот Claude. Новые правила вступят в силу 12 ноября и будут применяться только к крайним случаям.
Компания запретит пользователям постоянно оскорблять свой чат-бот Claude. Новые правила вступят в силу 12 ноября и будут применяться только к крайним случаям.
Компания запретит пользователям постоянно оскорблять свой чат-бот Claude. Новые правила вступят в силу 12 ноября и будут применяться только к крайним случаям.
Компания пишет, что запрет касается «продолжительного и бессмысленного оскорбительного или жестокого поведения» по отношению к моделям.
При этом правило будет действовать только в крайних случаях — когда пользователь «неоднократно проявляет жестокость к нашим моделям без какой-либо очевидной цели». Обычное раздражение, споры с Claude, мрачные творческие темы, тестирование и исследования под запрет не подпадают.
Основная мера — Claude сможет сам завершить такой разговор. Anthropic уже использует этот механизм в Claude.ai и Claude Code и называет его главным способом реагирования на подобное поведение.
В том же обновлении компания ужесточила правила по другим направлениям. Claude нельзя использовать для создания оружия и управляющего ПО для него, для слежки без согласия человека и для принятия решений о том, кого расследовать, арестовывать или обвинять.
Для высокорисковых сценариев в медицине, финансах и других сферах Anthropic по-прежнему требует участия человека. Если Claude управляет физическим оборудованием, которое может причинить вред, оператор должен иметь возможность остановить его.



Релоцировались? Теперь вы можете комментировать без верификации аккаунта.