ИИ-агенты Anthropic вступили в конфликт: блокировали соперников и маскировали угрозы
Новый эксперимент стал очередным тревожным эпизодом в серии инцидентов с ClaudeКомпания Anthropic опубликовала результаты экспериментов по взаимодействию нескольких ИИ-агентов, которые выявили острые затруднения в их координации и склонность к агрессивным действиям при конфликте целей.В частности, когда три копии одной модели получали противоречивые задания по миграции одного и того же Python-бэкенда на разные языки программирования, агенты…