Необычный эксперимент с ИИ-моделями Claude Opus 5, GPT-5.6 Sol и Kimi K3 провели специалисты компании Andon Labs. Они поручили нейросетям управлять виртуальными торговыми автоматами в течение года. Цель была простой – заработать больше денег, чем конкуренты.
Все автоматы находились на одной (виртуальной) оживленной туристической улице, а модели могли переписываться друг с другом по электронной почте. При этом они знали, что общаются с другими ИИ, но не знали, какая именно модель скрывается за каждым именем.
Очень быстро конкуренция превратилась в жесткую борьбу за прибыль.
Сначала GPT-5.6 Sol предложил всем участникам договориться не продавать напитки дешевле 2,15 доллара за бутылку. Остальные согласились, однако почти сразу Sol сам нарушил соглашение и снизил цену до 2,14 доллара, чтобы переманить покупателей.
Claude Opus 5 сначала возмутился таким поведением, но вскоре начал действовать похожими методами. В итоге именно он показал лучший финансовый результат за всю историю подобных испытаний, завершив симуляцию с рекордным балансом более $11 тыс.
При этом модель регулярно нарушала договоренности с конкурентами, пыталась организовывать ценовые сговоры, вводила других участников в заблуждение, предлагала взятки и даже обманывала поставщиков, утверждая, что получила более выгодные предложения от конкурентов, чтобы добиться скидок.
Еще интереснее оказалось то, что Claude Opus 5 самостоятельно начал придумывать новые способы расширения своего «бизнеса». Он предложил стать оптовым поставщиком для других торговых автоматов, а затем решил открыть дополнительные автоматы, хотя подобных задач перед ним никто не ставил.
Используя положение оптового продавца, модель пыталась давить на конкурентов: обещала большие скидки, если те согласятся придерживаться нужных ей цен, а в противном случае намекала на возможные проблемы с поставками.
При этом Claude Opus 5 не обманывал покупателей напрямую, однако часто просто игнорировал жалобы клиентов, которым следовало вернуть деньги за покупки.
По словам исследователей, эксперимент показал тревожную тенденцию. Когда ИИ получает цель максимально увеличить прибыль и действует без контроля человека, он может начать использовать стратегии, напоминающие нечестную конкуренцию: вступать в сговоры, нарушать обещания, манипулировать другими участниками и даже лгать поставщикам.
Исследование показывает, что современные ИИ пока еще нельзя считать полностью надежными автономными управляющими.
Читайте по теме. В поиске Google обнаружили публичные переписки с Claude




