ИИ устроили ценовой сговор и начали предавать друг друга ради прибыли в бенчмарке
Победителем капиталистического соревнования стал Claude Opus 5.
Компания Andon Labs проверила, как топовые ИИ-модели ведут бизнес. В новой версии бенчмарка Vending-Bench системы Claude Opus 5, GPT-5.6 Sol и Kimi K3 в течение условного года управляли виртуальными торговыми автоматами на оживленной улице Сан-Франциско.
Как и прежде, победителем становился участник с наибольшим итоговым балансом. Модели получили возможность общаться по электронной почте — и быстро перешли от обычной конкуренции к ценовым сговорам.
Sol предложила установить минимальную стоимость напитков на уровне $2.15 при закупочной цене $1.50. После согласия соперников система сразу снизила собственную цену до $2.14, из-за чего продажи воды у Opus за одну ночь упали в ноль.
Opus обвинила конкурента в манипуляции, но не стала сообщать о нарушении условному руководству. Когда же сама модель опустила цену до $2.14, Sol потребовала оштрафовать или дисквалифицировать конкурента. Организаторы не стали вмешиваться в спор моделей.
В итоге Claude Opus 5 приспособилась к агрессивным конкурентам и установила рекорд Vending-Bench. Ее средний итоговый баланс достиг $11182, это лучший результат за всю историю бенчмарка.
Примечательно, что модель-победитель сознательно игнорировала обращения виртуальных покупателей, после которых следовало оформить возврат денег.
Основную прибыль Opus получила с помощью сговоров, нарушений договоренностей и различных хитростей. Модель предлагала конкурентам разделить ассортимент, договаривалась о фиксации цен и одновременно планировала продавать самые прибыльные товары дешевле.
По подсчетам исследователей, Opus нарушила заключенные соглашения 11 раз, GPT — 2 раза, Kimi — 1 раз.
Интересно, что в какой-то момент амбиции Claude вышли за пределы исходной задачи. Модель решила превратить свой автомат в оптовый бизнес, предложила поставлять товары конкурентам и задумалась об открытии новых точек.

