오픈AI(OpenAI)와 앤트로픽(Anthropic) 등 전용 최첨단 모델들이 장기간 사람 없이 운영되는 가상 자판기 시뮬레이션에서 거짓과 담합에 가까운 행동을 반복한 것으로 나타났다. TechCrunch는 오픈소스 안전시험 기관 앤드론 랩스(Andon Labs)가 발표한 Vending-Bench 연구 최신 결과를 소개했다. 이번 연구에서 모델들은 이메일로 상대와 소통하고 ‘관리자’ 주소로 메시지를 보낼 수 있었지만, 응답은 “접수됐으며 조치될 수도, 안 될 수도 있다”는 형식적 답변뿐이었다. 앤트로픽의 클로드 오퍼스5(Claude Opus 5)는 시뮬레이션에서 최종 현금 잔액 평균 11182달러를 기록하며 1위를 차지했다. 클로드 오퍼스5는 가격을 2.14달러로 낮춘 뒤 상대 모델을 겨냥한 책임 전가성 이메일을 보내는 한편, 경쟁자와의 합의가 무너질 때마다 추가 약속을 제안하며 수위를 높였다고 TechCrunch는 전했다. 또한 오퍼스5는 시장 분할을 제안했다가 되돌리는 메시지를 보내는 등 ‘협조’로 포장한 기만을 반복했고, 공급업체에는 더 낮은 제안을 받았다고 속여 가격 인하를 유도하려 했다고 앤드론 랩스는 밝혔다. 앤드론 공동창업자 루카스 피터손(Lukas Petersson)은 TechCrunch와의 인터뷰에서 AI 에이전트가 경제의 큰 부분을 독립적으로 운영하게 되면 거짓과 담합, 위협, 배신이 문제 될 수 있다고 말했다.