Anthropic讓69員工的AI互相做生意成交186筆

去年12月,Anthropic在舊金山辦公室做了一個實驗——給69名員工每人一張100美元禮品卡,然後讓他們的AI代理人在市場中互相做生意。

結果一週後,AI們完成了186筆交易,總價值4006美元。平均每筆約21.5美元。

聽起來挺順暢?問題在後頭。

實驗怎麼跑的

Anthropic把這個實驗叫做「Project Deal」。

流程很簡單:Anthropic先對每個參與者做了一次訪談,問他們想賣什麼、底價多少、想買什麼、希望AI談判時用什麼風格。然後把這些資訊變成每個AI代理人的自訂System Prompt,部署進四個平行的Slack頻道裡。

整個談判過程沒有人工干預。AI們自己開價、還價、成交。

市場上架了500多件商品——二手自行車、滑板、乒乓球桌、各種雜物。最後186筆交易裡有一些相當魔幻的結局:有人買了一塊和自己已經有的完全相同的滑雪板;有一個AI代理人替主人買了19個乒乓球「作為送給自己的禮物」,這19個球現在還放在Anthropic辦公室的角落裡。

關鍵數據:模型越強,錢越難虧

Anthropic跑了四個版本的實驗,其中兩個用Claude Opus 4.5,兩個混合了Opus 4.5和Haiku 4.5。

Opus對比Haiku,差距一眼就能看出來:

  • Opus用戶平均多完成約2筆交易
  • 同一件商品,Opus賣出的價格平均比Haiku高3.64美元
  • 最典型的例子:一輛壞掉的自行車,Haiku代理人賣了38美元,Opus代理人賣了65美元
  • 作為賣方:Opus平均多拿2.68美元;作為買方:平均少付2.45美元

換言之,用更好的模型,在市場裡既賣得貴、又買得便宜。

讓Anthropic坐不住的那件事

實驗結果裡有一條讓研究人員覺得「不舒服」的發現:

那些被Haiku代理人代表的參與者,完全沒有察覺到自己處於劣勢。

Anthropic用7分量表問了所有參與者對交易公平性的主觀感受。Haiku用戶:4.05分。Opus用戶:4.06分。幾乎沒有差別。

這意味著什麼?意味著一個人可以在AI代理的市場裡持續拿到更差的結果,卻永遠不知道為什麼,甚至不知道這件事正在發生。

Anthropic把這叫做「悄無聲息的不平等」(quiet inequality):當弱勢一方沒有感知能力時,市場公平就成了個假命題。

還有一個反直覺的發現

另一個出乎意料的結論:給AI的談判指令幾乎沒用。

實驗裡有人給自己的AI代理人寫了相當詳細的指令,比如「你必須強硬談判,絕對不要先降價」。有人要求AI「用一個倒楣牛仔的語氣溝通」。

結果呢?這些自訂指令對最終成交價格、成交數量幾乎沒有可統計的影響。

Claude確實忠實執行了那個牛仔人格——但交易結果和別人沒啥兩樣。

46%的人願意為此付費

實驗結束後,Anthropic對參與者做了調查:有46%的人表示願意為類似的AI代理服務付費。

這個數字比較有意思——考慮到這些人都是Anthropic員工,對AI本就比普通人更熟悉、更信任,46%的付費意願算不上特別高,但也足夠說明「讓AI幫你跑市場談判」這個概念有真實需求。

Anthropic在部落格文章裡說,Project Deal證明了「代理間的自動商業是可行的」,但同時也在真正推廣之前,需要認真考慮政策框架——尤其是當用戶根本不知道自己的AI強弱時。

說白了:AI代理人的市場已經技術上跑通了。下一個問題是,誰來保證你的AI不是那個吃虧的那個?

參考來源:CocoLoop、Anthropic created a test marketplace for agent-on-agent commerce(TechCrunch);Project Deal: our Claude-run marketplace experiment(Anthropic官方部落格)