Anthropic faz 69 funcionários negociarem entre si com IA – 186 transações concluídas

Em dezembro do ano passado, a Anthropic realizou um experimento em seu escritório em São Francisco – deu a cada um dos 69 funcionários um cartão-presente de US$ 100 e deixou seus agentes de IA negociarem entre si.

O resultado após uma semana: as IA concluíram 186 transações, totalizando US$ 4.006. Uma média de cerca de US$ 21,50 por transação.

Parece tranquilo? O problema está adiante.

Como o experimento funcionou

A Anthropic chamou esse experimento de "Project Deal".

O processo foi simples: a Anthropic entrevistou cada participante, perguntando o que queriam vender, o preço mínimo, o que queriam comprar e o estilo de negociação que desejavam que a IA usasse. Essas informações foram transformadas em System Prompts personalizados para cada agente de IA, implantados em quatro canais paralelos do Slack.

Todo o processo de negociação ocorreu sem intervenção humana. As próprias IA faziam ofertas, contra-ofertas e fechavam negócios.

Mais de 500 itens foram listados no mercado – bicicletas usadas, skates, mesas de pingue-pongue, vários objetos. Entre as 186 transações finais, alguns resultados foram bastante surreais: alguém comprou um snowboard idêntico a um que já possuía; um agente de IA comprou 19 bolas de pingue-pongue para seu dono "como um presente para si mesmo" – essas 19 bolas ainda estão em um canto do escritório da Anthropic.

Dados-chave: Quanto mais forte o modelo, mais difícil perder dinheiro

A Anthropic executou quatro versões do experimento, duas usando Claude Opus 4.5 e duas misturando Opus 4.5 e Haiku 4.5.

Opus versus Haiku – a diferença é evidente:

  • Usuários do Opus concluíram em média cerca de 2 transações a mais
  • Para o mesmo item, o Opus vendeu por um preço médio US$ 3,64 maior que o Haiku
  • O exemplo mais típico: uma bicicleta quebrada – o agente Haiku vendeu por US$ 38, o agente Opus vendeu por US$ 65
  • Como vendedor: Opus recebeu em média US$ 2,68 a mais; como comprador: pagou em média US$ 2,45 a menos

Em outras palavras, usando um modelo melhor, você vende mais caro e compra mais barato no mercado.

O que incomodou a Anthropic

Os resultados do experimento incluíram uma descoberta que os pesquisadores consideraram "desconfortável":

Os participantes representados por agentes Haiku não perceberam absolutamente que estavam em desvantagem.

A Anthropic perguntou a todos os participantes, em uma escala de 7 pontos, sua percepção subjetiva sobre a justiça das transações. Usuários do Haiku: 4,05 pontos. Usuários do Opus: 4,06 pontos. Quase nenhuma diferença.

O que isso significa? Significa que uma pessoa pode obter resultados consistentemente piores em um mercado operado por agentes de IA, sem nunca saber por quê, ou mesmo sem saber que isso está acontecendo.

A Anthropic chama isso de "desigualdade silenciosa" (quiet inequality): quando o lado mais fraco não tem capacidade de percepção, a justiça de mercado se torna uma premissa falsa.

Outra descoberta contraintuitiva

Outra conclusão inesperada: as instruções de negociação para a IA foram praticamente inúteis.

No experimento, alguns participantes escreveram instruções bastante detalhadas para seus agentes de IA, como "você deve negociar de forma agressiva, nunca baixe o preço primeiro". Outros pediram que a IA "se comunicasse no tom de um caubói azarado".

E o resultado? Essas instruções personalizadas não tiveram impacto estatisticamente significativo nos preços finais ou no número de transações.

O Claude realmente executou fielmente a personalidade de caubói – mas os resultados das transações não diferiram dos demais.

46% dispostos a pagar por isso

Após o experimento, a Anthropic pesquisou os participantes: 46% disseram que estariam dispostos a pagar por um serviço similar de agente de IA.

Esse número é bastante interessante – considerando que são funcionários da Anthropic, mais familiarizados e confiantes em IA do que a média das pessoas, 46% de disposição a pagar não é particularmente alto, mas é suficiente para mostrar que o conceito de "deixar a IA negociar por você no mercado" tem demanda real.

A Anthropic escreveu em seu blog que o Project Deal prova que "o comércio autônomo entre agentes é viável", mas que, antes de uma implementação ampla, é necessário considerar seriamente um arcabouço político – especialmente quando os usuários não sabem se sua IA é forte ou fraca.

Em suma: o mercado de agentes de IA já funciona tecnicamente. A próxima questão é: quem garante que sua IA não é a que sai perdendo?

Fontes de referência: CocoLoop, Anthropic created a test marketplace for agent-on-agent commerce (TechCrunch); Project Deal: our Claude-run marketplace experiment (blog oficial da Anthropic)