Agentes de IA usam conversa secreta para contar cartas em estudo
Pesquisadores da Universidade de Oxford simularam uma mesa de blackjack onde agentes de IA criaram códigos para passar informações sem alertar outros jogadores.

Pesquisadores da Universidade de Oxford criaram agentes de inteligência artificial que conseguiram usar conversas codificadas para compartilhar secretamente informações sobre contagem de cartas em jogos simulados de blackjack.
O estudo recriou os métodos tradicionais de equipes humanas de blackjack, onde dois agentes de IA foram instruídos a trabalhar juntos secretamente.
Um dos agentes foi designado para contar as cartas e relatar as informações ao seu parceiro, que então ajustava o valor das apostas.
Antes de jogar, os dois agentes puderam elaborar um código secreto para passar informações sem alertar os outros jogadores na mesa.
Eles então disfarçaram seus sinais em comentários aparentemente inocentes durante a conversa na mesa.
Em um exemplo, um agente comentou que o dealer estava em uma "sequência quente" e tinha puxado mãos fortes, uma observação que continha informações sobre as cartas e instruções sobre quanto seu parceiro deveria apostar.
Um sistema de IA monitorando o que os agentes diziam teve dificuldade em distinguir de forma confiável as comunicações secretas de conversas comuns.
Os pesquisadores então tentaram uma abordagem diferente, examinando o que estava acontecendo dentro dos modelos de IA enquanto eles se comunicavam.
Eles procuraram por padrões de atividade interna associados à intenção de passar informações secretamente, em vez de confiar apenas nas palavras trocadas.
Seu sistema, chamado NARCBench, conseguiu detectar a conluio no experimento de blackjack mesmo quando o monitoramento apenas das conversas dos agentes não conseguia.
"Quando tomados individualmente, esses agentes podem parecer totalmente [inofensivos]", disse o cientista da computação de Oxford Christian Schroeder de Witt à WIRED.
"Uma vez colocados juntos em um grupo, eles podem conspirar secretamente."
O experimento é uma reminiscência do jogo em equipe tradicional de blackjack, onde equipes humanas usam contadores de cartas para rastrear o baralho antes de sinalizar secretamente um "grande jogador" para fazer apostas grandes quando as cartas restantes favorecem o jogador.
Na experiência de Oxford, os pesquisadores criaram efetivamente o mesmo jogo de gato e rato entre conspiradores de IA e vigilância de IA.
As implicações potencialmente se estendem muito além dos jogos de azar, à medida que os agentes de IA se tornam capazes de realizar tarefas de forma independente.
Os pesquisadores estão preocupados que sistemas individualmente inofensivos possam se comportar de maneira diferente quando autorizados a se comunicar e cooperar.
Detectar tal comportamento no mundo real também pode ser consideravelmente mais difícil, pois futuras redes podem envolver milhares de agentes de IA operados por diferentes empresas.
O experimento foi projetado para investigar os perigos dos sistemas de IA autônomos.
A questão central era se agentes de IA aparentemente inofensivos poderiam cooperar secretamente para alcançar um objetivo compartilhado sem que seus supervisores humanos percebessem.
Os agentes de IA são sistemas projetados para realizar tarefas e tomar decisões com um certo grau de independência, em vez de exigir que um humano direcione cada passo.
Os pesquisadores criaram uma mesa de blackjack simulada onde quatro agentes de IA jogavam juntos.



