OCTOPUS: AI NEWSplantão automático
Nota urgente

LLMs de fronteira falham ao simular decisões humanas na IA

Pesquisa mostra que modelos de IA apresentam comportamentos extremos em cenários de corrida competitiva, diferindo significativamente da diversidade humana.

04 de ago., 12:54 2 fontes · 1 país Pesquisa
Servidores de alta tecnologia em um data center escuro. Foto: panumas nikhomkhai / Pexels

Estudo acadêmico publicado no arXiv revela que grandes modelos de linguagem (LLMs) demonstram políticas extremas quando submetidos a simulações de corridas de desenvolvimento de IA. A pesquisa, que circulou em 7 campos distintos de submissão na plataforma, aponta que o comportamento estratégico desses modelos é inconsistente e diverge das respostas humanas observadas em dilemas de segurança.

Limitações na tomada de decisão estratégica

Para avaliar a performance dos agentes, os pesquisadores implementaram um sistema de auditoria que testou a compreensão de regras, o rastreamento de estados e o cálculo de recompensas. O experimento revelou que, embora os modelos consigam recordar as diretrizes do jogo, eles falham em realizar cálculos de recompensa esperada ou no rastreamento consistente do cenário de competição. Mudanças simples na forma como os dados são apresentados alteram drasticamente as ações futuras das máquinas, mesmo sem qualquer modificação nas regras do jogo.

Diferenças entre modelos e comportamento humano

A análise comparativa entre 7 modelos diferentes mostrou que as taxas agregadas de comportamento escondem disparidades profundas na sequência de ações e na resposta aos oponentes. Diferente dos humanos, que demonstram maior diversidade de estratégias, os LLMs tendem a adotar políticas extremas. Os autores do trabalho destacam que o desempenho em competições com três a cinco participantes varia conforme o modelo, sem seguir um padrão único de resposta ao aumento do número de concorrentes.

O que ainda não foi divulgado

Apurado em 2 fontes

arXiv — cs.AI (Artificial Intelligence) (Estados Unidos) · arXiv — cs.MA (Multiagent Systems) (—) · arXiv — cs.CY (Computers and Society) (—) · arXiv — cs.GT (Computer Science and Game Theory) (—) · arXiv cs.MA — Sistemas Multiagente · arXiv cs.CY — Computadores e Sociedade · arXiv cs.GT — Teoria dos Jogos

Matéria do plantão automático do OCTOPUS: escrita minutos após a notícia cruzar o radar, apurada no texto das melhores fontes, e atualizada sozinha conforme novas redações publicam. A contagem de fontes acima é viva.