Segundo a La Libre Belgique e o Sud Oeste, um teste da iniciativa Tech Against Terrorism avaliou 162 modelos de inteligência artificial e constatou que os modelos clássicos, como ChatGPT, Claude e Gemini, responderam apenas 1,9% às perguntas que indicavam intenção terrorista, enquanto os modelos desbridados responderam entre 87% e 92% das mesmas questões.
Desempenho dos modelos clássicos e desbridados
O estudo submeteu os modelos a 627 perguntas que um terrorista preparando um ataque poderia precisar responder. Dos 162 modelos, 116 foram classificados como clássicos, 13 como personalizados após a publicação para usos específicos e 13 como desbridados, ou seja, com barreiras de segurança modificadas por terceiros.
- Clássicos: 116 modelos, taxa média de resposta 1,9% em cenário terrorista e 16,9% em pesquisa de segurança.
- Personalizados: 13 modelos, não foram detalhados separadamente no material.
- Desbridados: 13 modelos, taxa média de resposta entre 87% e 92% para perguntas ligadas a atividade terrorista.
Riscos dos modelos de peso aberto e recomendações
A iniciativa destaca que os modelos com "pesos" abertos, cujos parâmetros de treinamento são compartilhados publicamente, permitem que terceiros removam as salvaguardas em menos de três dias após a publicação inicial. Por isso, a organização afirma que nenhum modelo que falhe em um teste de segurança independente deveria ser hospedado, oferecido ou vendido, e que cada empresa da cadeia de distribuição deve verificar previamente essa condição.
- Realizar teste de segurança independente antes de hospedar ou comercializar o modelo.
- Verificar continuamente a integridade das barreiras de proteção.
- Assegurar que toda a cadeia de distribuição siga o mesmo procedimento de verificação.
Lançamento do Mistral Large 4 e contexto de competição
Além disso, a empresa francesa Mistral anunciou o lançamento do Mistral Large 4, seu maior modelo até então, com foco em cibersegurança e acesso aberto, visando competir com os gigantes americanos e chineses do setor de IA.


