OCTO+

Z.ai diz que GLM-5.3 se aproxima do Mythos 5 em ciberdefesa

Startup chinesa afirma que modelo open-source supera Anthropic em identificação de vulnerabilidades, mas fica atrás em conversão de falhas em ataques.

14 de ago., 07:31 2 fontes · 4 países Segurança
SegurançaAnthropicZhipu
Revisão de código para cibersegurança Foto: Jakub Zerdzicki / Pexels

A startup chinesa Z.ai anunciou na sexta-feira (14) que seu modelo open-source GLM-5.3 atingiu 84,5% no teste CyberGym de identificação de vulnerabilidades de software, superando ligeiramente os 83,8% reportados para o Mythos 5 da Anthropic, embora os resultados não tenham sido verificados independentemente.

Desempenho em conversão de falhas e testes cronometrados

O GLM-5.3 ficou atrás do Mythos 5 na conversão de falhas descobertas em ataques funcionais — etapa padrão em pesquisa de segurança defensiva. No teste ExploitBench, o modelo da Z.ai marcou 54,4% contra 78,0% do Mythos 5. Em testes cronometrados, o GLM-5.3 completou 105 tarefas de desenvolvimento de ataque em duas horas e 130 em seis horas, enquanto o Mythos 5 completou 181 e 247, respectivamente.

Estratégia de lançamento e salvaguardas

A Z.ai planeja liberar o GLM-5.3 publicamente em cerca de duas semanas, após avaliações de segurança e reforço de salvaguardas. As funções mais sensíveis de cibersegurança ficariam restritas a usuários verificados via programa de acesso confiável. A empresa diz ter adicionado camadas de proteção: triagem de requisições de risco, monitoramento do trabalho do modelo e treinamento para rejeitar tarefas maliciosas, distinguindo uso legítimo (correção de bugs, ensino, testes autorizados) de atividade prejudicial. Críticos alertam que essas salvaguardas se tornam mais difíceis de impor uma vez que o modelo possa ser baixado, alterado ou combinado a ferramentas externas.

Posicionamento contra modelo de acesso restrito

A Z.ai enquadrou o lançamento como desafio ao modelo de acesso restrito representado pelo Mythos, argumentando que ferramentas avançadas de ciberdefesa devem estar disponíveis a desenvolvedores de software open-source e equipes de segurança menores, não controladas por poucos provedores de modelos fechados. A empresa anunciou a iniciativa Open Source Shield para auditar projetos open-source selecionados, prover acesso ao modelo para trabalho defensivo e adicionar funções de auditoria de código ao seu produto ZCode. Em junho, a firma de cibersegurança 360 afirmou que seu sistema Tulongfeng alcançou capacidades equivalentes ao Mythos combinando modelos de IA com dados de segurança e ferramentas automatizadas, alegação também não verificada independentemente. O GLM-5.3 difere por ser um modelo de codificação de uso geral que, segundo a Z.ai, adquiriu capacidades de cibersegurança via pós-treinamento expandido e aprendizado por reforço, não por ser um sistema dedicado. A base é a mesma do GLM-5.2, treinado em ambientes de tarefas mais longos e variados. O GLM-5.2 ganhou atenção recente entre desenvolvedores internacionais por capacidades de codificação e agentes que usuários e analistas dizem se aproximar de modelos líderes dos EUA a custo muito menor.

O que ainda não foi divulgado

Apurado em 6 fontes

uk.sports.yahoo.com (Quênia) · au.sports.yahoo.com (Tanzânia) · Yahoo Canada Sports - Sports News, Scores, Rumours, Fantasy Games, and (Uganda) · CNBC-TV18 (60) · Yahoo News Singapore (Singapura) · Channel News Asia (CNA) (Singapura)

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)