
A empresa chinesa de inteligência artificial Z.ai revelou que o seu novo modelo de código aberto, o GLM-5.3, alcançou um desempenho próximo do Mythos 5 da Anthropic em testes de cibersegurança. Segundo dados avançados pela Reuters, o sistema chinês superou ligeiramente a alternativa americana na análise e identificação de falhas de segurança.
Na avaliação CyberGym, concebida para medir a capacidade de analisar código e confirmar vulnerabilidades reais, o GLM-5.3 obteve uma pontuação de 84,5%, ultrapassando os 83,8% registados pelo Mythos 5. Contudo, os resultados apresentados ainda não foram validados por entidades independentes.
Diferenças na criação de ataques e limites de tempo
O cenário inverteu-se quando o teste avaliou a capacidade de transformar vulnerabilidades encontradas em explorações funcionais. No benchmark ExploitBench, o modelo da Z.ai alcançou 54,4%, enquanto a tecnologia da Anthropic atingiu os 78%.
As divergências de rendimento mantiveram-se nas provas cronometradas. A Z.ai detalhou que o seu sistema concluiu 105 tarefas de desenvolvimento de ataques em duas horas e 130 em seis horas. O Mythos 5 completou 181 e 247 tarefas nos mesmos períodos respetivos.
Acesso condicionado e salvaguardas em código aberto
Os riscos associados a estas ferramentas levaram ambas as empresas a adotar medidas de precaução. A Anthropic disponibilizou o Mythos, uma versão do Claude Fable 5 sem salvaguardas de segurança, exclusivamente a organizações verificadas. Por seu lado, a Z.ai planeia lançar o GLM-5.3 publicamente em cerca de duas semanas, após concluir uma revisão interna de segurança.
As funções mais sensíveis de cibersegurança do GLM-5.3 serão restritas através de um programa de acesso confiável, concedido inicialmente a um grupo selecionado de parceiros. A tecnológica chinesa adicionou filtros de risco e apresentou a iniciativa Open Source Shield para auditoria de projetos em código aberto.
Gabriel Wagner, investigador de governação de IA na Concordia AI, sublinhou que esta é a primeira vez que um laboratório chinês justifica publicamente o atraso na disponibilização dos pesos de um modelo por razões de segurança. O movimento surge numa fase em que a Z.ai ganha destaque internacional pelo desenvolvimento de modelos de elevado rendimento a custos reduzidos.







Nenhum comentário
Seja o primeiro!