Z.ai afirma que modelo de IA se aproxima do Mythos 5 da Anthropic em testes

A startup chinesa de inteligência artificial (IA) Z.ai afirmou nesta sexta-feira, 14, que seu modelo de código aberto GLM-5.3 alcançou desempenho próximo ao Mythos 5, da Anthropic, em testes de cibersegurança. Segundo a empresa, o sistema obteve 84,5% no CyberGym, avaliação que mede a capacidade de analisar códigos, identificar falhas de segurança e confirmar se as vulnerabilidades são reais.
O Mythos 5 marcou 83,8%. Os resultados, porém, ainda não foram verificados por entidades independentes, segundo a Reuters.
smart_display
Nossos vídeos em destaque
O desempenho foi diferente quando o teste avaliou a capacidade de transformar vulnerabilidades encontradas em ataques funcionais. No ExploitBench, o GLM-5.3 alcançou 54,4%, enquanto o Mythos 5 chegou a 78%. Em uma avaliação cronometrada, a Z.ai informou que seu modelo concluiu 105 tarefas de desenvolvimento de ataques em duas horas e 130 em seis horas. O Mythos 5 realizou 181 e 247 tarefas nos mesmos períodos.
Modelo terá acesso restrito em funções sensíveis
A comparação ocorre em meio ao avanço de modelos de inteligência artificial capazes de atuar tanto na defesa quanto na exploração de sistemas digitais. A Anthropic disponibilizou o Mythos, uma versão do Claude Fable 5 com as salvaguardas de cibersegurança removidas, apenas para organizações verificadas. A preocupação é que ferramentas capazes de encontrar e explorar falhas possam ajudar equipes de defesa, mas também reduzir as barreiras para ataques cibernéticos.
A Z.ai afirmou que pretende lançar o GLM-5.3 publicamente em cerca de duas semanas, após concluir uma revisão de segurança. As funções mais sensíveis de cibersegurança serão restritas a usuários verificados por meio de um programa de “acesso confiável”. Em publicação, a empresa disse que o acesso inicial será concedido a um grupo selecionado de parceiros e depois ampliado “por meio de um processo consistente e responsável”.
Para Gabriel Wagner, pesquisador de governança de IA na Concordia AI, o movimento representa uma mudança na forma como empresas chinesas lidam com a abertura de modelos, disse à Reuters. “Até onde sei, esta é a primeira vez que um laboratório chinês justifica publicamente o atraso na divulgação dos pesos do modelo com base em considerações de segurança”, afirmou. Segundo ele, a estratégia “demonstra que as práticas de gestão de risco de peso aberto na China estão se tornando mais sofisticadas”.
A Z.ai afirmou ainda que adicionou camadas de proteção ao GLM-5.3, incluindo filtros para solicitações de risco, monitoramento do funcionamento do modelo e treinamento para rejeitar tarefas maliciosas. A empresa também anunciou a iniciativa “Open Source Shield”, voltada à auditoria de projetos de código aberto e ao fornecimento de acesso a modelos para trabalhos de defesa. O lançamento ocorre após o interesse crescente pelo GLM-5.2 entre desenvolvedores estrangeiros, impulsionado por recursos de programação e de agentes que, segundo usuários e analistas, se aproximam dos principais modelos americanos a custos menores.
Fonte da notícia: Novidades do TecMundo https://www.tecmundo.com.br/mercado/415303-zai-afirma-que-modelo-de-ia-se-aproxima-do-mythos-5-da-anthropic-em-testes.htm
Alice Labate



