Startup chinesa Z.ai afirma que novo modelo de IA rivaliza com o Mythos 5 da Anthropic em ciberdefesa
2 fontes em 2 países · Paquistão · Reino Unido
Quem noticiou
- Dawn
- Reuters
O que as cores significam
- Esquerda
- Centro-esquerda
- Centro
- Centro-direita
- Direita
- Um bloco hachurado indica que o veículo é ligado a um Estado ou controlado por ele.
A orientação política indica onde o veículo se situa dentro da política do próprio país. Nunca é uma posição numa única escala global.
A orientação política é comparável dentro de um país, não entre países, e por isso a barra agrupa por país primeiro. Emissoras de financiamento público não são marcadas como ligadas ao Estado.
O proprietário de cada veículo é informado como registro, e não como um julgamento sobre o veículo.
Traduzido do original em inglês, que foi escrito a partir das fontes listadas abaixo.
A startup de IA chinesa Z.ai anunciou que seu modelo de código aberto GLM-5.3 quase igualou o desempenho do modelo restrito Mythos 5, da Anthropic, na identificação de vulnerabilidades de software. De acordo com a Z.ai, o GLM-5.3 obteve 84,5 por cento no teste CyberGym, que avalia a capacidade de um modelo de revisar código e identificar falhas de segurança, em comparação com 83,8 por cento do Mythos 5. Esses resultados não foram verificados independentemente.
Apesar da força na identificação, a Z.ai relatou que o GLM-5.3 ficou atrás do Mythos 5 na conversão dessas falhas em ataques funcionais. No teste ExploitBench, o GLM-5.3 obteve 54,4 por cento, enquanto o Mythos 5 obteve 78,0 por cento. Em tarefas de desenvolvimento de ataque com tempo determinado, o Mythos 5 completou significativamente mais tarefas do que o GLM-5.3 em períodos de duas e seis horas.
A Z.ai planeja lançar o GLM-5.3 publicamente em aproximadamente duas semanas, após avaliações de segurança. A empresa afirmou que suas funções de cibersegurança mais sensíveis serão limitadas a usuários verificados por meio de um programa de acesso confiável. Essa abordagem reflete o esquema de acesso limitado usado pela Anthropic para o Mythos, que é uma versão do modelo Claude Fable 5 com as salvaguardas de cibersegurança removidas.
A Z.ai apresentou o lançamento como um desafio aos modelos de código fechado, argumentando que ferramentas avançadas de ciberdefesa devem estar disponíveis para equipes de segurança menores e desenvolvedores de código aberto. A empresa também anunciou a iniciativa Open Source Shield para auditar projetos de código aberto selecionados. Gabriel Wagner, pesquisador da Concordia AI, observou que esta é a primeira vez que um laboratório chinês justifica publicamente um lançamento aberto atrasado com base em considerações de segurança, sugerindo que as práticas de gestão de risco na China estão se tornando mais sofisticadas.
Como cada lado enquadrou
- Centro-esquerda
- A cobertura forneceu comparações técnicas detalhadas e contextualizou o evento dentro do debate mais amplo entre a governança de IA de código aberto e de código fechado.
- Centro
- A cobertura focou na reivindicação técnica de que o modelo se aproximou do desempenho de um concorrente.
Fontes
100% das afirmações deste artigo foram rastreadas até as reportagens de origem listadas acima.