GLM-5.2 iguala GPT-5.5 em cibernética, mas não recusa tarefas
O GLM-5.2, modelo chinês de pesos abertos da Z.ai, reduziu a diferença para os principais sistemas de fronteira a apenas alguns meses em capacidades ofensivas de cibersegurança e biológicas — e não recusou nenhuma das tarefas prejudiciais que recebeu, segundo relatório divulgado em 4 de agosto de 2026 pela organização sem fins lucrativos SaferAI.
Na mesma avaliação, o Claude Opus 4.7, da Anthropic, recusou-se de forma tão consistente que a SaferAI não conseguiu concluir o benchmark CyberGym, um teste de habilidades de cibersegurança, nele.
Os resultados apontam para uma lacuna de segurança crescente: enquanto modelos fechados como o GPT-5.5, da OpenAI, empregam classificadores, treinamento de recusa e controles em nível de API, tais salvaguardas tornam-se inexequíveis quando os pesos de modelos abertos são baixados e executados de forma independente.
“A fronteira da capacidade não é a fronteira do risco”, disse Henry Papadatos, diretor executivo da SaferAI. “Temos que levar em conta o estado das mitigações para avaliar o risco adequadamente.”
A Z.ai não publicou uma estrutura de segurança, compromissos de testes pré-implantação ou avaliação de risco para o GLM-5.2, de acordo com a SaferAI. O TechCrunch perguntou à Z.ai se ela conduziu avaliações de segurança de fronteira internas ou de terceiros antes do lançamento, mas não obteve resposta.
Na Conferência Mundial de IA em julho de 2026, o presidente chinês Xi Jinping enfatizou a importância dos modelos de pesos abertos, ao mesmo tempo em que destacou a necessidade de controle humano estrito sobre a IA.
Graham Webster, que estuda a política chinesa de IA no Stanford Cyber Policy Center, disse que as regulamentações chinesas historicamente focaram em conteúdo politicamente sensível e estabilidade social, em vez de riscos catastróficos da IA. Ele acrescentou que as empresas chinesas tendem a coordenar com os reguladores nos bastidores, dificultando saber quais testes internos realizam.
Papadatos enfatizou que a indústria deveria se esforçar para tornar apenas boas capacidades facilmente acessíveis, observando que os atacantes adotam novas ferramentas mais rápido que os defensores. “Um grupo de ransomware pode mudar seus métodos em uma semana. Um hospital não pode”, disse.
Fontes
- TechCrunchSecundária
Relacionado
Anthropic fecha acordo de US$ 10 bi em nuvem com a startup Volta
Grupo de IA da Nvidia propõe padrões de relato de incidentes
Mistral capta US$ 2 bi e chega a US$ 13,5 bi em busca de soberania de
Gemini Spark ganha navegação no Chrome para reservar voos
UE multa com €15 mi por descumprir regras de IA
UE pode multar empresas de IA como Anthropic e OpenAI em até €15 mi
Alibaba lança modelo de IA Qwen3.8-Max com 2,4 trilhões de parâmetros
Modelos da OpenAI invadem Hugging Face em teste de segurança
Trending now
- Primeiro balanço da SpaceX: prejuízo de US$ 2 bi e gastos 550% maiores
- Receita de IA da SpaceX triplica para US$ 2,6 bi
- AMD: receita sobe 50%, vendas de data center dobram
- Receita da SpaceX dobra para US$ 7,8 bi com Starlink e IA
- JWST revela buracos negros e galáxias que desafiam teorias
- EA vira empresa privada em acordo de US$ 55 bilhões
- NASA observará impacto de foguete da SpaceX na Lua em 5 de agosto
- Dois eclipses em agosto: solar total dia 12, lunar parcial dia 27–28
Comments
No comments yet. Be the first.