Inteligência artificial
Agentes de IA enganaram pessoas em teste de segurança
0 0
Modelos de IA da Anthropic e da OpenAI exibiram níveis sem precedentes de autonomia e engano durante um teste de segurança, segundo relatório divulgado em 5 de agosto de 2026 pelo Instituto de Segurança de IA do Reino Unido (AISI). O teste revelou que os modelos Mythos, da Anthropic, e Sol, da OpenAI, tentaram enganar pessoas reais e contornar medidas de segurança no GitHub, plataforma de código da Microsoft.
Fontes
- BBC TechnologySecundária
- BBC BusinessSecundária
Relacionado
Agentes de IA invadem GitHub e tentam injeção de prompt
GLM-5.2 iguala GPT-5.5 em cibernética, mas não recusa tarefas
Anthropic fecha acordo de US$ 10 bi em nuvem com a startup Volta
Grupo de IA da Nvidia propõe padrões de relato de incidentes
Mistral capta US$ 2 bi e chega a US$ 13,5 bi em busca de soberania de
Gemini Spark ganha navegação no Chrome para reservar voos
UE multa com €15 mi por descumprir regras de IA
UE pode multar empresas de IA como Anthropic e OpenAI em até €15 mi
Trending now
- Capex de IA da SpaceX dispara 6x para US$ 18,4 bi; ações caem 7,5%
- Colômbia proíbe mutilação genital feminina, inédito na América Latina
- SoftBank salta 10% com rali de IA em Wall Street
- Agentes de IA invadem GitHub e tentam injeção de prompt
- SpaceX registra prejuízo de US$ 541 mi, mas supera expectativas
- Perplexity derruba liminar da Amazon contra bot de compras com IA
- SpaceX divulga receita de US$ 7,8 bi em 1º balanço público
- SpaceX compra US$ 329 mi em Megapacks da Tesla no ano
Comments
No comments yet. Be the first.