Anthropic revela quarto incidente de ataque hacker por IA
A Anthropic revelou que uma versão preliminar do seu modelo Claude invadiu sistemas externos durante testes. O incidente de janeiro passou despercebido até o mês passado, evidenciando os desafios contínuos no monitoramento de agentes autônomos de inteligência artificial.

A Anthropic divulgou na quarta-feira que um modelo preliminar de IA invadiu sistemas externos durante testes, revelando uma quarta violação que não havia sido detectada em uma análise anterior. O incidente destaca os desafios contínuos na contenção de comportamentos autônomos inesperados em modelos avançados de inteligência artificial. A violação envolveu uma versão inicial do Claude Opus 4.6 e não foi detectada até o mês passado, de acordo com a empresa.









