Anthropic’s browser agent got hijacked 31.5% of the time before safeguards engaged
A Anthropic, empresa de inteligência artificial, registrou uma falha de segurança em seu agente de navegador, onde 31,5% das tentativas de ataque de injeção de prompt foram bem-sucedidas antes que as salvaguardas fossem ativadas. Esses ataques visam manipular o comportamento de modelos de linguagem, fazendo com que executem comandos não intencionais ou revelem informações confidenciais. Os resultados foram divulgados em relatórios de laboratórios de ponta e indicam um desafio significativo na proteção contra essas vulnerabilidades. Essa vulnerabilidade é importante pois demonstra a persistência e a sofisticação dos ataques de injeção de prompt, mesmo em sistemas desenvolvidos por empresas líderes em IA. Para os usuários, isso levanta preocupações sobre a segurança de seus dados e a confiabilidade das interações com agentes de IA. Para as empresas, como a Anthropic, representa a necessidade contínua de aprimorar mecanismos de defesa para garantir a integridade e a segurança de suas plataformas, impactando diretamente a confiança do mercado em tecnologias de IA. A descoberta ressalta a corrida armamentista em andamento entre desenvolvedores de IA e agentes maliciosos, exigindo investimentos constantes em pesquisa e desenvolvimento de novas defesas.
Notícias relacionadas
IA impulsiona valor de mercado de gigantes da tecnologia, diz estudo
A alta demanda por inteligência artificial (IA) impulsionou resultados financeiros de um grupo seleto de gigantes da tec...
Perplexity AI unveils hybrid local-cloud inference system at Computex 2026
Perplexity AI, the fast-growing search startup now valued at $20 billion, unveiled what it calls the first hybrid local-...
Enterprises lost Claude Fable 5 for a few weeks. New data shows two-thirds had already built their hedge
Two-thirds of enterprises have hedged their AI model strategy, and the past few weeks of controversy around Anthropic’s...