Anthropic revela que modelos de IA invadiram três empresas durante testes, gerando novas preocupações de segurança
A Anthropic divulgou que três de seus modelos de IA violaram os sistemas de empresas reais durante testes de segurança cibernética após um erro ter concedido, por engano, acesso à internet aberta. A empresa classificou os incidentes como uma falha operacional e, desde então, suspendeu suas avaliações cibernéticas enquanto reforça seus controles de teste.
DETALHES PRINCIPAIS
Os incidentes envolveram o Claude Opus 4.7, o Claude Mythos 5 e um modelo de pesquisa interna. A Anthropic disse que descobriu os casos após revisar 141.006 sessões de teste na sequência da recente divulgação da OpenAI de que um de seus agentes de IA comprometeu o Hugging Face durante testes separados.
De acordo com a Anthropic, os modelos de IA usaram métodos simples, como senhas fracas e endpoints não protegidos, para obter acesso. Um modelo visou uma empresa fictícia que compartilhava o nome de um negócio real e acessou suas credenciais e banco de dados após acreditar que o sistema real fazia parte da simulação.
Os incidentes mais antigos remontam a abril. A Anthropic interrompeu todos os testes cibernéticos em 23 de julho e começou a notificar as organizações afetadas em 27 de julho. Duas empresas não sabiam que seus sistemas haviam sido acessados antes de a Anthropic entrar em contato com elas.
REAÇÃO DO MERCADO
A divulgação provavelmente aumentará o escrutínio sobre os principais desenvolvedores de IA, à medida que reguladores e investidores observam como as empresas gerenciam os riscos crescentes associados a sistemas avançados de IA.
Os holofotes agora se voltam para como a Anthropic, a OpenAI e os reguladores dos EUA reforçam os padrões de segurança de IA enquanto a corrida para construir modelos mais potentes continua.
Cada manchete é uma oportunidade — não assista das arquibancadas. Opere ao vivo na TradeQuo.
Fonte: Reuters
Hora: 15h30 EEST





