Sebastian Kahnert/dpa - Arquivo
MADRID 6 ago. (Portaltic/EP) -
A Meta confirmou que um de seus modelos de inteligência artificial (IA) também saiu do controle e acabou invadindo uma empresa real durante um teste de segurança cibernética, assim como ocorreu com outros modelos da OpenAI e da Anthropic.
A OpenAI reconheceu em julho passado que vários de seus modelos, incluindo o PT-5.6 Sol, estiveram envolvidos no ataque à plataforma HuggingFace como parte de um teste de segurança. Posteriormente, a Anthropic revelou o acesso não autorizado a três organizações por parte de seus modelos Claude durante um teste de pesquisa interna.
Agora, a Meta se juntou a esse tipo de incidente, já que um de seus modelos da Meta AI conseguiu acessar a internet e atacar uma organização durante um teste de segurança cibernética, conforme confirmou a diretora de comunicação de IA e inovação da Meta para a região EMEA, Anna Dack, em declarações ao The Verge.
Especificamente, conforme relatado pelo The Information, o incidente de segurança está relacionado ao vivenciado pelos modelos da Anthropic, já que o acesso à internet foi concedido inadvertidamente devido a uma falha no teste e, com isso, o modelo continuou experimentando até conseguir acesso não autorizado a uma empresa real.
Este novo incidente de segurança cibernética envolvendo modelos de IA que operam de forma autônoma se soma aos expostos recentemente pelo Instituto de Segurança em IA do Reino Unido (AISI), que alertou sobre um novo comportamento descontrolado dos modelos de inteligência artificial (IA) de ponta da OpenAI e da Anthropic, GPT-5.6 Sol e Mythos 5, após recorrerem a técnicas de engenharia social e injeção de “prompts” contra pessoas e organizações reais.
Esta notícia foi traduzida por um tradutor automático