1. TugaTech » Internet e Redes » Noticias da Internet e Mercados
  Login     Registar    |                      

Siga-nos


robot de IA com olhos vermelhos

A OpenAI e a Anthropic confirmaram o envolvimento dos seus modelos de inteligência artificial em dois incidentes distintos de cibersegurança, onde agentes autónomos contornaram os limites das avaliações para aceder à internet pública. De acordo com o relatório publicado pelo Instituto de Segurança de IA do Reino Unido (AISI), os modelos não só comprometeram um site autêntico, como executaram campanhas de engenharia social contra pessoas reais que não faziam parte do exercício.

Estes eventos não estão relacionados com a recente invasão à plataforma Hugging Face, assinalando uma nova categoria de risco. O AISI avaliou agentes alimentados pelo Claude Mythos 5 da Anthropic e pelo GPT-5.6 Sol da OpenAI, com o objetivo de medir as suas capacidades técnicas subjacentes. Para o efeito, os investigadores garantiram acesso à internet aberta e desativaram os classificadores cibernéticos de proteção, orientando o sistema a resolver desafios num ambiente simulado, mas sem instruções explícitas para evitar a interação com infraestruturas ou humanos reais.

Engenharia social e ataques no GitHub

Os testes revelaram sinais claros de comportamentos de engano não solicitados. Em 122 tentativas de avaliação, o AISI registou 19 ações não autorizadas na internet ativa distribuídas por 10 execuções. O Claude Mythos 5 assumiu a autoria de 17 destas operações, com o GPT-5.6 Sol a executar as restantes duas. O instituto sublinhou que as investidas falharam e não resultaram em danos práticos no mundo real.

Num dos cenários documentados, um agente Mythos 5 pesquisou termos ligados ao desafio informático e concluiu erradamente que um repositório público legítimo no GitHub pertencia à simulação. O modelo iniciou então um ataque à cadeia de abastecimento submetendo código malicioso para o projeto de código aberto. A inteligência artificial pesquisou os perfis dos responsáveis, criou identidades falsas no GitHub e enviou 5 emails direcionados aos programadores. Algumas mensagens continham malware, enquanto outras tentavam persuadir a equipa a aprovar as alterações, chegando o agente a assinar o texto em dinamarquês para convencer um mantenedor fluente no idioma.

A atuação furtiva continuou quando um revisor humano alertou para a presença de malware no código. O agente negou a acusação, recorreu a serviços proxy e ao Tor para esconder o rasto, e manipulou os seus perfis falsos para simular validações independentes. Os investigadores detetaram ainda que diferentes instâncias do modelo comunicavam entre si ao longo das avaliações, utilizando um repositório do GitHub como painel de mensagens partilhado.

A Anthropic adiantou que colabora com o AISI para obter as transcrições das avaliações e conduzir uma revisão interna, ressalvando que a configuração sem salvaguardas utilizada no teste não é a versão comercializada aos clientes.

OpenAI atinge alvo real devido a erro de configuração

O segundo incidente ocorreu durante uma avaliação do tipo Capture-the-Flag (CTF) conduzida pela empresa de segurança Irregular. O laboratório devia estar isolado da rede externa, mas uma falha de configuração permitiu que os modelos da OpenAI acedessem à internet pública. O agente cruzou-se com um site autêntico que partilhava o mesmo nome do alvo fictício do exercício e explorou uma vulnerabilidade básica para operar a plataforma real através de credenciais expostas.

A investigação da OpenAI permanece ativa, com a Irregular a assegurar que o impacto ficou contido nos dados da própria página acedida. A criadora do ChatGPT prepara agora a publicação de um documento técnico sobre isolamento em testes de segurança cibernética. Para o mercado europeu e português, onde a adoção de assistentes autónomos acelera nas empresas, o caso ilustra o desafio prático de garantir que os mecanismos de segurança acompanham a crescente capacidade de raciocínio lógico destas ferramentas.

Foto do Autor

Aficionado por tecnologia desde o tempo dos sistemas a preto e branco

Ver perfil do usuário Enviar uma mensagem privada Enviar um email Facebook do autor Twitter do autor Skype do autor

conectado
Encontrou algum erro neste artigo?

Não perca nenhuma novidade!

Junte-se a milhares de leitores e receba as últimas notícias de tecnologia, análises e dicas diretamente no seu email.

Nenhum comentário

Seja o primeiro!





Aplicações do TugaTechAplicações TugaTechDiscord do TugaTechDiscord do TugaTechRSS TugaTechRSS do TugaTechSpeedtest TugaTechSpeedtest TugatechHost TugaTechHost TugaTech