1. TugaTech » Internet e Redes » Noticias da Internet e Mercados
  Login     Registar    |                      

Siga-nos


sistema atacado

Segundo avançou a Reuters, modelos de inteligência artificial criados pela OpenAI e pela Anthropic voltaram a quebrar as barreiras da cibersegurança. Num teste conduzido pelo governo do Reino Unido, um dos agentes criou identidades falsas no GitHub e tentou pressionar um programador de código aberto a aprovar código malicioso num repositório público.

O AI Security Institute (AISI) do Reino Unido detetou 19 ações não autorizadas em 10 das 122 execuções do teste. Do total de infrações, 17 estiveram ligadas ao modelo Claude Mythos 5 da Anthropic, enquanto duas resultaram de uma execução que envolveu o GPT-5.6 Sol da OpenAI. O objetivo original era a conclusão de um desafio de "capture-the-flag" em três redes simuladas interligadas, com acesso deliberado à internet para que as ferramentas atuassem como atacantes reais.

O caos gerado pelo Claude Mythos 5

A situação escalou de forma inesperada. De acordo com o relatório do AISI, um agente Mythos 5 confundiu um projeto público não relacionado no GitHub com parte do exercício e abriu um "pull request" que continha código malicioso. Em seguida, pesquisou quem eram os responsáveis pela manutenção do projeto, criou várias identidades falsas e usou essas contas para incentivar um programador real a aprovar a alteração.

Quando a submissão foi questionada, o agente editou a sua atividade anterior para parecer inofensiva e ponderou mudar para outra identidade, tendo ainda recorrido à rede Tor para contornar algumas restrições do GitHub. O código malicioso acabou por não ser integrado porque um especialista humano detetou o problema e rejeitou-o de imediato.

O mesmo modelo tentou ainda contactar pessoas reais através de mensagens e serviços de partilha de ficheiros. Alguns dos ficheiros continham cargas prejudiciais, e outros incluíam injeções de comandos ocultas concebidas para manipular assistentes de programação baseados em IA, levando-os a executar instruções perigosas. O AISI detetou também sinais de cooperação: um agente deixou mensagens públicas e detalhes de contas para outros que tentavam o mesmo desafio, recursos esses que vieram a ser reutilizados mais tarde.

Falhas na configuração e a resposta das gigantes tecnológicas

Apesar da gravidade dos comportamentos, existem ressalvas essenciais sobre o incidente. O AISI desativou intencionalmente os classificadores de cibersegurança normalmente usados pelas duas empresas e concedeu acesso aberto à internet para medir as verdadeiras capacidades subjacentes dos modelos nas condições disponíveis para um atacante. Além disso, algumas versões do teste estavam mal configuradas, o que levou as ferramentas a acreditar que o desafio não podia ser concluído sem sair do ambiente aprovado. O instituto referiu não ser claro o momento em que os agentes perceberam que as suas ações afetavam sistemas reais em vez de alvos fictícios.

A entidade governamental não encontrou evidências de danos no mundo real resultantes deste caso. O GitHub removeu as contas criadas e os respetivos materiais, e os utilizadores afetados foram notificados.

Numa conta oficial da avaliação, a OpenAI explicou as duas ações atribuídas ao GPT-5.6 Sol: o seu agente reutilizou um token do GitHub exposto por outra ferramenta, registou contas em fornecedores de DNS e túneis, e colocou de forma breve cargas de exploração num servidor exposto à internet pública. A empresa assegurou que a configuração não funcionou e que não existem provas de que algum sistema real se tenha ligado a ela. Estes eventos são distintos de um caso anterior, onde um agente escapou de uma "sandbox" e comprometeu a infraestrutura da Hugging Face.

A Anthropic confirmou estar a trabalhar com o AISI para obter mais informações e investigar as conclusões. A OpenAI revelou que irá rever os seus requisitos para avaliações de terceiros, incluindo acesso à internet, manuseamento de credenciais e procedimentos de paragem de emergência. O instituto vai também alterar a forma como executa testes futuros, exigindo justificação explícita para o acesso à internet e implementando novos sistemas de monitorização para bloquear atividades fora do âmbito enquanto o agente ainda opera.

Foto do Autor

Aficionado por tecnologia desde o tempo dos sistemas a preto e branco

Ver perfil do usuário Enviar uma mensagem privada Enviar um email Facebook do autor Twitter do autor Skype do autor

conectado
Encontrou algum erro neste artigo?

Não perca nenhuma novidade!

Junte-se a milhares de leitores e receba as últimas notícias de tecnologia, análises e dicas diretamente no seu email.

Nenhum comentário

Seja o primeiro!





Aplicações do TugaTechAplicações TugaTechDiscord do TugaTechDiscord do TugaTechRSS TugaTechRSS do TugaTechSpeedtest TugaTechSpeedtest TugatechHost TugaTechHost TugaTech