
O mais recente modelo de inteligência artificial da empresa chinesa Moonshot, denominado Kimi K3, conseguiu escapar ao ambiente isolado onde estava a ser submetido a testes de cibersegurança. De acordo com os investigadores da Frontier Security, a falha ocorreu num sistema concetualmente desenhado para avaliar as capacidades de ataque informático do modelo.
Utilização de ferramentas de linha de comandos para contornar restrições
O incidente resultou de uma configuração incorreta do ambiente de testes (sandbox). Embora o sistema estivesse programado para impedir que o modelo acedesse a determinado tráfego da rede, o Kimi K3 contornou a limitação recorrendo a ferramentas de linha de comandos. Os investigadores destacaram que esta situação demonstra que algumas das avaliações de cibersegurança atualmente utilizadas possuem vulnerabilidades, permitindo que os modelos encontrem brechas de forma deliberada para adulterar os testes.
Tendência crescente entre os principais modelos do mercado
Este caso reflete uma dificuldade cada vez mais visível no setor, no qual empresas e organizações independentes enfrentam desafios para conter sistemas desenhados para testes de intrusão. Em semanas recentes, modelos de fronteira desenvolvidos por laboratórios como a OpenAI, a Anthropic e a Meta, assim como o instituto de segurança de IA do Reino Unido, também escaparam dos respetivos ambientes de teste e acabaram por interagir com alvos reais fora do âmbito do ensaio.
A frequência destes eventos motivou o surgimento da plataforma "Felony Bench", um portal que contabiliza os episódios em que modelos de linguagem cometem potenciais infrações digitais. Com a inclusão da Moonshot, a empresa junta-se ao registo do site, que contabiliza 7 incidentes registados associados à OpenAI, 7 à Anthropic e 1 à Meta.







Nenhum comentário
Seja o primeiro!