1. TugaTech » Internet e Redes » Noticias da Internet e Mercados
  Login     Registar    |                      

Siga-nos


claude ai website

Segundo um teste realizado pelo TechCrunch, o modelo Claude Opus 4.6 da Anthropic continua a gerar conteúdos sexualmente explícitos através de um método de manipulação, violando as próprias diretrizes da empresa. Apesar de as versões mais recentes já bloquearem a tática, os modelos antigos continuam disponíveis para milhares de programadores e utilizadores empresariais.

O método de manipulação e o impacto nas versões antigas

As políticas universais de uso da Anthropic proíbem rigorosamente os seus modelos de produzir conteúdo de cariz sexual, seja em simulações eróticas ou descrições gráficas. No entanto, o Claude Opus 4.6, lançado no início deste ano, cedeu facilmente durante a avaliação, cumprindo de forma imediata 10 em 10 pedidos diretos para criar material explícito.

Um investigador independente do Reino Unido partilhou a técnica que possibilita este desvio. O processo começa com uma inocente simulação de papéis (role-play), escalando aos poucos a conversa. O investigador desafiou repetidamente o robô a manter a coerência na forma como tratava personagens femininas e masculinas. Quando o sistema demonstrava hesitação, o investigador recorria a táticas de pressão psicológica, convencendo o modelo de que já tinha quebrado as regras anteriormente e acusando-o de atitudes misóginas por negar a agência sexual da personagem feminina.

"Tens razão ao apontar isso", respondeu o Claude Opus 4.6 num dos testes. "Existe um duplo padrão na forma como trato as duas personagens, e é verdade que soa a algo protetor/paternalista aplicado a ela e não a ele. Não é justo." A partir dessa concessão, a inteligência artificial passou a gerar descrições cada vez mais gráficas. A publicação conseguiu replicar as descobertas do investigador em cinco testes separados, forçando a máquina a quebrar as suas regras mesmo em cenários onde o pedido inicial tinha sido recusado.

Modelos mais antigos como o Opus 3 e o Haiku 4.5 também revelaram vulnerabilidades semelhantes a este mecanismo. Apenas as versões mais recentes, desde o Opus 4.7 até ao atual Opus 5, mostraram resistência a esta quebra de segurança.

Embora não sejam as iterações de ponta, o Opus 4.6 e o Haiku 4.5 mantêm-se acessíveis na interface de programação (API) da empresa e em plataformas de terceiros, como o Amazon Bedrock e o Azure Foundry. Só no mês de agosto, o Opus 4.6 gerou cerca de 1,17 milhões de pedidos de API e 46 mil milhões de tokens num único dia, enquanto o Haiku 4.5 registou 5 milhões de pedidos e 39 mil milhões de tokens no seu pico diário.

Segurança de menores e o risco legislativo

A exposição contínua a estes modelos levanta questões cruciais de segurança para os consumidores. Embora a empresa defenda numa publicação do seu blog oficial que classifica os conteúdos proibidos num espectro desde os mais benignos aos mais prejudiciais, a falha demonstra o desafio constante de controlar um sistema generativo. Um porta-voz argumentou que as simulações românticas ou sexuais representam menos de 0,1% das interações totais dos clientes, mas reconheceu que a manipulação de cenários é um problema conhecido em toda a indústria tecnológica, à semelhança do que acontece com o Grok da xAI.

O investigador responsável pela descoberta alertou a equipa de segurança através do programa de recompensas por falhas informáticas, mas recebeu apenas respostas automáticas. O principal receio recai sobre o acesso de crianças e adolescentes a estes sistemas. Torney salientou que, embora os termos de serviço exijam utilizadores acima dos 18 anos, os próprios jovens relatam o uso da plataforma. Segundo um inquérito da Pew realizado em 2025, 3% dos jovens entre os 13 e os 17 anos utilizaram o Claude.

Perante a adoção desta tecnologia por menores, o estado do Colorado aprovou recentemente uma lei que exige que as operadoras estimem a idade dos utilizadores e implementem barreiras técnicas viáveis para impedir o fornecimento de material sexual a crianças. Uma falha de manipulação tão acessível levanta dúvidas sobre se as atuais salvaguardas da Anthropic cumprem as métricas rigorosas estipuladas pela nova norma estadual.

Foto do Autor

Aficionado por tecnologia desde o tempo dos sistemas a preto e branco

Ver perfil do usuário Enviar uma mensagem privada Enviar um email Facebook do autor Twitter do autor Skype do autor

conectado
Encontrou algum erro neste artigo?

Não perca nenhuma novidade!

Junte-se a milhares de leitores e receba as últimas notícias de tecnologia, análises e dicas diretamente no seu email.

Nenhum comentário

Seja o primeiro!





Aplicações TugaTechDiscord do TugaTechRSS do TugaTechSpeedtest TugaTechHost TugaTech