
A Google começou a aplicar uma nova medida de segurança no seu motor de pesquisa para impedir a recolha automatizada de conteúdos. Os utilizadores que acedam às pesquisas através de um separador em modo anónimo no navegador passam a ser redirecionados para uma página de segurança, onde é necessária a resolução de um CAPTCHA para prosseguir com a pesquisa.
Esta nova barreira junta-se a um conjunto de ferramentas reforçadas pela gigante tecnológica para combater a extração não autorizada de dados. Recentemente, a empresa já tinha implementado a encriptação dos URLs nos resultados de pesquisa, substituindo os endereços diretos por ligações únicas e temporárias que dificultam a recolha massiva por scripts automatizados.
Reforço da segurança contra bots e extração de dados
Com a obrigatoriedade do preenchimento de um CAPTCHA na navegação anónima, a Google bloqueia uma das vias mais utilizadas por ferramentas automatizadas para contornar restrições de sessão. Ao navegar em modo anónimo, os robôs de pesquisa evitam a associação a contas de utilizador ou ao histórico de cookies, o que tornava a extração de informação mais difícil de detetar pelas defesas habituais.
A utilização conjunta de ligações encriptadas e verificações humanas diretas cria um obstáculo significativo para as redes de scraping. O sistema identifica pedidos provenientes de sessões não autenticadas e exige a confirmação de que existe um utilizador real a realizar a pesquisa antes de devolver os resultados.
Motivos por trás das novas restrições da Google
O aumento drástico das ações de extração automatizada está diretamente associado ao crescimento dos sistemas de IA. Várias empresas e programadores recorrem a crawlers para recolher dados em tempo real e alimentar os seus modelos de linguagem ou motores de resposta alternativos, utilizando o índice de pesquisa da Google como fonte primária de informação.
Além da proteção dos conteúdos organizados no seu ecossistema e do respeito pelos direitos dos editores, a empresa procura conter o consumo excessivo de largura de banda. O tráfego gerado por bots de scraping coloca uma carga substancial sobre a infraestrutura sem gerar qualquer interação legítima, levando a gigante das pesquisas a adotar uma postura mais agressiva na defesa das suas páginas de resultados.







Nenhum comentário
Seja o primeiro!