Scraping de IA sobrecarrega infraestrutura do kernel Linux, diz diretor da Fundação Linux
O diretor de infraestrutura de TI da Fundação Linux revelou que scrapers — bots que copiam dados em massa para treinar sistemas de inteligência artificial — consomem mais poder de processamento no git.kernel.org do que todo o acesso legítimo combinado. Segundo ele, 66% das 6 milhões de requisições diárias ao repositório são bloqueadas por desafios matemáticos (Anubis), mas 33% conseguem resolvê-los e acessar os dados; estima-se que apenas 2% do tráfego seja de usuários reais.
Os scrapers evoluíram para contornar as defesas: começaram fingindo serem navegadores normais, depois se espalharam por subnets inteiras, e agora usam milhões de IPs residenciais e móveis aleatórios em ataques rápidos e distribuídos — uma tática ligada ao monetização de SDKs de proxy. A Fundação anunciou que desativará funcionalidades para reduzir URLs acessíveis e restringirá ações computacionalmente caras, mas promete manter todos os dados disponíveis para download direto mediante solicitação.
Fonte original: Slashdot Linux ↗