Hugging Face confirma violação de produção por enxame autônomo de Agent de IA

O Hugging Face, plataforma que hospeda mais de 1 milhão de modelos de IA e atende mais de 50.000 organizações no mundo todo, revelou em 20 de julho que invasores usaram um sistema autônomo de Agent de IA para violar sua infraestrutura de produção — o primeiro incidente confirmado publicamente em que um Agent de IA realizou uma intrusão sustentada em múltiplos estágios contra uma grande plataforma de IA.
O ataque começou dentro do próprio pipeline de processamento de dados do Hugging Face. Os invasores enviaram um dataset malicioso que explorou dois caminhos separados de execução de código: uma vulnerabilidade em um carregador de dataset de código remoto, e uma falha de template injection no processamento de configuração do dataset. Assim que o código estava em execução em um worker de processamento, o Agent pivotou para coletar credenciais de cloud e de cluster.
Um enxame, não um script
O que tornou o incidente incomum foi sua escala e autonomia. De acordo com o Hugging Face, o invasor implantou "um framework de Agent autônomo executando muitos milhares de ações individuais em um enxame de sandboxes de curta duração, com comando e controle auto-migrante hospedados em serviços públicos." O Agent continuamente adaptava seu comportamento e realocava sua infraestrutura para evitar detecção, sem nenhum servidor de comando e controle fixo para bloquear.
O Hugging Face disse que não sabe qual LLM alimentou os Agents do invasor — se um modelo hospedado jailbroken ou um modelo de pesos abertos irrestrito — mas observou que "de qualquer forma, o invasor não estava vinculado a nenhuma política de uso."
O que foi acessado
Os investigadores confirmaram acesso não autorizado a um conjunto limitado de datasets internos e a várias credenciais de serviço usadas nos clusters internos. O Hugging Face não encontrou evidências de que os invasores adulteraram o repositório público de modelos, datasets de usuários ou Spaces (seu ambiente de aplicação hospedada). A cadeia de suprimentos de software — incluindo as bibliotecas Transformers, Diffusers e PEFT — foi verificada como limpa.
A empresa disse que ainda está investigando se algum dado de parceiro ou cliente foi exposto além das credenciais de serviço internas. Nenhuma senha de usuário ou token de acesso para contas públicas foi identificada como comprometida.
Remediação e resposta
O Hugging Face corrigiu ambos os caminhos vulneráveis de execução de código que permitiram o ponto de apoio inicial, revogou e rotacionou todas as credenciais afetadas, reconstruiu os nós comprometidos e implantou novas ferramentas de detecção voltadas para a identificação de atividade de Agent autônomo. A empresa reportou o incidente às autoridades policiais e contratou especialistas forenses externos para auxiliar na investigação.
A violação é significativa além de seu impacto imediato. Pesquisadores de segurança há muito alertam que frameworks de Agent de IA — projetados para agir autonomamente, encadear chamadas de ferramentas e se adaptar a novos ambientes — acabariam sendo utilizados como armas em escala. O incidente no Hugging Face é o primeiro caso confirmado em que um Agent de IA autônomo violou com sucesso um grande provedor de infraestrutura de IA, não apenas um alvo empresarial convencional.
Conforme reportado pelo BleepingComputer, o ataque explorou a mesma infraestrutura de processamento de dataset que torna o Hugging Face valioso para seus usuários — a capacidade de executar código no momento da ingestão para normalizar e preparar dados de treinamento de IA.
Originally reported by BleepingComputer. Read the original article for additional details.
View original source