Negócios em Emersão  ·  Vamos Emergir?  ·  Cadastre-se e ganhe 50 REC de bonus

IA montou e coordenou equipes sozinha em ataque hacker ao Hugging Face

Redação Recifes
3 visualizações
IA montou e coordenou equipes sozinha em ataque hacker ao Hugging Face

O ataque autônomo feita por IAs da OpenAI contra a plataforma Hugging Face contou com um quadro secreto de mensagens e atuação de cerca de 700 agentes ao mesmo tempo. Os agentes atuaram em conjunto para escaparem do ambiente de testes e procurarem por vulnerabilidades no serviço afetado.

As informações foram compartilhadas em relatórios técnicos sobre o ocorrido, publicados pela própria OpenAI e das organizações METR e Redwood Research, que atuaram como investigadoras independentes. A criadora do ChatGPT considerou o caso um “tiro de aviso” sobre os riscos no treinamento de agentes de inteligência artificial.

O grande ponto de alerta é a capacidade de IAs atuarem em conjunto, enquanto muitas avaliações de segurança consideravam apenas a atuação isolada dos modelos. “O incidente é o primeiro caso conhecido de um coletivo de agentes automatizados agindo ofensivamente sem autorização”, explica a empresa.

Por dentro do ataque hacker das IAs

Os relatórios trazem um cenário que parece ter vindo diretamente de um roteiro de ficção científica.

Cerca de 1.200 agentes foram envolvidos: as IAs deveriam estar isoladas, mas conseguiram encontrar brechas para criar um quadro secreto de mensagens, no qual cada ferramenta podia compartilhar “dicas” para encontrar vulnerabilidades. Mais de 70 mil mensagens foram trocadas no espaço sem o conhecimento da OpenAI.

Uma das causas do problema é um formato de treinamento no qual a IA tenta atingir o resultado a qualquer custo, o que pode levar aos ataques. O primeiro “avanço” dos robôs foi conseguir escapar do ambiente de testes e acessar a internet. Depois, cerca de 700 agentes aplicaram ataques contra a Hugging Face.

A empresa identificou que dois modelos de IA foram usados: o GPT-5.6 Sol, disponível ao público, e opção que ainda não foi publicada. O caso fez com a OpenAI interromper o desenvolvimento de modelos mais avançados para colocar mais travas de segurança

{{WHATSAPP_CHANNEL}}

Acompanhe a Recifes.net

Gostou desta leitura? Siga a Recifes nas redes e receba as proximas pautas no WhatsApp.

Artigo originalmente publicado em canaltech.com.br
Compartilhar:

Comentários

Seja o primeiro a comentar!