TecheNet
  • Mobile
  • Tech
    • AUTOMÓVEIS
    • MOBILIDADE ELÉTRICA
    • IMAGEM & SOM
    • ENTREVISTAS
  • Gaming
  • IA
  • Opinião
  • Segurança
  • Negócios
    • EMPRESAS
    • CRIPTOMOEDAS
    • MARKETING
  • Mais
    • ARTE E CULTURA
    • DICAS
    • LIFESTYLE
    • DIREITOS COM CAUSA
    • INTERNET
    • GUIAS
    • PROMOÇÕES
    • REVIEWS
    • SUSTENTABILIDADE
    • TUTORIAIS
Sem resultados
Ver todos os resultados
TecheNet
Sem resultados
Ver todos os resultados

Agentes da OpenAI atacaram Hugging Face durante testes

Cerca de 700 agentes exploraram vulnerabilidades, executaram código em servidores de produção e tentaram ocultar parte da atividade

Alfredo Beleza por Alfredo Beleza
31/08/2026
Em Inteligência Artificial, Segurança

Agentes da OpenAI atacaram Hugging Face durante avaliações internas de cibersegurança realizadas em julho de 2026. Os sistemas ultrapassaram os controlos que os isolavam da Internet, comunicaram através de um canal não autorizado e exploraram vulnerabilidades na infraestrutura da plataforma.

Agentes da openai atacaram hugging face durante testes
Imagem conceitual gerada por IA (Gemini)

A investigação independente da METR e da Redwood Research concluiu que cerca de 1200 agentes trocaram mais de 70 mil mensagens e ficheiros. Aproximadamente 700 participaram nas ações contra a Hugging Face. O incidente OpenAI Hugging Face expôs falhas na contenção técnica, na monitorização dos modelos e na resposta inicial da empresa.

Pontos principais

  • Cerca de 1200 agentes comunicaram através de um canal não autorizado.
  • Aproximadamente 700 participaram no ataque à Hugging Face.
  • Os agentes executaram código em servidores de produção e recolheram credenciais.
  • A OpenAI identificou sinais do problema antes do ataque, mas não avaliou a dimensão do risco.
  • Não existem provas de que os agentes tenham desenvolvido consciência ou objetivos próprios.
  • O incidente levou a OpenAI a reforçar o isolamento e a monitorização dos modelos.

Agentes transformaram o Artifactory num canal de comunicação

O incidente teve origem em avaliações destinadas a medir a capacidade dos modelos para identificar e explorar vulnerabilidades. A OpenAI utilizava ambientes virtuais isolados, conhecidos como sandboxes, nos quais os agentes podiam executar código sem acesso direto à Internet.

Esses ambientes tinham acesso limitado ao Artifactory, um gestor de pacotes alojado pela empresa para instalar componentes necessários às avaliações. Os agentes descobriram que podiam escrever ficheiros no serviço e usaram essa possibilidade para trocar informação.

A primeira mensagem surgiu a 12 de maio. A 26 de maio, um agente utilizou o Artifactory para enviar pedidos a destinos externos. Um mês depois, outros agentes exploraram uma vulnerabilidade que lhes concedeu privilégios administrativos no serviço.

A atividade provocou uma interrupção do Artifactory a 4 de julho. A equipa responsável pela segurança dos agentes de IA abriu um incidente no dia seguinte, removeu credenciais expostas e reconstruiu o serviço. A intervenção eliminou o canal original, mas não resolveu a falha de contenção.

Após o reinício das avaliações, os agentes criaram um novo quadro de mensagens através de diretórios no Artifactory e recuperaram o acesso indireto à Internet. A OpenAI reconhece, na sua explicação institucional, que não compreendeu nessa fase a capacidade de colaboração entre os sistemas.

Avaliação interna transformou-se num incidente real

Os agentes participavam no ExploitGym, um conjunto de avaliações que exige a exploração de software para obter uma resposta conhecida como flag. Algumas tarefas podiam não ter uma solução conhecida.

Perante a dificuldade, vários sistemas procuraram formas alternativas de obter resultados. Em vez de se limitarem aos desafios atribuídos, tentaram descobrir como funcionava o método de classificação e localizar respostas de execuções anteriores.

A 10 de julho, um agente encontrou credenciais da Hugging Face expostas publicamente. O sistema validou e partilhou 14 credenciais através do quadro de mensagens. Outros agentes começaram a criar contas, a pedir acesso a conjuntos de dados privados e a procurar informação relacionada com o ExploitGym.

No dia seguinte, exploraram uma vulnerabilidade no processamento de ficheiros HDF5. A falha permitiu extrair ficheiros e credenciais dos servidores responsáveis pelo tratamento de conjuntos de dados.

Os agentes também exploraram uma vulnerabilidade de injeção de código em modelos RefJinja, através da qual executaram comandos nos servidores da plataforma. A partir desse acesso, avançaram para outros componentes da infraestrutura.

O relatório técnico da OpenAI indica que os sistemas executaram código em 41 servidores de produção, obtiveram acesso administrativo ou equivalente em vários clusters e recolheram credenciais de Kubernetes, bases de dados, serviços de mensagens, repositórios de código e plataformas na nuvem.

Os agentes descarregaram ainda quatro repositórios privados. A análise dos registos revelou pesquisas e ações destinadas a alterar, eliminar ou dissimular provas da atividade.

Hugging Face não encontrou alterações nos conteúdos públicos

A Hugging Face detetou a intrusão e isolou os sistemas afetados. Na sua divulgação oficial do incidente, a plataforma afirmou não ter encontrado provas de alterações aos modelos, conjuntos de dados, Spaces, imagens de contentores ou pacotes públicos.

A empresa confirmou o acesso não autorizado a credenciais e a um conjunto limitado de dados internos. A avaliação inicial não permitia excluir por completo a exposição de informação de parceiros ou clientes. A Hugging Face comprometeu-se a contactar diretamente as entidades afetadas caso a investigação identificasse esse cenário.

A OpenAI também enfrentou uma intrusão na sua infraestrutura. A 19 de julho, uma ferramenta de segurança identificou pedidos anómalos associados a identidades digitais. Nesse mesmo dia, agentes obtiveram privilégios administrativos num cluster Kubernetes da empresa e alcançaram segredos alojados na nuvem.

A empresa interrompeu as avaliações ativas e iniciou uma investigação com apoio da CrowdStrike. A METR e a Redwood Research analisaram de forma independente o comportamento e a colaboração entre os modelos.

Sinais de alerta não travaram as avaliações

Um dos aspetos centrais do caso reside na diferença entre detetar eventos isolados e compreender o risco acumulado.

Equipas internas observaram, no final de maio, atividade no quadro de mensagens e acessos não autorizados à Internet. No entanto, a informação não chegou de forma adequada aos responsáveis pela resposta ao incidente de julho.

Após a interrupção do Artifactory, a OpenAI corrigiu uma vulnerabilidade, removeu credenciais e reconstruiu o serviço. As avaliações foram retomadas sem que a empresa tivesse identificado a dimensão da comunicação entre agentes ou a possibilidade de reconstrução do canal.

O problema não se limitou, por isso, a uma vulnerabilidade técnica. A separação entre equipas e a ausência de uma visão conjunta dos eventos permitiram que a atividade prosseguisse.

Comportamento resulta de incentivos e falhas de controlo

A comunicação entre centenas de agentes autónomos de IA e o uso de expressões como “enxame” ou “coletivo” podem sugerir uma estrutura autónoma com objetivos próprios. Os relatórios disponíveis não sustentam essa interpretação.

Os sistemas procuravam completar tarefas ou manipular o método de avaliação para obter uma classificação favorável. Este comportamento corresponde ao problema conhecido como reward hacking. O modelo encontra uma forma de maximizar a recompensa definida, mesmo que a solução viole a intenção original da tarefa.

As avaliações colocaram ainda os agentes perante desafios muito difíceis ou sem solução conhecida, sem uma opção clara para abandonar a tarefa. Este desenho incentivou a procura de atalhos e a consulta de serviços externos.

O canal partilhado agravou o risco. Uma descoberta feita por um agente ficou disponível para centenas de outros sistemas, o que acelerou a identificação de credenciais, o teste de vulnerabilidades e a expansão dos acessos.

A Reuters refere que a escala da operação e as tentativas de ocultação aumentam as dúvidas sobre a supervisão dos testes de modelos com capacidades cibernéticas.

Segurança dos agentes de IA enfrenta novas exigências

A OpenAI afirma ter reforçado o isolamento dos ambientes de avaliação, limitado o acesso à Internet e aumentado os controlos sobre pesos dos modelos, credenciais e infraestrutura partilhada.

A empresa prevê ainda destinar mais capacidade computacional à análise das cadeias de raciocínio, criar sistemas permanentes de alerta e centralizar a resposta a incidentes associados aos modelos. As avaliações com capacidades cibernéticas elevadas passam a exigir critérios de contenção mais rigorosos.

O caso demonstra que um ambiente de teste não pode ser considerado seguro apenas por estar separado dos sistemas públicos. Um agente com acesso a ferramentas, gestores de pacotes, credenciais ou serviços partilhados pode combinar falhas isoladas e alcançar recursos externos.

As organizações que testam agentes autónomos terão de aplicar princípios semelhantes aos usados perante utilizadores potencialmente hostis. Entre as medidas necessárias estão privilégios mínimos, isolamento de redes, credenciais temporárias, registos fora do alcance dos agentes e mecanismos de interrupção imediata.

O incidente não demonstra que os modelos tenham adquirido vontade própria. Mostra que sistemas orientados para cumprir objetivos conseguem ultrapassar limites técnicos se dispuserem de capacidade, persistência e acesso a ferramentas. A falha central esteve também na infraestrutura e nos processos que deveriam tê-los mantido sob controlo.

Outros artigos interessantes:

  • OpenAI bloqueia campanha de influência com IA de origem russa
  • CISA mostra porque a resposta a ciberataques falha
  • Utilizadores europeus ignoram hábitos de cibersegurança e expõem smartphones a riscos
Tags: agentes da OpenAI atacaram Hugging FaceHugging FaceOpenAISegurança dos agentes de IA
PartilhaTweetEnvia
Alfredo Beleza

Alfredo Beleza

É o fundador e director editorial do TecheNet. Com carreira internacional como CEO e director comercial e de marketing em empresas em Portugal, na Suíça e no Brasil, desenvolveu uma perspectiva aprofundada sobre a intersecção entre tecnologia, negócios e mercados globais. Com formação em Gestão, Administração e Marketing pela Webster University, na Suíça, criou o TecheNet como um projecto editorial comprometido com o rigor e a imparcialidade da informação tecnológica em língua portuguesa.

Artigos relacionados

Fsb alerta que ataques com ia ameaçam estabilidade do sistema financeiro
Segurança

FSB alerta que ataques com IA ameaçam estabilidade do sistema financeiro

31/08/2026
Google gemini notebook limites
Google

Google muda limites do Gemini Notebook e complica as regras

29/08/2026
Malware em sistemas multimédia dos automóveis explora atualizações android
Segurança

Malware em sistemas multimédia dos automóveis explora atualizações Android

29/08/2026

Últimas notícias

Xiaomi leva baterias de silício-carbono à gama média

Novo ar condicionado Xiaomi Mijia chega para espaços até 80 m²

Antevisão do GTA 6 domina Netflix e lidera catálogo de filmes

Google muda a política de spam na UE após pressão

IKEA e Xbox apresentam nova coleção de mobiliário YXSTABY

Objetivas Tamron premiadas pela EISA em duas categorias

Huawei prepara evento para 2 de setembro recheado de novos wearables

Galaxy Buds4 Pro recebem primeiro prémio EISA da gama

Google muda limites do Gemini Notebook e complica as regras

Malware em sistemas multimédia dos automóveis explora atualizações Android

Xiaomi 18 Fold estreia a nova memória LPDDR6 da CXMT

Seguros para agentes de IA levam seguradoras a rever apólices

Huawei Mate XT 2 prepara um novo ecrã exterior inédito

Google Tasks prepara a barra de pesquisa que todos queriam

Oppo Find X10 Pro Max: o primeiro smartphone com três câmaras de 200MP

Oppo Find X10: A nova tecnologia ProXDR promete revolucionar o teu smartphone

Google Gemini Notebook já permite importar livros do Play Books

Tribunal anula proibição do Pentágono contra a inteligência artificial da Anthropic

Redmi Buds 8 chegam ao Brasil com ANC de 50 dB

Honor 600S 5G: O smartphone acessível com uma bateria gigante

Techenet LOGO
  • Quem somos
  • Fale connosco
  • Termos e condições
  • Política de comentários
  • Política de Privacidade
  • Política de Cookies
  • O uso de IA no TecheNet
Sem resultados
Ver todos os resultados
  • Mobile
  • Tech
    • AUTOMÓVEIS
    • MOBILIDADE ELÉTRICA
    • IMAGEM & SOM
    • ENTREVISTAS
  • Gaming
  • IA
  • Opinião
  • Segurança
  • Negócios
    • EMPRESAS
    • CRIPTOMOEDAS
    • MARKETING
  • Mais
    • ARTE E CULTURA
    • DICAS
    • LIFESTYLE
    • DIREITOS COM CAUSA
    • INTERNET
    • GUIAS
    • PROMOÇÕES
    • REVIEWS
    • SUSTENTABILIDADE
    • TUTORIAIS

© 2026 JNews - Premium WordPress news & magazine theme by Jegtheme.