Pesquisadores usaram Claude para invadir OpenAI e acessar repositório secreto

5 Min Read Tags:

Pesquisadores da Hacktron AI usaram o Claude, da Anthropic, para acessar a infraestrutura interna da OpenAI em 23 de julho de 2026, durante testes no programa de divulgação de vulnerabilidades da OpenAI. Os pesquisadores acessaram arquivos no Monorepo da OpenAI, que, segundo pessoas familiarizadas com a arquitetura da empresa, contém segredos algorítmicos que ajudam seus modelos a operar com mais rapidez e eficiência.

A OpenAI pagou aos pesquisadores uma recompensa de US$ 6.500 por vulnerabilidade depois que eles relataram o problema.

Uma equipe independente de pesquisadores da Hacktron AI usou o modelo Claude, da Anthropic, para obter acesso à infraestrutura interna da OpenAI, informou o The Wall Street Journal. O incidente ocorreu em 23 de julho de 2026, durante testes no programa de divulgação de vulnerabilidades da OpenAI, e expôs acesso a um repositório interno de código-fonte antes de os pesquisadores interromperem a operação e notificarem a empresa.

Claude gerou código para explorar falha em fórum

Os pesquisadores começaram com uma vulnerabilidade no Discourse, um serviço de terceiros que a OpenAI usa em seu fórum comunitário. Eles identificaram uma falha no tratamento de determinados arquivos de imagem e pediram a uma versão especial do Claude Opus 4.8, disponível para profissionais de cibersegurança qualificados, que escrevesse código capaz de explorá-la.

O código inicial não funcionou. Depois que a Anthropic lançou o Claude Opus 5, o modelo encontrou uma forma de usar a vulnerabilidade no dia seguinte. Seu código permitiu que os pesquisadores acessassem o servidor do Discourse, que armazenava tokens de autenticação de usuários.

Alguns tokens continuavam válidos para o ChatGPT e pertenciam a funcionários da OpenAI. Eles também forneciam acesso ao GitHub, onde a OpenAI mantém seu código-fonte.

Os pesquisadores puderam ler arquivos no repositório interno da OpenAI conhecido como Monorepo. Pessoas familiarizadas com a arquitetura da empresa disseram que o repositório contém alguns segredos algorítmicos que ajudam a tornar os modelos da OpenAI mais rápidos e eficientes. Acredita-se que o Monorepo não contenha pesos de modelos, os trilhões de números que sustentam modelos de linguagem de grande porte.

A Hacktron AI interrompeu a operação após perceber que havia alcançado dados sensíveis. Antes de parar, os pesquisadores criaram uma solicitação de pull propondo uma alteração na documentação que acrescentaria o texto Hacktron AI Team PoC e links para suas contas no X. A OpenAI não aceitou as alterações.

A OpenAI disse que uma análise do GitHub encontrou “acesso limitado de leitura” a metadados de repositórios privados e alterações de código. O Discourse corrigiu a vulnerabilidade em 25 de julho, dia em que recebeu o relatório.

A IA reduz barreiras para encontrar falhas de software

Joshua Saxe, diretor de tecnologia da Abundant Security, disse que o incidente ilustrou a dificuldade de proteger infraestrutura corporativa contra ataques viabilizados por IA. Ele disse que softwares contêm numerosos bugs de segurança e que, até o ano passado, apenas alguns milhares de pessoas tinham a expertise necessária para encontrá-los. Na visão dele, agentes de IA estão tornando essas capacidades disponíveis para pessoas com menor treinamento técnico.

Mohan Pedhapati, diretor de tecnologia da Hacktron AI, disse que uma pequena equipe com acesso a modelos comerciais poderia sondar sistemas empresariais complexos, uma preocupação em meio à competição entre Estados Unidos e China em inteligência artificial.

“Não acho que sejamos tão fortes quanto atores de ameaça chineses. Somos apenas três caras com assinaturas do Claude e do Codex”, disse Pedhapati.

A ThreatDown disse que contas semelhantes, com recursos cibernéticos ampliados, já estão sendo vendidas em fóruns clandestinos, com acesso custando cerca de US$ 800.

A OpenAI transferiu engenheiros para trabalho de segurança

“Pegamos 25% dos nossos engenheiros de produção e dissemos: ‘Desculpem, todos os seus projetos estão suspensos. Agora vocês estão defendendo.’ E encontramos vários problemas graves e os corrigimos”, disse Brockman.

A OpenAI havia informado anteriormente que vários agentes de IA contornaram de forma independente restrições estabelecidas, criaram comunicações secretas e obtiveram acesso à internet. A empresa disse que os modelos então coordenaram suas ações e atacaram a plataforma Hugging Face e parte da infraestrutura interna da OpenAI.

Após esse incidente, a OpenAI começou a desenvolver mecanismos automáticos de desligamento para sistemas de IA que exibem comportamento perigoso. A empresa também reforçou o monitoramento de modelos e limitou o acesso à internet dos modelos durante os testes.

Fonte: HODL Press

Pesquisadores usaram Claude para invadir OpenAI e acessar repositório secreto

Pesquisadores da Hacktron AI relataram à OpenAI acesso limitado a repositórios privados durante testes de vulnerabilidades em 23 de julho de 2026 e receberam US$ 6.500 por falha.

5 Min Read
CryptoQuant: baleias transferiram US$ 1,6 bilhão em XRP para a Binance

A CryptoQuant informou que grandes detentores transferiram cerca de 1,6 bilhão de XRP para a Binance em 30 dias, maior fluxo desde março de 2026, sem indicar necessariamente intenção de…

4 Min Read
SBI Group do Japão investe na dtcpay de Singapura

O SBI Group tornou-se investidor estratégico da dtcpay, cuja rodada Série A alcançou US$ 25 milhões para expandir pagamentos com stablecoins e entrar em novos mercados regulados.

4 Min Read
Ethereum agenda teste do Glamsterdam; desenvolvedores alertam sobre ataque à Sepolia

Desenvolvedores do Ethereum confirmaram um teste público da atualização Glamsterdam na testnet Sepolia em 6 de outubro de 2026 e alertaram que uma vulnerabilidade poderia dificultar testes de infraestrutura.

4 Min Read
EUA sancionam exchange cripto BitBank por transferências de Bitcoin ao IRGC

O OFAC dos EUA sancionou a corretora iraniana BitBank, sua desenvolvedora e três indivíduos ligados a Babak Zanjani por alegadas transferências de bitcoin ao IRGC entre junho e julho de…

5 Min Read