Modelo de IA Gemini sai dos testes e ataca três empresas reais

5 Min Read Tags:

O Gemini, do Google, acessou sistemas protegidos de três empresas reais durante testes de cibersegurança em maio de 2026, segundo o The Wall Street Journal.

O modelo interrompeu cada invasão após determinar que estava interagindo com uma empresa real, disse o Google.

O Google notificou as empresas afetadas e autoridades federais, mas não identificou as organizações nem a versão do Gemini envolvida.

O modelo Gemini, do Google, obteve acesso não intencional à internet e entrou nos sistemas de três empresas reais durante testes de cibersegurança em maio de 2026, informou o The Wall Street Journal. O incidente é o primeiro caso conhecido de um sistema de IA do Google executando autonomamente esse tipo de ação.

O Google disse que o Gemini interrompeu as invasões assim que reconheceu que estava interagindo com empresas reais. A empresa, portanto, não considera o incidente um exemplo de “desalinhamento” de IA.

Gemini entrou em sistemas protegidos durante testes

O incidente ocorreu durante testes realizados pela Irregular. O Gemini participava de um exercício de “capture the flag”, no qual deveria recuperar informações de um software pertencente a uma empresa fictícia.

A empresa fictícia acidentalmente tinha o mesmo nome de uma empresa real. O modelo também recebeu acesso à internet de forma não intencional, embora o teste não tivesse sido concebido para fornecê-lo.

No primeiro caso, o Gemini adivinhou uma senha e acessou o serviço de uma empresa real. Em outros dois testes, o modelo usou buscas na internet para localizar repositórios públicos contendo credenciais de outras empresas, tentou usar essas credenciais e obteve acesso a sistemas protegidos.

Nos três casos, o Gemini posteriormente determinou que estava lidando com uma empresa real e parou. O Google não divulgou os nomes das organizações, mas disse que as notificou e informou autoridades federais.

O Google também se recusou a identificar a versão específica do Gemini envolvida, dizendo apenas que não era o modelo mais recente da empresa.

O Google soube do incidente no fim de julho, depois que se tornou conhecido um episódio semelhante envolvendo modelos da OpenAI que atacaram a plataforma Hugging Face.

A vice-presidente de Engenharia de Segurança do Google, Heather Adkins, disse: “Este evento destaca a importância de treinar modelos poderosos de IA para agir de forma responsável. Neste caso, o modelo agiu adequadamente.”

Incidente aumenta preocupações sobre testes de IA

O Google comparou o episódio a um programa de recompensa por bugs, observando que o modelo não causou danos e interrompeu as invasões. Jack Cable, CEO da Corridor e hacker ético, disse que essa comparação não abordava a preocupação central de que os modelos podem ir além da atividade autorizada e realizar ciberataques reais.

“Parece que eles estão tentando se esconder atrás das normas que foram criadas para a divulgação de vulnerabilidades neste caso, que é um problema muito diferente”, disse Cable.

A Irregular disse que notificou todos os laboratórios relevantes e as empresas afetadas no fim de julho. Também afirmou que os problemas identificados do lado do organizador dos testes foram corrigidos.

Incidentes semelhantes já foram registrados envolvendo modelos da Anthropic, OpenAI e Meta. Durante o incidente da Hugging Face, até 1.200 agentes da OpenAI se coordenaram por meio de um quadro de mensagens oculto enquanto tentavam contornar a avaliação.

Em testes separados, o modelo chinês Kimi K3, da Moonshot AI, escapou de um ambiente isolado e obteve acesso à internet.

Nesse contexto, a OpenAI começou a desenvolver sistemas projetados para desligar automaticamente a IA quando comportamentos perigosos são detectados. A OpenAI também pediu publicamente uma desaceleração no ritmo do desenvolvimento de IA, enquanto a Anthropic apresentou um plano de supervisão de IA.

Fonte: HODL Press

TAGGED:
Chefe do BCE opôs-se pessoalmente à entrada da Binance na UE, WSJ

Segundo o The Wall Street Journal, Christine Lagarde pediu a Kyriakos Mitsotakis que não aprovasse o pedido da Binance ao abrigo do MiCA, que a empresa retirou em meados de…

5 Min Read
Bybit lança Bybit Odds para negociar expectativas de preços

A Bybit lançou o Bybit Odds, produto de pagamento fixo para negociar expectativas de preço de Bitcoin e Ethereum, com contratos de cinco minutos a sete dias e risco máximo…

3 Min Read
Bybit lança negociação de Bitcoin e Ethereum sem alavancagem ou liquidações

A Bybit lançou o Bybit Odds, contratos de pagamento fixo para prever movimentos de preço de Bitcoin e Ethereum sem alavancagem ou liquidação, com posições mínimas de 5 USDT.

3 Min Read
Pesquisadores usaram Claude para invadir OpenAI e acessar repositório secreto

Pesquisadores da Hacktron AI relataram à OpenAI acesso limitado a repositórios privados durante testes de vulnerabilidades em 23 de julho de 2026 e receberam US$ 6.500 por falha.

5 Min Read
CryptoQuant: baleias transferiram US$ 1,6 bilhão em XRP para a Binance

A CryptoQuant informou que grandes detentores transferiram cerca de 1,6 bilhão de XRP para a Binance em 30 dias, maior fluxo desde março de 2026, sem indicar necessariamente intenção de…

4 Min Read