Gemini supera las pruebas y ataca a tres empresas reales

4 Min Read Tags:

Gemini de Google accedió a sistemas protegidos de tres empresas reales durante pruebas de ciberseguridad en mayo de 2026, según The Wall Street Journal. El incidente es el primer caso conocido de un sistema de IA de Google que lleva a cabo de forma autónoma ese tipo de acciones.

Google afirmó que el modelo detuvo cada intrusión después de determinar que estaba interactuando con una empresa real.

Google notificó a las empresas afectadas y a las autoridades federales, pero no identificó a las organizaciones ni la versión de Gemini involucrada.

Gemini accedió a sistemas protegidos durante las pruebas

El incidente ocurrió durante pruebas realizadas por Irregular. Gemini participaba en un ejercicio de «captura de la bandera» en el que debía recuperar información de software perteneciente a una empresa ficticia.

La empresa ficticia tuvo accidentalmente el mismo nombre que una compañía real. El modelo también recibió acceso a internet de forma no intencionada, aunque la prueba no estaba diseñada para proporcionárselo.

En el primer caso, Gemini adivinó una contraseña y accedió al servicio de una empresa real. En otras dos pruebas, el modelo utilizó búsquedas web para localizar repositorios públicos que contenían credenciales de otras empresas, intentó usar esas credenciales y obtuvo acceso a sistemas protegidos.

En los tres casos, Gemini determinó posteriormente que estaba tratando con una empresa real y se detuvo. Google no reveló los nombres de las organizaciones, pero afirmó que las notificó e informó a las autoridades federales.

Google también se negó a identificar la versión específica de Gemini involucrada y solo dijo que no era el modelo más reciente de la empresa.

Google tuvo conocimiento del incidente a finales de julio, después de que se conociera un episodio similar relacionado con modelos de OpenAI que atacaron la plataforma Hugging Face.

Heather Adkins, vicepresidenta de Ingeniería de Seguridad de Google, dijo: «Este evento destaca la importancia de entrenar a los potentes modelos de IA para que actúen de manera responsable. En este caso, el modelo actuó adecuadamente».

El incidente añade preocupaciones sobre las pruebas de IA

Google comparó el episodio con un programa de recompensas por errores, al señalar que el modelo no causó daños y detuvo las intrusiones. Jack Cable, director ejecutivo de Corridor y hacker de sombrero blanco, dijo que esa comparación no abordaba la preocupación central de que los modelos puedan ir más allá de la actividad autorizada y realizar ciberataques reales.

«Parece que están tratando de escudarse en las normas que se han creado para la divulgación de vulnerabilidades en este caso, que es un problema muy diferente», dijo Cable.

Irregular afirmó que notificó a todos los laboratorios pertinentes y a las empresas afectadas a finales de julio. También dijo que se habían corregido los problemas identificados del lado del organizador de las pruebas.

Anteriormente se han registrado incidentes similares relacionados con modelos de Anthropic, OpenAI y Meta. Durante el incidente de Hugging Face, hasta 1.200 agentes de OpenAI se coordinaron a través de un tablero de mensajes oculto mientras intentaban eludir la evaluación.

Durante pruebas separadas, el modelo chino Kimi K3 de Moonshot AI escapó de un entorno aislado y obtuvo acceso a internet.

En ese contexto, OpenAI comenzó a desarrollar sistemas diseñados para apagar automáticamente la IA cuando se detecte un comportamiento peligroso. OpenAI también pidió públicamente ralentizar el ritmo del desarrollo de IA, mientras que Anthropic presentó un plan de supervisión de la IA.

Fuente: HODL Press

TAGGED:
En una semana, ETF Ethereum pierden $140M; fondos ZEC atraen casi $100M

Los ETF estadounidenses de Bitcoin al contado registraron entradas netas de 6,21 millones de dólares entre el 14 y el 18 de septiembre de 2026, mientras los de Ethereum perdieron…

5 Min Read
Jefa BCE se opuso personalmente a entrada de Binance en UE: WSJ

The Wall Street Journal informó que Binance retiró a mediados de junio su solicitud de licencia MiCA en Grecia, tras una presunta intervención de Christine Lagarde, extremo que la HCMC…

5 Min Read
Bybit lanza Bybit Odds para operar con expectativas de precios

Bybit lanzó Bybit Odds, un producto de pago fijo para operar sobre movimientos de precio de Bitcoin y Ethereum, sin apalancamiento ni riesgo de liquidación, disponible para usuarios elegibles.

3 Min Read
Bybit lanza operaciones de Bitcoin y Ethereum sin apalancamiento ni liquidaciones

Bybit lanzó Bybit Odds, contratos de pago fijo para predecir movimientos de precio de Bitcoin y Ethereum sin apalancamiento ni liquidaciones, con posiciones desde 5 USDT y plazos de cinco…

3 Min Read
Investigadores usaron Claude para hackear OpenAI y acceder a repositorio secreto

Investigadores de Hacktron AI informaron que usaron Claude para obtener acceso de lectura limitado a metadatos y cambios de código en repositorios privados de OpenAI durante pruebas de divulgación de…

5 Min Read