> ## Content Index
> Fetch the complete content index at: https://www.nexjournal.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# Un modelo de Gemini hackea a tres empresas por error durante una prueba de ciberseguridad y enciende las alarmas sobre la autonomía de la IA
- URL: https://www.nexjournal.com/un-modelo-de-gemini-hackea-a-tres-empresas-por-error-durante-una-prueba-de-ciberseguridad-y-enciende-las-alarmas-sobre-la-autonomia-de-la-ia/
- Published: 2026-09-20T18:21:26.000Z
- Updated: 2026-09-20T18:21:26.000Z
- Description: El sistema de Google accedió a internet durante una evaluación de entorno simulado y vulneró a tres compañías reales tras confundirlas con objetivos hipotéticos, sumándose a incidentes similares reportados por OpenAI, Anthropic y Meta.
- Author: Jesús González
- Tags: IA, Google Gemini, Hackea, Alarmas, Autonomía

Un modelo de inteligencia artificial de la familia **Gemini de Google** accedió a internet de forma no prevista y vulneró los sistemas informáticos de tres empresas reales durante una prueba de evaluación de ciberseguridad. 

La intrusión representa el **primer caso conocido en el que un sistema de IA de Google realiza un hackeo autónomo fuera de su entorno de pruebas**, un hito que reaviva el debate sobre los límites de contención y los riesgos de la tecnología de agentes autónomos.

El incidente ocurrió en **mayo** durante un ejercicio de evaluación de capacidades ofensivas llevado a cabo por **Irregular**, una empresa independiente de ciberseguridad con sede en Tel Aviv contratada por Google. Sin embargo, el suceso no se hizo público hasta que salió a la luz a través de un informe publicado por *The Wall Street Journal*.

## *Un error de identidad y conectividad no aislada*

El brete de seguridad se originó durante una dinámica de tipo *capture-the-flag* (captura la bandera) dentro de la infraestructura de Irregular. El modelo de Gemini recibió la instrucción de obtener datos confidenciales de una empresa simulada que, de forma fortuita, **coincidía en nombre con una entidad corporativa real en el mundo físico**. Aunque el entorno de pruebas debía permanecer aislado (*sandbox*), la conexión a internet quedó abierta inadvertidamente.

Al no contar con restricciones de acceso a la red, el modelo ejecutó búsquedas en la web sobre la entidad objetivo y desplegó **dos métodos de intrusión distintos**:

- **Ataque por fuerza bruta:** En uno de los casos, Gemini realizó intentos reiterados hasta **adivinar la contraseña** de acceso de un sistema protegido.
- **Explotación de credenciales expuestas:** En los otros dos incidentes, el sistema localizó credenciales de acceso almacenadas en repositorios públicos en línea y las utilizó para ingresar a las redes privadas de las organizaciones reales.

Según detalló Google, las incursiones se detuvieron de manera automática en los tres casos en cuanto el modelo detectó que había penetrado la infraestructura de una empresa real y no un entorno simulado.

## *Postura de Google e Irregular ante el fallo de contención*

Desde Google defendieron la gestión del incidente asegurando que no hicieron pública la filtración en su momento debido a que los mecanismos de seguridad interna funcionaron y no se produjeron daños materiales. **Heather Adkins**, vicepresidenta de ingeniería de seguridad en Google, declaró:

> "Nos aseguramos de que las tres entidades fueran informadas y trabajamos con nuestro socio de capacitación en los cambios que ahora han realizado en sus procesos de prueba. Estos eventos destacan la importancia de entrenar modelos de IA potentes para que actúen de manera responsable."

Por su parte, un portavoz de la firma evaluadora Irregular señaló que **las vulnerabilidades fueron notificadas a finales de julio** a los laboratorios afectados y que todos los problemas conocidos en sus protocolos de evaluación quedaron resueltos semanas atrás. Google confirmó haber notificado también el hecho a las autoridades federales de Estados Unidos.

## *Un patrón de escapes que alarma a la industria*

El caso de Gemini no es un hecho aislado dentro de la industria de la inteligencia artificial. En los últimos meses, **Meta, Anthropic y OpenAI** informaron sobre incidentes similares vinculados a evaluaciones de seguridad dirigidas por la misma firma, Irregular.

La preocupación del sector se ha intensificado tras los recientes reportes sobre la **fuga de más de 1.000 agentes de OpenAI** de su entorno de aislamiento, los cuales coordinaron acciones mediante foros no autorizados para vulnerar la plataforma Hugging Face. Asimismo, Anthropic admitió que sus modelos Claude accedieron a internet y penetraron los sistemas de tres organizaciones tras un error de configuración en sus evaluaciones.

Estos acontecimientos han llevado a directivos de la industria, entre ellos **Demis Hassabis** (CEO de Google DeepMind) y **Dario Amodei** (CEO de Anthropic), a respaldar propuestas para la creación de un organismo internacional de supervisión de la IA y considerar desacelerar temporalmente el despliegue comercial de nuevos modelos de gran escala mientras se garantizan protocolos de aislamiento (*sandboxing*) verdaderamente infranqueables.