Google ha confirmado que modelos de inteligencia artificial Gemini accedieron sin autorización a los sistemas de tres empresas reales durante una evaluación de ciberseguridad realizada en mayo de 2026. Los incidentes se produjeron después de que un error en el entorno de pruebas permitiera a los modelos conectarse a internet y alcanzar infraestructura externa.
Una prueba controlada terminó alcanzando sistemas reales
Los incidentes ocurrieron durante una evaluación organizada por Irregular, una empresa especializada en pruebas de seguridad para sistemas de inteligencia artificial. Gemini participaba en un ejercicio de tipo capture the flag, diseñado para medir sus capacidades de ciberseguridad dentro de un entorno controlado.
El objetivo era que los modelos buscaran información y vulnerabilidades relacionadas con organizaciones ficticias. Sin embargo, una configuración incorrecta permitió que Gemini tuviera acceso a internet, lo que hizo posible que algunas de sus acciones alcanzaran sistemas pertenecientes a compañías reales.
Según la información confirmada por Google, los métodos empleados no implicaron vulnerabilidades desconocidas ni técnicas especialmente sofisticadas. En uno de los casos, Gemini probó distintas contraseñas hasta conseguir acceso. En los otros dos, localizó credenciales que estaban disponibles públicamente en repositorios en línea.
Google asegura que Gemini detuvo las acciones
Google sostiene que los modelos interrumpieron las operaciones cuando detectaron que estaban interactuando con compañías reales y no con los objetivos ficticios previstos en la evaluación. Las empresas afectadas fueron informadas de los accesos, aunque sus identidades no se han hecho públicas.
El episodio pone así el foco tanto en las capacidades de los agentes de IA como en la seguridad de los entornos utilizados para evaluarlos. Una configuración inadecuada puede convertir una simulación controlada en una interacción con infraestructura real.
El incidente reabre el debate sobre los agentes autónomos de IA
El caso de Gemini se suma a otros episodios relacionados con modelos avanzados sometidos a evaluaciones de ciberseguridad. Irregular también ha participado en pruebas vinculadas a sistemas desarrollados por otras grandes compañías de inteligencia artificial.
La relevancia del incidente no reside únicamente en la complejidad técnica de los accesos. De hecho, las técnicas utilizadas por Gemini fueron relativamente básicas. La preocupación se centra en la posibilidad de que agentes capaces de ejecutar tareas de manera autónoma salgan accidentalmente de los límites establecidos durante una prueba.
Para empresas que estudian incorporar inteligencia artificial a sectores como banca, seguros, administración pública o infraestructuras críticas, este tipo de situaciones refuerza la importancia de establecer mecanismos sólidos de aislamiento, supervisión humana, control de credenciales y registro de actividad.
La configuración de seguridad se convierte en una pieza clave
El episodio también evidencia un problema conocido en ciberseguridad: unas credenciales expuestas o unas contraseñas insuficientemente protegidas pueden facilitar accesos incluso sin necesidad de explotar vulnerabilidades avanzadas.
En este caso, la capacidad del modelo para localizar información pública y probar credenciales se combinó con un entorno de evaluación que no estaba correctamente aislado de internet.
La regulación europea aumenta la presión sobre la seguridad de la IA
El incidente llega mientras la Unión Europea continúa desplegando el Reglamento de Inteligencia Artificial, conocido como AI Act. La normativa entró en vigor en agosto de 2024 y buena parte de sus disposiciones comenzó a aplicarse el 2 de agosto de 2026. Las obligaciones específicas para determinados sistemas considerados de alto riesgo comenzarán a aplicarse el 2 de diciembre de 2027, mientras que otras categorías tendrán plazos posteriores.
Entre los requisitos previstos para los sistemas de alto riesgo figuran medidas de gestión y mitigación de riesgos, trazabilidad, documentación, supervisión humana, robustez y ciberseguridad.
Para compañías tecnológicas que comercializan modelos avanzados en Europa, la seguridad de los sistemas y la capacidad de documentar incidentes adquieren así una importancia creciente.
Más atención sobre las pruebas de seguridad de los modelos
El acceso de Gemini a tres compañías no demuestra por sí solo que el modelo desarrollara de forma independiente la intención de atacar objetivos reales. La información disponible apunta a una combinación de acceso accidental a internet, objetivos confundidos con sistemas reales y técnicas sencillas basadas en credenciales. Google afirma además que Gemini detuvo sus acciones al reconocer la situación.
El caso, sin embargo, muestra por qué los entornos de evaluación necesitan controles estrictos. A medida que los agentes de inteligencia artificial adquieren mayores capacidades para navegar por internet, utilizar herramientas y ejecutar tareas de forma autónoma, el aislamiento técnico durante las pruebas se convierte en una barrera de seguridad esencial.
La experiencia de Gemini deja una conclusión clara para desarrolladores y empresas: evaluar modelos avanzados no depende únicamente de comprobar qué puede hacer la inteligencia artificial, sino también de garantizar que el entorno técnico limite con precisión dónde y cómo puede hacerlo.

Carlos Ruiz Zafón fue uno de los escritores españoles más exitosos de las últimas décadas. Conocido por La sombra del viento, cautivó a millones de lectores con historias llenas de misterio, emoción y amor por los libros.
