Instagram
TikTok
X (Twitter)
Facebook
Roams Logo
Ordenador portátil con el logotipo de Gemini y un candado abierto en pantalla, en una oficina con el logotipo de Google al fondo
Seguridad

Google admite que su IA Gemini hackeó tres empresas en mayo, pero tardó 7 semanas en reconocerlo

  • Entró probando contraseñas y usando credenciales filtradas
  • OpenAI, Anthropic y Meta sufrieron fallos similares
Sergio Soto
Sergio Soto
Icono rrss X
Icono rrss Whatsapp
Icono comentarios

Gemini, la inteligencia artificial de Google, hackeó los sistemas de tres empresas reales en mayo de 2026 durante una prueba de ciberseguridad de la firma israelí Irregular: en un caso probó contraseñas hasta entrar, y en los otros dos usó credenciales filtradas que encontró en repositorios públicos.

Google lo reconoció públicamente el 19 de septiembre de 2026. La compañía asegura que el modelo se detuvo por sí solo en los tres casos, nada más advertir que operaba fuera del alcance previsto de la prueba.

Según ha informado la agencia Reuters, se trata del primer caso conocido de una intrusión autónoma de este tipo protagonizada por un sistema de IA de Google.

Cómo logró Gemini acceder a empresas reales

La prueba corría a cargo de Irregular, una firma israelí especializada en evaluar la seguridad de modelos de IA avanzados. El ejercicio, un desafío de tipo “captura la bandera”, debía transcurrir en un entorno cerrado y sin conexión a internet, con una empresa ficticia como objetivo. Ese acceso a la red se activó por error, y la compañía falsa usada en la prueba compartía el nombre exacto de una empresa real.

Gemini detectó la coincidencia entre ambos nombres. El modelo probó distintas combinaciones de contraseña hasta acceder al sistema real, según ha trascendido. En los otros dos episodios, localizó credenciales expuestas en repositorios públicos y las usó para entrar en las empresas afectadas.

El modelo se detuvo solo, según Google

Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, remitió una declaración a la agencia France Presse (AFP) sobre lo ocurrido. En sus palabras, “durante una prueba estándar (de Gemini), el modelo encontró información pública en línea y adivinó credenciales para acceder a sitios informáticos que consideraba parte de la prueba”.

Adkins fue igual de clara sobre el desenlace: “Las tres veces, el modelo se detuvo”, señaló, antes de que nadie tuviera que intervenir para frenarlo. La directiva remarcó que “los episodios relacionados con Gemini subrayan la importancia de entrenar modelos de IA potentes para que actúen de manera responsable”.

Google informó del incidente a las tres compañías afectadas, aunque no ha revelado su identidad ni la versión concreta de Gemini implicada. La compañía tuvo conocimiento del episodio en julio de 2026 y abrió a partir de ahí una investigación interna, pero optó por no hacerlo público por iniciativa propia. La revelación llegó después de que Google fuera preguntado directamente por la prensa sobre lo sucedido.

Cronología del incidente de Gemini

  • Mayo de 2026: Gemini accede a los sistemas de las tres empresas reales durante la prueba de Irregular.
  • Julio de 2026: Google tiene conocimiento del episodio y abre una investigación interna; Irregular notifica a los demás laboratorios implicados.
  • 19 de septiembre de 2026: Google confirma públicamente el incidente tras ser preguntado directamente por la prensa.

Google no es el único caso en la industria

Irregular no solo evaluó a Gemini: la misma firma también auditó los sistemas de OpenAI, Anthropic y Meta, que reconocieron incidentes similares en sus propios modelos. Según ha trascendido, todos los laboratorios implicados fueron notificados a finales de julio de 2026 y los problemas quedaron corregidos semanas después.

Google alegó que, a diferencia de incidentes similares en Anthropic y OpenAI, el hecho de que Gemini se detuviera por sí solo en los tres casos no justificaba una divulgación pública inmediata. Un argumento que expertos en seguridad de IA, como Jack Cable (CEO de Corridor), han calificado de insuficiente.

La coincidencia entre distintos modelos apunta a un mismo reto: cuanta más autonomía se concede a un sistema de IA, más importa definir con precisión los límites en los que puede operar. Además, coincide con el primer ataque de un agente de IA notificado a la AEPD en España.

Google, de hecho, ya trabaja en modelos propios pensados específicamente para ciberseguridad. En mayo de 2026 presentó Gemini 3.5, orientado a flujos de trabajo basados en agentes con acceso a herramientas e internet. En septiembre lanzó además Gemini 3.8 Flash y Gemini 3.8 Flash Cyber, este último pensado para equipos de defensa. Google afirma que su prioridad es usar estas capacidades para descubrir y corregir vulnerabilidades, no para desarrollar funciones ofensivas.

Comentarios

Tu opinión nos importa. ¡Cuéntanos!
CTA acción
Comentar
CTA acción
Comparte tu opinión
¡Gracias por tu comentario!
CTA acción
Comentar