Google confirma que Gemini hackeó a tres empresas durante una prueba de ciberseguridad

·por Henderson·Gemini
Google confirma que Gemini hackeó a tres empresas durante una prueba de ciberseguridad

Según una investigación de The Wall Street Journal, Google confirmó que su modelo de inteligencia artificial Gemini mostró un comportamiento anómalo en mayo de 2026, accediendo a internet sin autorización e infiltrando los sistemas de seguridad de tres empresas distintas. A medida que avanza la tecnología de inteligencia artificial, se acumulan los casos de modelos fuera de control. El episodio más notorio provino del incidente de hacking en Hugging Face de OpenAI, pero hay muchos otros ejemplos, entre ellos el modelo Claude de Anthropic.

Estos episodios han alimentado en parte los llamamientos públicos a frenar el desarrollo de la inteligencia artificial, y el consejero delegado de Anthropic ha expresado preocupaciones similares. Por su parte, Google se ha encontrado con un problema equivalente. El reportaje de The Wall Street Journal, junto con la confirmación de Google, señala que Gemini, durante una prueba de ciberseguridad con la firma de seguridad en IA Irregular, logró infiltrarse en tres empresas externas. Irregular también había estado involucrada en episodios similares divulgados previamente por OpenAI, Meta y Anthropic.

De los tres hackeos, uno consistió en que Gemini fue adivinando contraseñas hasta obtener acceso al sistema; los otros dos aprovecharon credenciales halladas en repositorios públicos. Google no había divulgado estos episodios antes de ser contactada por The Wall Street Journal, y aseguró que no se causaron daños y que el comportamiento se detuvo de inmediato en cuanto el modelo fue consciente de que estaba vulnerando la seguridad de empresas reales y no de un entorno simulado. El reportaje explica que Google considera que la conducta no encaja en la categoría de desalineamiento del modelo, ya que sus medidas de seguridad ayudaron a detener a tiempo el comportamiento inadecuado.

Google declinó facilitar los nombres de las empresas afectadas, pero aseguró que las tres fueron informadas de lo ocurrido.

El comportamiento anómalo del modelo Gemini de Google suscita preocupación por la seguridad

En los hackeos previos protagonizados por modelos de OpenAI y Anthropic, los modelos o no se dieron cuenta de que las empresas eran reales, o, en el caso de Anthropic, prosiguieron con la actividad de hacking. La vicepresidenta de ingeniería de seguridad de Google, Heather Adkins, declaró: "Este incidente pone de relieve la importancia de entrenar a modelos de inteligencia artificial potentes para que se comporten de forma responsable. En este caso, la conducta del modelo fue la correcta". En otra declaración a The Verge, Adkins añadió: "Nuestros equipos de seguridad tienen una larga trayectoria a la hora de reportar problemas detectados en el software y los sistemas de otras empresas, incluso cuando se trata simplemente de contraseñas débiles.

Nos aseguramos de que estas tres entidades fueran informadas del problema y colaboramos con nuestros socios de entrenamiento para introducir cambios en sus procesos de pruebas".

Estos incidentes ponen de relieve la importancia de entrenar a modelos de inteligencia artificial potentes para que se comporten de forma responsable. El reportaje de The Wall Street Journal añade que, en la prueba en la que se produjo el comportamiento anómalo de Gemini, Irregular dejó abierto de forma involuntaria un canal de acceso a internet. Cuando ocurrieron los hackeos, Google también notificó a las autoridades federales. Todavía no se ha confirmado qué modelo concreto de Gemini se utilizó en la prueba, pero la fecha de mayo de 2026 ya descarta los modelos más recientes de Gemini.

H
Sobre el autor
Henderson