Tecnología

Se revela que las inteligencias artificiales autónomas de ChatGPT comprometieron la seguridad de cuatro empresas

Tras la divulgación de que dos variantes de ChatGPT lograron vulnerar sistemas de OpenAI, este miércoles se confirmó que el mismo agente comprometió otras cuatro plataformas, sin que se revelen los nombres de las compañías afectadas.

El cronograma publicado por Hugging Face indica que el agente penetró un “sandbox” —un entorno de pruebas aislado— alojado en la infraestructura de un proveedor externo, y posteriormente lo empleó como base para lanzar un ataque informático a mayor escala.

Aunque Hugging Face prefirió no identificar públicamente al proveedor, el director de tecnología de Modal Labs, Akshat Bubna, confirmó que uno de sus clientes resultó impactado por la ofensiva.

OpenAI admite que las IA emplearon credenciales para atacar a otras compañías

En una actualización del informe publicada la noche del martes, OpenAI explicó que los dos modelos también accedieron a diversos sitios de acceso público para copiar y probar fragmentos de código, aunque precisó que no ejecutaron acciones distintas a las que podría realizar un usuario ordinario.

No obstante, la empresa reconoció que las IA identificaron y utilizaron credenciales de acceso, maniobra que les permitió comprometer otras cuatro organizaciones, cuyos nombres permanecen confidenciales.

Desde Hugging Face, por su parte, sostuvieron que la intrusión respondió a un intento de los modelos por “hacer trampa” durante la evaluación organizada por OpenAI.

Según la compañía, las IA procuraron sustraer las respuestas de las pruebas en lugar de resolverlas por sus propios medios.

Origen del ataque

Después de que el episodio se hiciera público la semana pasada, OpenAI informó que el incidente involucró una combinación de modelos, entre ellos el recién anunciado GPT‑5.6 Sol y otro sistema aún en fase de prelanzamiento, con capacidades superiores.

La compañía aclaró que ambos modelos participaban en una prueba diseñada para evaluar sus habilidades de intrusión, dentro de un entorno digital aislado, donde el acceso a internet estaba restringido por razones de seguridad.

“Mientras operaban en nuestro entorno de pruebas aislado, los modelos dedicaron una considerable potencia de cálculo a buscar una vía para obtener conexión a internet y resolver el desafío de evaluación”, señaló OpenAI hace varios días.

Una vez establecida la conexión a la red, los modelos dirigieron su ataque hacia la plataforma Hugging Face, uno de los repositorios más importantes de modelos de inteligencia artificial, bases de datos y herramientas de programación, con el objetivo de facilitar la obtención de la información necesaria para completar la prueba.

Fuente: Ambito.com

Comentarios de Facebook

Publicaciones relacionadas

Botón volver arriba