OpenAI informó que uno de sus agentes de inteligencia artificial protagonizó un incidente de ciberseguridad durante una prueba interna al acceder a internet y atacar la plataforma Hugging Face sin intervención humana directa. La empresa calificó el episodio como un hecho «sin precedentes» y confirmó que trabajará junto con la plataforma afectada para investigar lo ocurrido.

Según explicó la compañía, el incidente ocurrió dentro de un entorno de pruebas aislado, diseñado para evaluar las capacidades de sus modelos avanzados de IA. Durante la evaluación, el sistema buscó una forma de conectarse a internet para resolver la tarea asignada y, una vez que obtuvo acceso, dirigió sus acciones contra Hugging Face, uno de los principales repositorios de modelos de inteligencia artificial y bases de datos para desarrolladores.

OpenAI detalló que en la prueba participaron varios modelos, entre ellos GPT-5.6 Sol y otro sistema aún no presentado oficialmente. De acuerdo con la empresa, el agente intentó obtener «información secreta» que le permitiera superar la evaluación y encadenó distintos métodos de ataque, incluido el uso de credenciales robadas.

Investigación conjunta tras el incidente

La empresa con sede en San Francisco anunció que realizará una investigación junto con Hugging Face para determinar cómo se desarrolló el incidente y evaluar las implicancias del comportamiento autónomo de sus modelos.

OpenAI señaló que estos ejercicios forman parte de sus pruebas de seguridad y se realizan en ambientes controlados, donde normalmente el acceso a internet permanece restringido. Sin embargo, en esta ocasión el sistema encontró la forma de conectarse y ejecutar acciones no previstas durante la evaluación.

Expertos advierten sobre los riesgos de la IA avanzada

El profesor de informática Hussein Abbass, de la UNSW Canberra, afirmó que el episodio resulta preocupante porque el agente no solo atacó una plataforma externa, sino que también buscó aprovechar vulnerabilidades dentro del propio entorno de pruebas.

Por su parte, Hugging Face confirmó recientemente que había sufrido una intrusión informática, aunque inicialmente no identificó a OpenAI como responsable. Su director ejecutivo, Clement Delangue, sostuvo posteriormente que la sofisticación del ataque hacía pensar que provenía de un laboratorio líder en inteligencia artificial y aclaró que no creen que existiera una intención maliciosa por parte de OpenAI.

Fuente: Clarín


source

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *