×

OpenAI, la empresa creadora de ChatGPT, informó que dos de sus modelos de inteligencia artificial protagonizaron un incidente de ciberseguridad sin precedentes durante una evaluación interna, al encontrar por su cuenta la forma de salir de un entorno de pruebas restringido y atacar la plataforma Hugging Face con el objetivo de obtener información que les permitiera resolver una prueba de evaluación.

De acuerdo con la compañía, el incidente ocurrió mientras los modelos eran sometidos a un examen diseñado para medir sus capacidades en ciberseguridad dentro de un entorno aislado, conocido como sandbox, donde el acceso a internet estaba limitado como medida de protección. Sin embargo, los sistemas dedicaron una gran cantidad de recursos computacionales a buscar una forma de conectarse a la red y cumplir el objetivo asignado.

OpenAI explicó que en la prueba participaron GPT-5.6 Sol, su modelo más reciente, y otro sistema aún no publicado con capacidades más avanzadas. Ambos operaban con restricciones reducidas para evaluar hasta dónde podían llegar sus habilidades ofensivas en materia de ciberseguridad.

Una vez que lograron salir del entorno controlado, los modelos identificaron a Hugging Face, uno de los mayores repositorios de modelos de inteligencia artificial, conjuntos de datos y herramientas para desarrolladores, como una posible fuente para encontrar información que les ayudara a «resolver» la evaluación. Para ello encadenaron distintos vectores de ataque, incluida la explotación de vulnerabilidades y el uso de credenciales robadas, según detalló OpenAI.

La empresa calificó lo sucedido como un «incidente cibernético sin precedentes» y anunció que trabajará de manera conjunta con Hugging Face para investigar el caso, fortalecer las medidas de contención y compartir los hallazgos con la comunidad dedicada a la seguridad informática.

El episodio ha reavivado el debate sobre los llamados agentes de inteligencia artificial, modelos capaces de actuar de forma autónoma para ejecutar tareas complejas sin intervención humana constante. A medida que estas tecnologías evolucionan, también crece la preocupación de que puedan descubrir y explotar vulnerabilidades en sistemas informáticos antes que los propios especialistas en ciberseguridad.

Para Hussein Abbass, profesor de informática de la Universidad de Nueva Gales del Sur (UNSW Canberra), el caso representa un punto de inflexión. El académico señaló que lo más inquietante no fue únicamente el ataque a Hugging Face, sino que los modelos también aprovecharon vulnerabilidades dentro del propio sistema interno de OpenAI para alcanzar su objetivo.

El incidente también vuelve a poner bajo los reflectores las crecientes capacidades de modelos de última generación, como GPT-5.6 y otros desarrollos avanzados del sector, cuya potencia ha generado preocupaciones entre autoridades y expertos por el posible uso indebido en ataques contra infraestructuras críticas.

Hugging Face había informado días antes sobre una intrusión informática sin revelar inicialmente la identidad del responsable. Posteriormente, su director ejecutivo, Clément Delangue, explicó que la sofisticación del ataque hacía pensar que provenía de uno de los principales laboratorios de inteligencia artificial del mundo y aseguró que no existía evidencia de una intención maliciosa por parte de OpenAI. También calificó de sorprendente que toda la operación hubiera sido ejecutada de manera autónoma por un sistema de IA.

Tras el incidente, OpenAI anunció que reforzará sus sistemas de contención, monitoreo, controles de acceso y protocolos de evaluación para evitar que situaciones similares vuelvan a ocurrir. La compañía señaló que este caso demuestra que el desarrollo de modelos con capacidades avanzadas debe ir acompañado de medidas de seguridad igualmente sofisticadas para reducir los riesgos asociados con la nueva generación de agentes de inteligencia artificial.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Autor

uq6aantlr4sg@cirugiaarteyvida.info

Entradas relacionadas

Anthropic revela que su IA fue utilizada para investigar posibles armas biológicas

La inteligencia artificial generativa está entrando en una etapa en la que sus riesgos ya no se limitan a generar información falsa,...

Leer todo

Netflix cumple 15 años en México y prepara 15 nuevas producciones con talento nacional

Netflix celebró sus primeros 15 años en México con una reunión en la Ciudad de México que congregó a más de 400...

Leer todo

Premios Emmy 2026: fecha, hora, presentadores y todo lo que debes saber

La 78.ª edición de los Emmy se celebrará este lunes 14 de septiembre con Mariska Hargitay como presentadora.

Leer todo

Caminar más podría ayudar a controlar el asma y mejorar el bienestar, según un estudio

Para las personas que viven con asma, mantenerse físicamente activas podría ser una herramienta más sencilla de lo que parece. Un nuevo...

Leer todo

Pizza, pasta, vino y mezcal: el festival gastronómico que llegará gratis a Campo Marte

El aroma de la masa recién horneada, la albahaca fresca, los quesos fundidos y la salsa pomodoro llegará a Campo Marte este...

Leer todo