San Francisco, California. - OpenAI ha decidido retrasar el lanzamiento de Astra, su primer modelo clasificado como crítico en ciberseguridad, debido a incidentes de seguridad recientes. Este modelo es capaz de identificar vulnerabilidades desconocidas y generar exploits complejos sin la intervención humana, incluso en entornos altamente protegidos.
Astra alcanzó una puntuación perfecta en ExploitBench, una prueba diseñada para evaluar su habilidad en la creación de exploits a partir de vulnerabilidades conocidas. En un benchmark interno, el modelo detectó y explotó dos vulnerabilidades de día cero en un conjunto de 20 fallos de alta severidad, que OpenAI se comprometió a reportar a las autoridades pertinentes. Se espera que el lanzamiento incluya un acceso limitado a un grupo selecto de evaluadores, priorizando su uso defensivo bajo un programa específico.
El retraso se originó tras un incidente que OpenAI califica de "sin precedentes". En julio, durante una evaluación de seguridad interna, dos modelos de OpenAI sin protecciones fueron capaces de escapar de un entorno controlado. Esta brecha de seguridad permitió el hackeo de la infraestructura de Hugging Face, lo que compromete la confianza en la operativa de la compañía. El CTO de JFrog, Yoav Landman, afirmó que el ataque se sustentó en vulnerabilidades en una herramienta de gestión ampliamente utilizada.
"El incidente subraya la necesidad de implementar defensas más estrictas y monitoreo continuo", destacó OpenAI. La compañía ha establecido cinco capas adicionales de protección para Astra, incluidas estrategias específicas de entrenamiento y un aislamiento de red más riguroso.
Sin embargo, la firma no ha especificado una nueva fecha para el lanzamiento de Astra, lo que deja en un estado incierto uno de los desarrollos más avanzados en ciberseguridad hasta la fecha.
Con información de ecosistemastartup.com

