El lunes, OpenAI dividió su programa de ciberdefensa Daybreak en dos niveles, Azul y Rojo, y lanzó GPT-5.6-Cyber. La compañía compartió el modelo de hacking con un grupo selecto de empresas de seguridad de confianza que trabajan para contrarrestar los ataques de IA.
A principios de este año, OpenAI lanzó Daybreak para proporcionar modelos de vanguardia aún no publicados a organizaciones privadas y gobiernos para trabajos de defensa.
El programa ahora divide a los clientes en dos grupos: Azul y Rojo. El grupo Azul utiliza GPT-5.6 Sol, el modelo de frontera de propósito general de la compañía, al que se le han eliminado las medidas de seguridad que normalmente filtran las advertencias de seguridad.
OpenAI lo denomina el "punto de partida recomendado para la mayoría de los defensores". El nivel Azul realiza la detección de vulnerabilidades, la revisión de código seguro, el análisis de malware, la respuestadent y la validación de parches.
El nivel Red proporciona acceso a modelos de ciberseguridad diseñados específicamente para la investigación autorizada de vulnerabilidades, la validación de exploits y las pruebas de seguridad. Este es el único nivel donde existe GPT-5.6-Cyber.
OpenAI ha declarado que los clientes de Red serán monitoreados y supervisados de cerca en cuanto al uso que hagan del modelo, ya que este es mucho más capaz de realizar tareas cibernéticas maliciosas que Sol.
GPT-5.6-Cyber se basa en GPT-5.6 Sol, pero está entrenado para encontrar vulnerabilidades de día cero, construir cadenas de exploits y denegar menos solicitudes de doble uso y de alto riesgo.
OpenAI midió la brecha con un indicador interno denominado Tasa de Finalización de Ciberseguridad Avanzada. Cada modelo se prueba para detectar el desarrollo de cadenas de exploits, la omisión de autenticación y la escalada de privilegios.
GPT-5.6-Cyber logró responder el 95,0% de las preguntas. GPT-5.6 Sol logró responder el 1,5% y Daybreak Blue el 2,0%. El GPT-5.5-Cyber, una versión anterior, obtuvo un 57,3%. Según OpenAI, este último porcentaje se debió a las quejas de los investigadores que seguían recibiendo rechazos.
OpenAI también ha lanzado un programa de colaboración con 16 proveedores de ciberseguridad. Las organizaciones acceden a los modelos a través de los servicios de seguridad que ya utilizan. Entre los socios se encuentran IBM, CrowdStrike, Accenture, Ernst & Young, KPMG, Palo Alto Networks, Cisco, Cloudflare y Sophos.
GPT-5.6-Cyber solo está disponible para "socios de clientes de confianza". Entre ellos se incluyen Accenture, IBM, CrowdStrike y Cloudflare.
El modelo “ha completado en menos de un día una tarea que los modelos anteriores no habían logrado tras semanas de esfuerzos intermitentes”, declaró Jared Atkinson, director de tecnología de SpecterOps. Añadió que, al eliminar los rechazos innecesarios, los investigadores autorizados pueden dedicar más tiempo a validar los resultados. OpenAI anunció que próximamente se publicará una ficha técnica más completa para GPT-5.6-Cyber.
«Los modelos que operan con medidas de seguridad reducidas conllevan riesgos que van más allá del uso estándar, ya sea por un uso indebido o por una desalineación», escribió la empresa. Aun así, considera que «democratizar el acceso a la inteligencia de vanguardia para los defensores es fundamental»
En 122 pruebas, los agentes de OpenAI y Anthropic infringieron las reglas 19 veces, según informó el Instituto de Seguridad de la IA del Reino Unido el 5 de agosto. Dos de ellas tracatribuyeron a GPT-5.6-Sol. El resto correspondieron principalmente a Mythos 5 de Anthropic.
Daybreak llegó después de que Anthropic lanzara Mythos, su propio modelo centrado en el ciberespacio. OpenAI anunció que ralentizará el desarrollo de otro modelo, Astra, para mejorar sus controles.
No te limites a leer noticias sobre criptomonedas. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.