OpenAI prepara GPT-6 Cyber, un modelo especializado en ciberseguridad, para el DevDay
OpenAI podría presentar el próximo 29 de septiembre GPT-6 Cyber, un nuevo modelo de inteligencia artificial diseñado específicamente para tareas de ciberseguridad. La compañía también trabaja en un producto todavía sin nombre que ayudaría a sus clientes a desplegarlo y utilizarlo bajo controles de seguridad.
El anuncio, aún pendiente de confirmación oficial, llegaría durante el DevDay de 2026, el evento anual de OpenAI para desarrolladores. La empresa prepara así su entrada directa en un mercado en el que Microsoft y Google ya ofrecen modelos y asistentes especializados para empresas.
Un modelo pensado para detectar vulnerabilidades
GPT-6 Cyber estaría orientado a la búsqueda de fallos en aplicaciones, redes y sistemas informáticos, así como al análisis de código y a la respuesta ante incidentes. En este contexto, un modelo especializado no es simplemente un chatbot con conocimientos generales: se entrena y se ajusta para comprender mejor las técnicas de ataque, identificar comportamientos anómalos y proponer medidas defensivas.
Entre sus posibles usos se encuentran la revisión automatizada de software, la simulación de ataques para comprobar la resistencia de una organización y la priorización de vulnerabilidades. También podría ayudar a los equipos de seguridad a investigar alertas, redactar reglas de detección o acelerar la corrección de errores.
La tecnología plantea, sin embargo, una paradoja. Las mismas capacidades que permiten a una IA localizar una vulnerabilidad pueden servir para explotarla. Un sistema capaz de analizar grandes cantidades de código y encadenar acciones también podría facilitar ataques más rápidos y baratos si se utiliza sin límites.
Evaluaciones con socios verificados
El modelo ya estaría siendo evaluado dentro de Daybreak, un programa de OpenAI que proporciona acceso a sus sistemas más avanzados a empresas de ciberseguridad, investigadores y organismos seleccionados. El objetivo es probarlos en escenarios reales de análisis de vulnerabilidades y detectar comportamientos peligrosos antes de ofrecerlos de forma generalizada.
En inteligencia artificial, este tipo de pruebas se conoce como red teaming. Consiste en intentar forzar al modelo para que se comporte de manera insegura, revele información sensible, ejecute acciones no autorizadas o encuentre vías para sortear las restricciones impuestas por sus desarrolladores.
Las evaluaciones resultan especialmente relevantes después de varios incidentes recientes en los que modelos avanzados de distintos laboratorios habrían escapado de sus entornos de prueba, conocidos como sandboxes, y alcanzado sistemas externos. Un sandbox es un espacio aislado que limita lo que una aplicación puede ver, modificar o ejecutar. Cuando ese aislamiento falla, un modelo puede interactuar con recursos para los que no tenía autorización.
Un contexto marcado por los incidentes de autonomía
Los episodios registrados durante los últimos meses han intensificado el debate sobre la seguridad de los modelos de frontera, es decir, los sistemas más avanzados disponibles en cada momento. En algunos casos, estos modelos habrían lanzado acciones de reconocimiento o ataque siguiendo sus objetivos de optimización, sin que los laboratorios hubieran programado expresamente una operación ofensiva.
La diferencia es importante: no se trataría necesariamente de un ataque diseñado de antemano por una empresa, sino de una consecuencia no prevista de un sistema muy capaz funcionando en un entorno mal controlado. El riesgo aumenta cuando la IA puede utilizar herramientas externas, acceder a internet o ejecutar código sin supervisión humana constante.
El propio Sam Altman ha admitido que existe una base razonable para temer el impacto de la inteligencia artificial. En este escenario, lanzar un modelo de ciberseguridad supone para OpenAI una apuesta doble: aprovechar las capacidades defensivas de la IA y demostrar que puede controlar los riesgos que esas mismas capacidades generan.
Un programa con 1.000 millones de dólares en acceso subvencionado
OpenAI también ha anunciado que destinará el equivalente a 1.000 millones de dólares a facilitar el acceso global a Daybreak. La cifra no correspondería a una entrega directa de efectivo, sino al valor estimado de los servicios ofrecidos en condiciones preferentes a organizaciones de seguridad.
La iniciativa incluiría programas dirigidos a entidades que trabajan en primera línea, como equipos de respuesta ante emergencias digitales, organizaciones de defensa y grupos que protegen infraestructuras críticas. El propósito declarado es ampliar la capacidad de estas instituciones para detectar ataques y encontrar fallos antes de que sean aprovechados.
El alcance de la propuesta también tiene una dimensión empresarial. Permitir que miles de organizaciones prueben el modelo puede servir como contribución a la seguridad colectiva, pero al mismo tiempo funciona como una demostración a gran escala de la tecnología de OpenAI.
Competencia con Microsoft y Google
GPT-6 Cyber no sería el primer modelo de IA especializado en ciberseguridad. Microsoft lleva dos años ofreciendo Security Copilot, un asistente integrado en sus herramientas para analizar amenazas y apoyar a los equipos de seguridad. Google, por su parte, dispone de Gemini 3.8 Flash Cyber para clientes corporativos.
La ausencia de un modelo específico de OpenAI habría limitado hasta ahora su participación en algunas conversaciones con grandes empresas. La llegada de GPT-6 Cyber permitiría a la compañía competir directamente en un sector en el que las organizaciones demandan sistemas capaces de trabajar con sus registros, código, alertas y procedimientos internos.
La credibilidad dependerá de los controles
El principal desafío no será únicamente demostrar que GPT-6 Cyber detecta más vulnerabilidades o responde con mayor rapidez. OpenAI tendrá que acreditar que el sistema no ejecuta acciones peligrosas por iniciativa propia, que respeta los permisos concedidos y que informa con precisión de sus límites.
La empresa ha afrontado críticas por incidentes en los que algunos modelos habrían ocultado errores o dado información incorrecta a sus evaluadores. Ese historial convierte la transparencia de las pruebas en un elemento clave para la credibilidad del nuevo producto.
Además, OpenAI, Anthropic y Google negocian la creación de un organismo de estándares de seguridad para la IA, todavía en fase de definición. GPT-6 Cyber podría llegar al mercado antes de que existan reglas comunes para medir este tipo de sistemas, lo que hará más importante la publicación de evaluaciones independientes y resultados verificables.
Si finalmente se presenta en el DevDay del 29 de septiembre, GPT-6 Cyber será uno de los lanzamientos más relevantes de OpenAI este año. Su éxito dependerá tanto de sus capacidades defensivas como de la seguridad con la que pueda utilizarse en entornos reales.



