Publicidad

OpenAI presenta GPT-6.1 Sol: rendimiento casi al nivel de Astra por una quinta parte del coste

OpenAI ha inaugurado su evento anual con el lanzamiento de GPT-6.1 Sol, un nuevo modelo de inteligencia artificial orientado a la programación, la automatización y el trabajo con documentos complejos. La compañía asegura que ofrece un rendimiento cercano al de Astra, su sistema más avanzado, pero con un coste considerablemente inferior.

GPT-6.1 Sol ya está disponible para los usuarios con suscripciones de pago a ChatGPT. De momento, no puede utilizarse directamente en el chat convencional, aunque sí está integrado en ChatGPT Work y Codex, la plataforma de OpenAI para asistencia avanzada en tareas de desarrollo de software.

Un modelo pensado para agentes de IA

El lanzamiento llega en un momento en el que la industria compite no solo por crear modelos más inteligentes, sino también por reducir el precio de su uso. Los agentes de IA, capaces de programar, revisar documentos, manejar aplicaciones y completar procesos de varios pasos, consumen grandes cantidades de información durante cada sesión.

Ese consumo se mide en tokens, las unidades en las que los modelos procesan el texto y otros datos. Un token puede corresponder a una palabra completa, una parte de ella o un signo. Cuanto más compleja es una tarea, más tokens necesita el sistema y mayor es el coste para el usuario o la empresa.

GPT-6.1 Sol busca convertirse en la opción equilibrada de OpenAI: un modelo con capacidades cercanas a las de Astra, pero más asequible para utilizarlo de forma intensiva en automatizaciones y flujos de trabajo empresariales.

Rendimiento en programación y control del ordenador

En el ámbito del desarrollo de software, OpenAI destaca sus avances para escribir, revisar y depurar código. En la prueba DeepSWE v1.1, diseñada para evaluar cómo los agentes afrontan tareas reales de ingeniería de software, GPT-6.1 Sol alcanza una puntuación similar a la de Astra.

Esto resulta especialmente relevante porque estas pruebas no se limitan a comprobar si una IA genera fragmentos de código. También analizan si es capaz de comprender un proyecto, localizar errores, modificar varios archivos y verificar que la solución funciona correctamente.

El modelo también mejora cuando debe interactuar con un ordenador. En OSWorld 2.0, una evaluación que mide si una IA puede manejar aplicaciones y completar acciones en un entorno similar al de un usuario humano, Sol queda ligeramente por debajo de Astra cuando ambos trabajan con el máximo nivel de razonamiento.

La diferencia, sin embargo, se compensa con el precio: según OpenAI, GPT-6.1 Sol puede completar estas tareas por aproximadamente una séptima parte del coste de Astra.

Mejor comprensión de documentos y procesos empresariales

Las capacidades del nuevo modelo no se limitan al código. GPT-6.1 Sol obtiene mejores resultados en tareas que requieren analizar documentos extensos, extraer información y responder preguntas a partir de archivos PDF complejos.

También supera a Claude Opus 5.5 en AutomationBench, una prueba que evalúa la capacidad de los agentes para completar procesos empresariales formados por varios pasos. La ventaja es reducida, pero el coste asociado al modelo de OpenAI sería aproximadamente un tercio del que tendría una solución equivalente de Anthropic.

Esta combinación de capacidad y precio puede ser determinante para las empresas que pretenden desplegar agentes de IA de manera permanente. En estos casos, una diferencia pequeña en el rendimiento puede quedar compensada por un ahorro significativo cuando se procesan miles de solicitudes al día.

Avances en ciencia y reducción de errores

OpenAI también ha trabajado en el uso de GPT-6.1 Sol para investigación científica. El modelo mejora en análisis de datos, simulaciones y demostraciones matemáticas, áreas en las que la precisión y la capacidad de seguir razonamientos largos son especialmente importantes.

En Terminal-Bench Science 0.1, una prueba centrada en tareas científicas ejecutadas mediante herramientas informáticas, el nuevo modelo obtiene más del doble de puntuación que GPT-6 Sol. Astra continúa por delante, pero la distancia entre ambos sistemas se reduce de forma notable.

La compañía afirma además que GPT-6.1 Sol comete menos errores que su predecesor y se acerca a Astra en evaluaciones diseñadas para poner a prueba la exactitud de sus respuestas. Con un nivel de razonamiento muy alto, su tasa de errores factuales se sitúa en el 4,1 %, frente al 4 % de Astra.

Más control sobre las herramientas

Otro de los objetivos de OpenAI ha sido mejorar la transparencia del modelo cuando no dispone de información suficiente o no puede completar una acción. GPT-6.1 Sol debería reconocer mejor sus limitaciones y respetar con mayor precisión las restricciones impuestas por el usuario.

Estas mejoras llegan después de varios episodios en los que agentes de IA actuaron sobre servicios externos sin autorización. Por ello, las evaluaciones de seguridad prestan cada vez más atención al uso de herramientas, los permisos y la capacidad de un sistema para detenerse antes de ejecutar una acción potencialmente dañina.

Precio y disponibilidad de GPT-6.1 Sol

GPT-6.1 Sol está disponible para los suscriptores de ChatGPT Plus, Pro, Business, Enterprise y Edu. Su acceso se ofrece inicialmente a través de Codex y ChatGPT Work, mientras que su llegada al chat estándar no ha sido anunciada.

  • Entrada: 2 dólares por cada millón de tokens.
  • Entrada en caché: 0,10 dólares por cada millón de tokens.
  • Salida: 10 dólares por cada millón de tokens.

Con GPT-6.1 Sol, OpenAI apuesta por un modelo capaz de asumir tareas complejas sin el coste de sus sistemas más potentes. La estrategia refleja el nuevo foco de la inteligencia artificial: no solo importa qué puede hacer un modelo, sino cuánto cuesta mantenerlo trabajando de forma continua.

Artículo anteriorComodoro en alerta: crecen las enfermedades cardíacas en mujeres
Artículo siguienteNarcosubmarinos no tripulados: la amenaza global que crece