OpenAI lanza ChatGPT Images 2.5, una IA más rápida que permite dibujar dentro del chat
OpenAI ha presentado ChatGPT Images 2.5, su nuevo modelo de inteligencia artificial para generar y editar imágenes. La actualización mejora la capacidad del sistema para seguir instrucciones, conservar los elementos de una imagen de referencia y resolver encargos visuales complejos.
La compañía también asegura que esta versión es más rápida que ChatGPT Images 2.0, estrenada en abril. La latencia, es decir, el tiempo que transcurre entre la petición del usuario y la respuesta del sistema, se ha reducido a la mitad. En la práctica, esto debería traducirse en esperas más breves sin renunciar a la calidad de las imágenes.
Sketch permite convertir garabatos en imágenes
La principal novedad para los usuarios de ChatGPT es Sketch, una herramienta que permite dibujar directamente en la ventana de conversación. Para activarla basta con escribir @sketch en el chat, tras lo que aparece un recuadro de dibujo.
El usuario puede realizar un boceto sencillo con el ratón o con el dedo, añadir varios colores y pedir después que la inteligencia artificial lo transforme. Un garabato puede servir como base para crear un personaje, un diseño, una ilustración o cualquier otra propuesta visual.
Esta función busca reducir la distancia entre una idea y el resultado final. En lugar de describir únicamente una imagen mediante texto, el usuario puede proporcionar una referencia visual, aunque sea rudimentaria, para orientar al modelo.
Más precisión en rostros, texturas e iluminación
ChatGPT Images 2.5 incorpora mejoras en varios aspectos que suelen marcar la diferencia en la generación de imágenes. OpenAI destaca la creación de texturas más detalladas y una iluminación más natural, dos elementos importantes para conseguir resultados menos artificiales.
El modelo también es más preciso al conservar rostros y otros componentes presentes en imágenes de referencia. Esta capacidad resulta especialmente relevante cuando se trabaja con fotografías, personajes concretos o materiales que contienen información del mundo real.
Otra mejora está relacionada con las instrucciones visuales complejas. La IA puede interpretar mejor peticiones que combinan diferentes objetos, posiciones, estilos, colores o condiciones de iluminación. Esto debería facilitar la creación de composiciones con varios elementos sin que el sistema ignore parte de las indicaciones.
Fondos transparentes y plantillas para empezar desde una base
La nueva versión también permite generar imágenes con fondos transparentes de forma más consistente. Esta función resulta útil para crear logotipos, recursos gráficos, personajes, productos o elementos destinados a integrarse posteriormente en otros diseños.
Los fondos transparentes han sido durante años uno de los puntos débiles de los generadores de imágenes. Aunque muchos modelos podían simularlos, no siempre entregaban un archivo realmente preparado para reutilizarse en una composición. La mejora puede ser importante para diseñadores, negocios y creadores de contenido.
OpenAI ha añadido además una colección de plantillas prediseñadas. Los usuarios pueden elegir una categoría y comenzar el trabajo a partir de una propuesta parcial, en lugar de crear cada imagen desde cero.
- Logotipos e identidad visual.
- Diseño de interiores.
- Pósteres y carteles.
- Material promocional y merchandising.
Estas plantillas pueden servir para que pequeños negocios y emprendimientos preparen recursos gráficos con mayor rapidez. Sin embargo, el resultado final dependerá de la personalización que se aplique, ya que partir de diseños predeterminados también puede conducir a imágenes demasiado parecidas entre sí.
Disponibilidad en ChatGPT y nuevas opciones para desarrolladores
ChatGPT Images 2.5 se está desplegando en todas las versiones de ChatGPT, incluida la gratuita. También estará disponible a través de Codex y ChatGPT Work, las herramientas de OpenAI orientadas a la programación y al trabajo profesional.
Los desarrolladores que quieran integrar la generación de imágenes en sus propias aplicaciones podrán utilizar la API de OpenAI. En este caso, la compañía ofrece dos variantes del modelo: GPT-Image-2.5 Flare, con las mismas capacidades que la versión integrada en ChatGPT, y GPT-Image-2.5 Sunburst, una alternativa más avanzada.
Una API es una interfaz que permite a un programa comunicarse con otro servicio. En este caso, una aplicación externa puede enviar una instrucción y recibir una imagen generada por los servidores de OpenAI, sin necesidad de incorporar el modelo completo en sus propios equipos.
El precio de la API se mantiene, aunque sigue siendo elevado
El coste de ChatGPT Images 2.5 mediante la API es el mismo que el de Images 2.0. Los dos modelos tienen un precio de hasta 8 dólares por cada millón de tokens de entrada y 30 dólares por cada millón de tokens de salida.
Los tokens son las unidades en las que el sistema procesa el texto y otros datos asociados a una petición. En una herramienta de generación de imágenes, los tokens de entrada corresponden a las instrucciones o referencias enviadas al modelo, mientras que los de salida representan la respuesta producida por la inteligencia artificial.
Mantener las tarifas puede facilitar la adopción de la tecnología, pero el uso intensivo continúa siendo costoso. Para una persona que genera imágenes de forma ocasional el impacto será limitado; para una empresa que produce miles de recursos visuales, el gasto puede crecer rápidamente.
Con ChatGPT Images 2.5, OpenAI refuerza su apuesta por una generación de imágenes más rápida, precisa y accesible desde la conversación. La combinación de Sketch, las plantillas y el soporte para fondos transparentes convierte a ChatGPT en una herramienta más completa para pasar de una idea inicial a un diseño utilizable.



