← Todos los artículos

ChatGPT Images 2.5 (Sunburst y Flare): qué puede hacer el nuevo modelo y cómo probarlo en tu navegador

El anuncio de GPT-Image-2.5: modelos Sunburst y Flare, fotograma de la demostración oficial de OpenAI

OpenAI ha lanzado una nueva generación de generación de imágenes:GPT-Image-2.5. La familia incluye dos modelos:Sunburst, centrado en detalles más nítidos, iluminación más natural y mayor control en las ediciones, yFlare, construido para la velocidad. Ambos admiten fondos transparentes y están disponibles a través del API. Hemos agregado ambas variantes familiares a nuestro sitio comoChatGPT Images 2.5— puedes generar y editar imágenes directamente en el navegador, sin necesidad de claves API ni suscripciones:la página del modelo en NeuralSpace(el enlace abre el generador con el modelo ya seleccionado).

Fotograma de la demostración oficial de OpenAI: el anuncio de GPT-Image-2.5 - modelos Sunburst y Flare

Novedades respecto a la generación anterior

Según sorteos OpenAI, Sunburstdetalles notablemente más nítidosconiluminación más naturaly, lo más importante, te brinda más control al editar: largas series de ediciones en un solo cuadro ya no se desmoronan. Flare es el hermano más rápido: ofrece imágenes de alta calidad más de un 50% más rápido.

Ambas variantes están disponibles en el sitio: Sunburst para ediciones precisas y de calidad, Flare para velocidad y pruebas de ideas. El precio no depende de la variante, sólo de la resolución.

Dos variantes y tres resoluciones en lugar de niveles de calidad

La generación 2.5 no tiene una escala de baja a máxima: en cambio, hay una variante y una resolución.Sunburstdibuja con mayor precisión y respeta los límites de edición;Flareofrece un marco terminado notablemente más rápido. La resolución fija el detalle y el precio:1Kpara borradores y probar ideas,2Kcomo centro de trabajo para redes sociales y sitios web,4Kcomo final para impresión y gran formato.

La estrategia económica: borradores el Flare 1K, un final el Sunburst 2K o el 4K desde el mejor mensaje. El precio se cuenta por imagen y se muestra.antespresionas generar: no hay sorpresas en el saldo y, si la generación falla, los tokens se reembolsan automáticamente.

Serie de ediciones a partir de una única imagen de origen

La habilidad distintiva de esta generación es la edición. En la demostración oficial de OpenAI, se aplica una larga serie de ediciones a un cuadro inicial: cambiar el color de la chaqueta, reemplazar el fondo, agregar anteojos, cambiar la escena a un clima lluvioso, volver a dibujarla en colores pastel o como una acuarela arquitectónica, y cada paso cambia solo lo que se pidió.

Fotograma de la demostración oficial de OpenAI: una serie de ediciones en una imagen fuente: color de la chaqueta, fondo, anteojos

En el sitio, el modo de edición se activa automáticamente: adjunte de una a dieciséis imágenes de referencia (hasta 30 MB cada una) y escriba una instrucción. No hay una alternancia separada: el modelo entiende el modo a partir de la presencia de imágenes en la solicitud.

Lo que muestra la demostración de la aplicación ChatGPT: boceto, ediciones específicas y plantillas

Junto con el lanzamiento del modelo, OpenAI actualizó la aplicación ChatGPT y las revisiones prácticas muestran bien el carácter de esta generación. Primero,entrada basada en bocetos: en la aplicación puedes dibujar un diagrama aproximado de una escena (una caja para el sofá, ventanas, la silueta de un perro) y el modelo convierte el garabato en un interior completo: interpreta el boceto incluso sin instrucciones de texto. La generación también se siente notablemente más rápida que antes.

Segundo,herramientas de edición específicasencima del marco terminado: encierra en un círculo un área y pide "poner un gato aquí", deja varios comentarios en un solo lote ("haz que esta planta muera", "agrega un arcoíris afuera", "haz las paredes grises"), resalta un objeto con el borrador para que el modelo entienda qué quitar y llene el espacio limpiamente. Un eliminador de fondo separa un sujeto claro de su fondo con un solo clic.

Tercero,fotos de referencia. Las reseñas muestran al modelo restaurando instantáneas antiguas (quitando el resplandor, límpielo, poniendo al niño un traje, y sigue siendo el mismo niño), rediseñando espacios reales (un patio trasero de grava se convierte en un jardín de rocas) y componiendo tres retratos separados en una sola foto. Otra habilidad destacada espreservación de la identidad: las personas y los animales se mantienen reconocibles a lo largo de largas series de edición: la imagen no se deteriora de una iteración a otra, que es donde los modelos de imagen generalmente eran criticados. La aplicación también ganóplantillas— puntos de partida para formatos populares: logotipos, carteles, diseño de interiores, ilustración.

La entrada de bocetos y las plantillas son comodidades de la aplicación ChatGPT y no forman parte de API. En nuestro sitio están disponibles ambas variantes, Sunburst y Flare: generación de texto a imagen, edición basada en referencias (hasta 16 imágenes de 30 MB cada una: restauración, cambio de color, reemplazo de fondo, rediseño), resoluciones 1K/2K/4K y una docena de relaciones de aspecto. Para restaurar o reelaborar una foto en el sitio, simplemente adjúntela como referencia y escriba una instrucción.

Un caso práctico separado de la revisión esminiaturas de vídeos: el autor reúne una vista previa pegadiza YouTube a través de una serie de ediciones (un fondo más impactante, un tema grande, una apariencia legible): la misma mecánica de edición específica, solo que se puede "hacer clic" en el objetivo en lugar de ser "bonito". En el sitio esta tarea funciona de la misma manera: adjunta un marco como referencia y agrega una instrucción sobre el fondo y el acento.

Precisión en los detalles

La segunda característica es la puntualidad en el cumplimiento de los pequeños detalles: cuántos objetos hay, de qué lado, qué marca el reloj, cuántos pisos tiene el edificio. La demostración de OpenAI muestra cuadros donde el modelo reproduce varias condiciones exactas de la descripción a la vez.

Fotograma de la demostración oficial de OpenAI: el modelo reproduce detalles exactos de la descripción: poses, recuento de objetos, manecillas del reloj.

Transparencia nativa lista para usar

Ambos modelos en la familia apoyan.transparencia nativa: un objeto con un canal alfa completo está listo instantáneamente para collages, diseños o juegos, sin recortes manuales. La demostración muestra un objeto compuesto sobre nuevos fondos.

Fotograma de la demostración oficial de OpenAI: transparencia nativa: alfa completo de PNG, el objeto se coloca sobre nuevos fondos

Una nota sobre el sitio: el generador no tiene un interruptor de fondo transparente separado; esta sección describe lo que el modelo puede hacer en la demostración OpenAI, no una opción en la página del modelo.

cuanto cuesta

Las tarifas de token de OpenAI para 2.5 coinciden con las de la generación anterior, y en el sitio el precio por imagen depende solo de la resolución (1K/2K/4K), que siempre se muestra antes de presionar generar. Borradores el Flare 1K, finales el Sunburst 2K o 4K. Paga desde su saldo de token interno; no se requiere suscripción.

Pruébalo en el navegador

El modelo ya está activo en el estudio de generación de imágenes: seleccione "ChatGPT Images 2.5" en la lista de modelos, describa el marco y adjunte referencias si es necesario.Abierto ChatGPT Images 2.5 el NeuralSpace.