惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 司徒正美
The GitHub Blog
The GitHub Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Apple Machine Learning Research
Apple Machine Learning Research
L
LangChain Blog
GbyAI
GbyAI
博客园_首页
V
Visual Studio Blog
Martin Fowler
Martin Fowler
WordPress大学
WordPress大学
H
Hackread – Cybersecurity News, Data Breaches, AI and More
博客园 - 叶小钗
腾讯CDC
博客园 - Franky
IT之家
IT之家
Google DeepMind News
Google DeepMind News
Microsoft Azure Blog
Microsoft Azure Blog
D
Docker
大猫的无限游戏
大猫的无限游戏
Recent Announcements
Recent Announcements
小众软件
小众软件
博客园 - 三生石上(FineUI控件)
B
Blog
酷 壳 – CoolShell
酷 壳 – CoolShell

Portada // elmundo

Muere a los 48 años Alex Manninger, ex portero del Arsenal, Juventus y Espanyol tras ser arrollado su coche por un tren El Supremo rechaza la suspensi�n cautelar�sima del decreto de regularizaci�n de inmigrantes El Mundo Sumar amenaza al PSOE con apoyarse en el PP para desbloquear la ley que da la nacionalidad a los saharauis tras quedar fuera de la regularizaci�n Esposada a los 86 a�os: el amargo final de la 'love story' de la viuda francesa de un estadounidense detenida por el ICE Estas son las mejores cuentas de ahorro de abril de 2026 Los jueces de Instrucción de Madrid salen en defensa de Peinado ante los "ataques" y "descalificaciones" del Gobierno Puigdemont rompe su relación con Yolanda Díaz tras acusar a Junts de "racista": "Buen viento. La próxima vez que el PP te haga vicepresidenta" Las listas de espera vuelven a crecer: 4.925.648 pacientes, 853.509 para una cirugía y 4.072.139 para ver al especialista Repsol firma un acuerdo con el Gobierno de Delcy Rodr�guez y recupera el control de sus operaciones en Venezuela Stella McCartney lanza una nueva colaboración con H&M 20 años después: "Si la moda sostenible no es democrática, no funcionará. Hoy el sistema hace que lo correcto sea más caro" Menchu Gal, la artista incansable que decidió ser pintora Alejo Sauras, actor: "El fenómeno fan es muy duro. Cuando todas quieren ligar contigo, no ligas con ninguna" Love Story y la mentira de los 90 Vox marca distancias con Trump meses después que sus aliados europeos y cuida a Meloni tras caer Orban "China ha manipulado las palabras de S�nchez y no es la primera vez": los diplom�ticos, ante el 'apoyo' espa�ol a la anexi�n de Taiw�n El Gobierno descarta un adelanto de las elecciones por el juicio a Bego�a G�mez: "Ser�n cuando toca que sean" La novia que sobrevivi� a un terremoto y se cas� con su rescatador en la China de las bodas grupales militares Un nuevo avance con la terapia gen�tica del 'corta-pega' logra silenciar el cromosoma extra en el s�ndrome de Down 26 restaurantes de Madrid se rinden a los sabores de Navarra El fracaso rotundo de las zapatillas de Zapatero que promet�an casa: las Keli Finder, dos d�cadas despu�s Cartas lacrimosas Por qué Sherlock Holmes sigue siendo un fenómeno inagotable: "Aún necesitamos alguien que sea más inteligente que todas las fuerzas del mal" El Mundo Luc�a Gal�n, pediatra: "Instagram me bloque� por hablar de vacunas con fuentes oficiales: 'contenido inapropiado'" Los mejores ejercicios para bajar barriga y conseguir un abdomen plano en casa Herida una ni�a tras recibir un disparo en el patio de un colegio de Badajoz El orgullo en Múnich no evita una derrota que aboca al Madrid a un año en blanco La decisiva roja a Camavinga en el Bayern-Real Madrid y la duda con el árbitro: "Creo que no sabía que era la segunda" Aldama pag� un catering para 5 ministros de S�nchez con Delcy Rodr�guez en el chal� de El Viso
El Mundo
�ngel Jim�nez de Luis · 2026-04-22 · via Portada // elmundo

El modelo llega con dos modos de funcionamiento, imágenes de hasta 2K y resuelve por fin el gran talón de Aquiles de la IA generativa: escribir texto legible dentro de una imagen

Ilustración generada por ChatGPT Images 2.0

Ilustración generada por ChatGPT Images 2.0E. M.

Actualizado

Hace dos años, al pedirle a un generador de imágenes que dibujase la carta de un restaurante mexicano, la IA devolvía platos inventados como una "enchuita" o un "burrto". La tipografía se desarmaba, las letras se repetían de forma caprichosa y cualquier texto de más de cuatro palabras acababa pareciendo un jeroglífico.

Era el talón de Aquiles de todas las inteligencias artificiales generativas. Y aunque modelos recientes como Nano Banana de Google, han dado pasos en la dirección correcta, parecía un problema difícil de solucionar. ChatGPT Images 2.0, el nuevo modelo que OpenAI ha presentado este martes, lo consigue. La compañía lo describe como un salto cualitativo respecto a GPT-Image-1.5, lanzado apenas cuatro meses, y la novedad más visible es precisamente el manejo del texto. El modelo es capaz de plasmar desde pequeñas etiquetas hasta bloques densos de prosa con una precisión que roza la perfección. Puede incluso generar capturas de pantallas indistinguibles de las capturadas en un ordenador real.

Durante las últimas semanas, el sistema ha estado disponible de forma anónima en la plataforma LM Arena bajo el nombre en clave duct tape. Varios usuarios, sin saber que se trataba del modelo de OpenAI, han destacado su capacidad para reproducir capturas de pantalla realistas, portadas de revista y hasta interfaces de aplicaciones completas.

OpenAI presume de que Images 2.0 puede, de hecho, diseñar revistas enteras, infografías, mapas, secuencias de manga o carteles publicitarios listos para imprimir. La resolución llega hasta 2K, con múltiples relaciones de aspecto, y el sistema acepta generar hasta ocho imágenes a partir de una sola instrucción manteniendo coherencia de personajes y objetos entre ellas. Esta capacidad abre la puerta a que puedan crear incluso storyboards, cómics enteros o campañas gráficas sin tener que encadenar instrucciones una tras otra.

DOS VELOCIDADES

El modelo llega dividido en dos versiones. Instant genera imágenes rápidas, pensadas para usos casuales. Thinking, reservada a los suscriptores de pago, razona antes de dibujar, verifica lo que crea y puede consultar la web para incorporar datos actualizados. Esta última capacidad es la novedad más interesante. Si se le pide una infografía con cifras recientes o el logotipo correcto de una empresa, el modelo puede buscar la información antes de crearlo.

A cambio, es más lento. Generar una tira cómica o una infografía compleja puede tardar varios minutos, según reconoce la propia OpenAI. Está entrenado con datos que llegan hasta diciembre de 2025, así que para cualquier hecho posterior necesita consultar en la web.

Otra mejora relevante es el soporte de alfabetos no latinos. El japonés, el coreano, el hindi, el bengalí y el chino son lenguas con las que los generadores de imagen han tropezado en el pasado por la dificultad de dibujar correctamente sus caracteres. Images 2.0 los maneja con una fluidez mucho mayor, hasta el punto de producir material editorial en esos idiomas sin que el texto se convierta en ruido visual.

Images 2.0 está disponible desde hoy para todos los usuarios de ChatGPT, con el modo Thinking limitado a las cuentas de pago. Los desarrolladores también podrán acceder al modelo a través de la API, con un precio variable en función de la resolución y la calidad solicitada. OpenAI también lo integrará en Codex, su aplicación para desarrolladores en Mac.