惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V
Visual Studio Blog
量子位
大猫的无限游戏
大猫的无限游戏
Hugging Face - Blog
Hugging Face - Blog
S
SegmentFault 最新的问题
Blog — PlanetScale
Blog — PlanetScale
月光博客
月光博客
Google DeepMind News
Google DeepMind News
小众软件
小众软件
WordPress大学
WordPress大学
宝玉的分享
宝玉的分享
MongoDB | Blog
MongoDB | Blog
B
Blog RSS Feed
博客园 - Franky
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
B
Blog
博客园 - 聂微东
The GitHub Blog
The GitHub Blog
Recent Announcements
Recent Announcements
Y
Y Combinator Blog
Microsoft Security Blog
Microsoft Security Blog
雷峰网
雷峰网
Jina AI
Jina AI
酷 壳 – CoolShell
酷 壳 – CoolShell

Tecnología

El Señor de los Anillos contará con un nuevo videojuego de mundo abierto a cargo de Warhorse Studios Google entra en la era de los agentes con Gemini Spark y un nuevo modelo más rápido y barato Seis años después, Fortnite vuelve al iPhone y Epic anuncia "la batalla final" contra Apple Apple anuncia un sistema para controlar sillas de ruedas desde Vision Pro usando sólo los ojos Si no pagas por X sólo podrás publicar 50 mensajes al día Grok Build, el agente de programación de xAI que aspira a competir con Claude Code y Codex Wilson Blade v10: la raqueta de control más completa de la última década El Chromebook ha muerto, Google presenta el Googlebook Google frustra el primer ataque documentado de hackers que usaron una IA para descubrir vulnerabilidades desconocidas Denuncian en Francia a TikTok por suicidios o trastornos mentales de adolescentes Nintendo claudica y subirá el precio de la Switch 2 Google lanza Fitbit Air, una pulsera de fitness sin pantalla, y rediseña Google Health como un nuevo servicio Nothing Phone (4a) Pro: casi gama alta por 479 euros Apple frente a la Ley de Mercados Digitales: "Nos están obligando a dejar funciones fuera de Europa" Samsung celebra el primer aniversario de The Mind Guardian, la herramienta que identifica señales de deterioro cognitivo Los herederos de Lee Kun-hee (Samsung) pagan un impuesto de sucesiones de récord: 6.800 millones, casi el 50% del patrimonio Los dueños de los últimos modelos de iPhone podrían recibir hasta 80 euros tras una demanda colectiva contra Apple Estas son las peores contraseñas del mundo para proteger tus cuentas: si tienes una de ellas, te ayudamos a cambiarla por una más segura Meta identificará a los usuarios menores de edad por sus huesos Motorola renueva todo su catálogo con nueve nuevos móviles Un cofundador de Anthropic cree que la IA empezará a desarrollarse a sí misma antes de 2029 Descubren estructuras en el oro que permitirán crear dispositivos electrónicos más pequeños y fiables EE.UU. frena el despliegue de Mythos, el nuevo modelo de lenguaje de Anthropic Europa fuerza el cambio: desde 2027 los móviles deberán tener baterías reemplazables El Mundo Japan Airlines probará robots humanoides para la asistencia en tierra en los aeropuertos Pornografía falsa y cuentas robadas: los socios de Meta y Facebook que utilizan pishing para estafar a sus usuarios El Mundo El Mundo El rey del zoom en los móviles es el Find X9 Ultra y Oppo lo acaba de estrenar en España
El Mundo
�ngel Jim�nez de Luis · 2026-04-22 · via Tecnología

El modelo llega con dos modos de funcionamiento, imágenes de hasta 2K y resuelve por fin el gran talón de Aquiles de la IA generativa: escribir texto legible dentro de una imagen

Ilustración generada por ChatGPT Images 2.0

Ilustración generada por ChatGPT Images 2.0E. M.

Actualizado

Hace dos años, al pedirle a un generador de imágenes que dibujase la carta de un restaurante mexicano, la IA devolvía platos inventados como una "enchuita" o un "burrto". La tipografía se desarmaba, las letras se repetían de forma caprichosa y cualquier texto de más de cuatro palabras acababa pareciendo un jeroglífico.

Era el talón de Aquiles de todas las inteligencias artificiales generativas. Y aunque modelos recientes como Nano Banana de Google, han dado pasos en la dirección correcta, parecía un problema difícil de solucionar. ChatGPT Images 2.0, el nuevo modelo que OpenAI ha presentado este martes, lo consigue. La compañía lo describe como un salto cualitativo respecto a GPT-Image-1.5, lanzado apenas cuatro meses, y la novedad más visible es precisamente el manejo del texto. El modelo es capaz de plasmar desde pequeñas etiquetas hasta bloques densos de prosa con una precisión que roza la perfección. Puede incluso generar capturas de pantallas indistinguibles de las capturadas en un ordenador real.

Durante las últimas semanas, el sistema ha estado disponible de forma anónima en la plataforma LM Arena bajo el nombre en clave duct tape. Varios usuarios, sin saber que se trataba del modelo de OpenAI, han destacado su capacidad para reproducir capturas de pantalla realistas, portadas de revista y hasta interfaces de aplicaciones completas.

OpenAI presume de que Images 2.0 puede, de hecho, diseñar revistas enteras, infografías, mapas, secuencias de manga o carteles publicitarios listos para imprimir. La resolución llega hasta 2K, con múltiples relaciones de aspecto, y el sistema acepta generar hasta ocho imágenes a partir de una sola instrucción manteniendo coherencia de personajes y objetos entre ellas. Esta capacidad abre la puerta a que puedan crear incluso storyboards, cómics enteros o campañas gráficas sin tener que encadenar instrucciones una tras otra.

DOS VELOCIDADES

El modelo llega dividido en dos versiones. Instant genera imágenes rápidas, pensadas para usos casuales. Thinking, reservada a los suscriptores de pago, razona antes de dibujar, verifica lo que crea y puede consultar la web para incorporar datos actualizados. Esta última capacidad es la novedad más interesante. Si se le pide una infografía con cifras recientes o el logotipo correcto de una empresa, el modelo puede buscar la información antes de crearlo.

A cambio, es más lento. Generar una tira cómica o una infografía compleja puede tardar varios minutos, según reconoce la propia OpenAI. Está entrenado con datos que llegan hasta diciembre de 2025, así que para cualquier hecho posterior necesita consultar en la web.

Otra mejora relevante es el soporte de alfabetos no latinos. El japonés, el coreano, el hindi, el bengalí y el chino son lenguas con las que los generadores de imagen han tropezado en el pasado por la dificultad de dibujar correctamente sus caracteres. Images 2.0 los maneja con una fluidez mucho mayor, hasta el punto de producir material editorial en esos idiomas sin que el texto se convierta en ruido visual.

Images 2.0 está disponible desde hoy para todos los usuarios de ChatGPT, con el modo Thinking limitado a las cuentas de pago. Los desarrolladores también podrán acceder al modelo a través de la API, con un precio variable en función de la resolución y la calidad solicitada. OpenAI también lo integrará en Codex, su aplicación para desarrolladores en Mac.