前言
今天凌晨 GPT 发布了自己的新一代生图模型 GPT Images 2.5 我实测下来是要比上一代生图的速度、质量、自由度高很多,新增的编辑器支持了标注、评论、移除背景、擦除、调整尺寸不用用户去自己用描述需要改哪里,想改哪里标注圈起来就可以让模型快速的知道你想改哪里,语言理解上以及细节控制要比上一代 img-2 好很多。
图像修复与高清重塑
GPT Images 2.5在底层架构上大幅优化了对参考图像的理解与维持能力。这意味着在进行画提升、老照片增强或局部瑕疵修改时,它能完美保留原图的神韵和核心特征,极大程度避免了以往AI修复中越修越走样的尴尬情况。

这不仅仅是一次简单的锐化或放大,而是基于深度语义理解的画面重塑。GPT Images 2.5证明了它能够在不破坏原图神韵的前提下,为低清图像注入真实的生命力。

为了直观展现AI在图像高清重塑时的理解差异,我们以相同的原图和相似的提示词,分别呈现了原始图像、gpt-img-2与Gemini Nano Banana 2三种不同风格的表现,GPT 明显给我一种想展示我能做的很高清饱和度很高的感觉,而Gemini是一种怀旧的风格但是生成多了很多内容比如山和怪兽的爪子。
图片编辑器
新增内置编辑器实现标注即指令,让您直接框选并指定修改,彻底告别繁琐的提示词重写流程。

新增了极具效率的一键抠图功能,它能极其智能地精准识别前景主体,并自动执行复杂的“移除背景、保持主体完整、边缘干净平滑等微调操作,完全免去了用户自行撰写和调试繁琐指令的困扰,真正实现了专业级别的背景透明化。

版本性能对比
通过下方的数据对比,可以直观感受到新版本的全方位进化:
关键特性 | GPT Images 2.0 | GPT Images 2.5 |
|---|---|---|
最高分辨率 | 1024 x 1024 | 原生4K |
文本渲染准确率 | 中等,易出现错别字 | 极高,支持精准排版 |
多主体逻辑控制 | 较弱,易发生元素融合 | 强,主体间界限与交互清晰 |
风格预设数量 | 约20种基础风格 | 超过50种,支持精细化微调 |
结语
GPT Images 2.5不仅仅是一款迭代升级的工具,它更像是延伸人类想象力的数字画笔。它大幅降低了视觉表达的门槛,让每一个脑海中的闪光点都能瞬间跃然纸上。
参考
OpenAI:https://openai.com/index/introducing-chatgpt-images-2-5/
X上的Sam Altman:https://x.com/sama/status/2097410967978324010














