惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

雷峰网
雷峰网
博客园 - 叶小钗
博客园_首页
阮一峰的网络日志
阮一峰的网络日志
D
Docker
J
Java Code Geeks
B
Blog
G
Google Developers Blog
小众软件
小众软件
博客园 - 聂微东
罗磊的独立博客
大猫的无限游戏
大猫的无限游戏
IT之家
IT之家
量子位
WordPress大学
WordPress大学
美团技术团队
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
宝玉的分享
宝玉的分享
腾讯CDC
Martin Fowler
Martin Fowler
V
Visual Studio Blog
D
DataBreaches.Net
Stack Overflow Blog
Stack Overflow Blog
C
Check Point Blog

HaoUp's Blog

别被发布会冲昏头脑!买 iPhone Duo 前你得知道的几个真相 OpenCode 终于有桌面版了! 升级 macOS 27 后外接屏黑屏?可能是显示器握手出了问题 ChatGPT语音迎来大升级:GPT-Live能边听边说,复杂问题交给后台模型处理 iPhone 照片误删找回攻略:有 iCloud 就能试,限 40 天内(附流程) 谈谈 Apple 27 系统:新鲜,也有点折腾 ChatGPT 生图:一键输出专业分层 PSD 源文件 关掉路由器 DHCP,用 Surge 开出“一机一网”的网络 Codex对话经常连续多次Reconnecting? 与 Codex 共舞数月:从入门到离不开全部功能体验感受 DeepSeek-V4 正式发布:教你如何 CC Switch 极速配置与无缝切换 Codex 居然可以控制我的电脑了! 新国标充电宝,又贵又歪 此帐户不符合 Google AI 计划的资格怎么办? 这工具吹爆:CompressO免费、离线、无广告,视频一拖就瘦身! 终端党狂喜!这款 AI 编程工具不花一分钱,还能把代码留给自己 全网炸锅!Claude Code Cli内部核心代码全部流出 Google Stitch 2026深度解析:从Vibe Design到Voice Canvas,免费AI设计工具如何重塑创意流程 QClaw深度体验:把电脑装进微信,基于 OpenClaw 的全能远程 AI 助手 Orbit —— 改善 macOS 应用切换与文件流转的“环形中枢” Deck一款兼顾原生、隐私的现代macOS剪贴板管理器工具 告别PS修图!iOS神器「超级制图」上手体验:AI无痕改字,一键修改图片文字 年轻人的第一台 Mac?一文看懂全新 MacBook Neo 用 Nugget 安装 iPhone/iPad 动态壁纸 Mac总是弹窗提示更新?2026 最新“养老”指南 Halo站点维护插件(Site Maintenance)使用与配置指南 前端无侵入式翻译方案 告别聊天框OpenAI Codex App上手初体验
探索 GPT Images2.5:AI视觉创作的新纪元
https://blog.528688.cn/authors/xwu528688 · 2026-09-09 · via HaoUp's Blog

前言

今天凌晨 GPT 发布了自己的新一代生图模型 GPT Images 2.5 我实测下来是要比上一代生图的速度、质量、自由度高很多,新增的编辑器支持了标注、评论、移除背景、擦除、调整尺寸不用用户去自己用描述需要改哪里,想改哪里标注圈起来就可以让模型快速的知道你想改哪里,语言理解上以及细节控制要比上一代 img-2 好很多。

图像修复与高清重塑

GPT Images 2.5在底层架构上大幅优化了对参考图像的理解与维持能力。这意味着在进行画提升、老照片增强或局部瑕疵修改时,它能完美保留原图的神韵和核心特征,极大程度避免了以往AI修复中越修越走样的尴尬情况。

这是一个黑色背景界面的截图。屏幕顶部居中用白色字体写着问候语:“你好,HaoUp。准备好开始了吗?”。页面主体是一个深灰色的圆角矩形聊天输入框。输入框内部的左上角附带了一张正方形缩略图,图片展示了经典的奥特曼在户外山野中摆出战斗姿势。图片下方是一行中文提示词:“为这张图片提供更清晰的细节,让人物更具有辨识度,光线和纹理也更加自然。”。输入框的底部左侧有一个白色的“+”号添加图标,底部右侧从左至右依次排列着三个操作按钮:一个带有大脑图标的“思考”按钮、一个麦克风图标,以及一个带有向上箭头的蓝色圆形发送按钮。

这不仅仅是一次简单的锐化放大,而是基于深度语义理解的画面重塑。GPT Images 2.5证明了它能够在不破坏原图神韵的前提下,为低清图像注入真实的生命力。

2026-09-09-sovvpxve.webp

为了直观展现AI在图像高清重塑时的理解差异,我们以相同的原图和相似的提示词,分别呈现了原始图像、gpt-img-2与Gemini Nano Banana 2三种不同风格的表现,GPT 明显给我一种想展示我能做的很高清饱和度很高的感觉,而Gemini是一种怀旧的风格但是生成多了很多内容比如山和怪兽的爪子。

图片编辑器

新增内置编辑器实现标注即指令,让您直接框选并指定修改,彻底告别繁琐的提示词重写流程。

这是一个图像注释界面截图,正在编辑一张奥特曼在山地摆出战斗姿势的照片。顶部和底部 有工具栏和输入框,照片右侧一个手绘的红色气泡框被蓝色选框包围,底部输入了中文提示 词:“在红圈内加上奥特曼文字”。

新增了极具效率的一键抠图功能,它能极其智能地精准识别前景主体,并自动执行复杂的“移除背景、保持主体完整、边缘干净平滑等微调操作,完全免去了用户自行撰写和调试繁琐指令的困扰,真正实现了专业级别的背景透明化。

这是一个AI图像编辑助手的聊天界面截图,全黑色背景。屏幕顶部左上角有通用操作图标 (全屏、编辑、上/下一个、点赞、点踩、分享)。右上角有一个小缩略图,显示原始的奥特 曼在户外山地风景中的图像。中心是一个蓝色的用户对话气泡,包含中文文本:“移除此图像 的背景。保持所有前景主体不变且完整无损,边缘干净平滑。将背景设为透明。”。在此气泡 下方,一个高清晰度的奥特曼角色(红银战服)摆着战斗姿势,悬浮在全黑背景中央。奥特 曼是完整的,边缘看起来非常干净。其下方有中文文本“编辑"和两个图标(下载、分享)。界 面底部是一个深灰色的输入框,左侧有“+"号,文本提示是中文“有问题,随便问”,右侧是大 脑(思考)、麦克风和蓝色的发送按钮。

版本性能对比

通过下方的数据对比,可以直观感受到新版本的全方位进化:

关键特性

GPT Images 2.0

GPT Images 2.5

最高分辨率

1024 x 1024

原生4K

文本渲染准确率

中等,易出现错别字

极高,支持精准排版

多主体逻辑控制

较弱,易发生元素融合

强,主体间界限与交互清晰

风格预设数量

约20种基础风格

超过50种,支持精细化微调

结语

GPT Images 2.5不仅仅是一款迭代升级的工具,它更像是延伸人类想象力的数字画笔。它大幅降低了视觉表达的门槛,让每一个脑海中的闪光点都能瞬间跃然纸上。

参考

OpenAI:https://openai.com/index/introducing-chatgpt-images-2-5/

X上的Sam Altman:https://x.com/sama/status/2097410967978324010

阅读推荐