


























我一直对「AI 能不能理解摄影风格」这件事有点怀疑。
不是能不能把一张照片调成某种色调,滤镜早就能做到。真正难的是:它能不能理解一种摄影语言背后的克制、距离感和观看方式?比如川内倫子(因为我超爱)那种轻、淡、微微过曝,却并不空洞的照片。

于是我拿 10 张九州旅行照片做了一次小实验:用完全相同的提示词,让 6 个图像模型把它们改成「川内倫子风格」。看看哪个AI最能在保留原片的基础上,把照片翻译成另一种视觉语言。
Re-render this photograph with the visual sensibility of Rinko Kawauchi: a softly desaturated pastel palette, faint film grain, gently blown-out yet not harsh highlights, an airy mist-like atmosphere. You may improve the image with a modest crop, slight rotation, horizon straightening, or vertical-line correction, and you may remove distracting edge areas by cropping. Preserve the original scene identity, main subjects, important visual elements, and natural perspective. Only refine the frame boundary, angle, color, light, and texture.
我刻意没有要求「完全模仿某张作品」,而是这样做了视觉语言的描述:低饱和、粉彩、颗粒、柔和高光、轻盈空气感。我更想测试模型对摄影风格的抽象理解,而不是让它复制某个具体构图。
下面这张图每一行是一张照片,从左到右依次是:原图、GPT-5.4 Image 2、Gemini 3 Pro、Seedream 4.5、FLUX.2 Max、Grok Imagine、Qwen Image 2.0。

GPT-5.4 Image 2:夯,效果很棒,能理解风格,而不是单纯的加滤镜
Gemini 3 Pro:神级,整体效果还可以,但是所有的照片都有点发白的塑料感
Seedream 4.5:拉完了,全都是加了滤镜,还是坏胶卷滤镜
FLUX.2 Max:NPC,成功的图还不错,但一和四有点莫名其妙
Grok Imagine:拉完了,统一的滤镜,有几张图幻觉了
Qwen Image 2.0:人上人,没有乱改,效果也不错
| 模型 | 接入方式 | 平均耗时 | 单张成本 | 10 张合计 |
|---|---|---|---|---|
| GPT-5.4 Image 2 | OpenRouter | ~228 秒 | ~$0.24 | ~$2.39 |
| Gemini 3 Pro Image Preview | OpenRouter | ~30 秒 | ~$0.14 | ~$1.38 |
| FLUX.2 MAX | OpenRouter | ~33 秒 | ~$0.10 | ~$1.00 |
| Seedream 4.5 | OpenRouter | ~29 秒 | ~$0.04 | ~$0.40 |
| Grok Imagine | X.ai | ~44 秒 | ~$0.11 | ~$1.10 |
| Qwen Image 2.0 | Aliyun | ~17 秒 | ~$0.02 | ~$0.20 |
如果只选一个「最好用」的,我会选 GPT-5.4 Image 2。速度虽然慢,但是效果我还是比较认可的,直接发朋友圈问题不大。
如果按性价比选,Qwen Image 2.0 便宜又快,效果也可以接受。
不过AI再努力,这些照片也跟川内的照片差很多,颜色、光感和颗粒很容易学,难的是「为什么在这个瞬间按下快门」,我的摄影技术还是差了太多。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。