惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
G
Google Developers Blog
M
MIT News - Artificial intelligence
Vercel News
Vercel News
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
GbyAI
GbyAI
B
Blog RSS Feed
Blog — PlanetScale
Blog — PlanetScale
Microsoft Security Blog
Microsoft Security Blog
V
Visual Studio Blog
Stack Overflow Blog
Stack Overflow Blog
雷峰网
雷峰网
The Cloudflare Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
F
Fortinet All Blogs
L
LangChain Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
A
About on SuperTechFans
T
The Blog of Author Tim Ferriss
B
Blog
J
Java Code Geeks
Hugging Face - Blog
Hugging Face - Blog
I
InfoQ
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派 万字剖析:千问App深度体验报告(2026) - 少数派
AI的审美:谁让把我变成川内倫子 - 少数派
2026-05-07 · via 少数派

我一直对「AI 能不能理解摄影风格」这件事有点怀疑。

不是能不能把一张照片调成某种色调,滤镜早就能做到。真正难的是:它能不能理解一种摄影语言背后的克制、距离感和观看方式?比如川内倫子(因为我超爱)那种轻、淡、微微过曝,却并不空洞的照片。

川内倫子的九张摄影作品

于是我拿 10 张九州旅行照片做了一次小实验:用完全相同的提示词,让 6 个图像模型把它们改成「川内倫子风格」。看看哪个AI最能在保留原片的基础上,把照片翻译成另一种视觉语言。

提示词

Re-render this photograph with the visual sensibility of Rinko Kawauchi: a softly desaturated pastel palette, faint film grain, gently blown-out yet not harsh highlights, an airy mist-like atmosphere. You may improve the image with a modest crop, slight rotation, horizon straightening, or vertical-line correction, and you may remove distracting edge areas by cropping. Preserve the original scene identity, main subjects, important visual elements, and natural perspective. Only refine the frame boundary, angle, color, light, and texture.

我刻意没有要求「完全模仿某张作品」,而是这样做了视觉语言的描述:低饱和、粉彩、颗粒、柔和高光、轻盈空气感。我更想测试模型对摄影风格的抽象理解,而不是让它复制某个具体构图。

结果

下面这张图每一行是一张照片,从左到右依次是:原图、GPT-5.4 Image 2、Gemini 3 Pro、Seedream 4.5、FLUX.2 Max、Grok Imagine、Qwen Image 2.0。

大模型生成结果对比

我的观察

GPT-5.4 Image 2:夯,效果很棒,能理解风格,而不是单纯的加滤镜

Gemini 3 Pro:神级,整体效果还可以,但是所有的照片都有点发白的塑料感

Seedream 4.5:拉完了,全都是加了滤镜,还是坏胶卷滤镜

FLUX.2 Max:NPC,成功的图还不错,但一和四有点莫名其妙

Grok Imagine:拉完了,统一的滤镜,有几张图幻觉了

Qwen Image 2.0:人上人,没有乱改,效果也不错

速度与成本

模型接入方式平均耗时单张成本10 张合计
GPT-5.4 Image 2OpenRouter~228 秒~$0.24~$2.39
Gemini 3 Pro Image PreviewOpenRouter~30 秒~$0.14~$1.38
FLUX.2 MAXOpenRouter~33 秒~$0.10~$1.00
Seedream 4.5OpenRouter~29 秒~$0.04~$0.40
Grok ImagineX.ai~44 秒~$0.11~$1.10
Qwen Image 2.0Aliyun~17 秒~$0.02~$0.20

结论

如果只选一个「最好用」的,我会选 GPT-5.4 Image 2。速度虽然慢,但是效果我还是比较认可的,直接发朋友圈问题不大。

如果按性价比选,Qwen Image 2.0 便宜又快,效果也可以接受。

不过AI再努力,这些照片也跟川内的照片差很多,颜色、光感和颗粒很容易学,难的是「为什么在这个瞬间按下快门」,我的摄影技术还是差了太多。