惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

宝玉的分享
宝玉的分享
IT之家
IT之家
Stack Overflow Blog
Stack Overflow Blog
Application and Cybersecurity Blog
Application and Cybersecurity Blog
腾讯CDC
P
Palo Alto Networks Blog
Spread Privacy
Spread Privacy
S
Schneier on Security
NISL@THU
NISL@THU
WordPress大学
WordPress大学
酷 壳 – CoolShell
酷 壳 – CoolShell
P
Proofpoint News Feed
T
Threatpost
Scott Helme
Scott Helme
C
Cybersecurity and Infrastructure Security Agency CISA
T
The Exploit Database - CXSecurity.com
I
Intezer
C
Check Point Blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
CXSECURITY Database RSS Feed - CXSecurity.com
C
Cyber Attacks, Cyber Crime and Cyber Security
S
Securelist
Security Latest
Security Latest
大猫的无限游戏
大猫的无限游戏
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
小众软件
小众软件
www.infosecurity-magazine.com
www.infosecurity-magazine.com
云风的 BLOG
云风的 BLOG
量子位
T
Tor Project blog
博客园 - 叶小钗
The Cloudflare Blog
Simon Willison's Weblog
Simon Willison's Weblog
T
Tailwind CSS Blog
W
WeLiveSecurity
Hacker News - Newest:
Hacker News - Newest: "LLM"
Attack and Defense Labs
Attack and Defense Labs
S
Security Affairs
罗磊的独立博客
Know Your Adversary
Know Your Adversary
Engineering at Meta
Engineering at Meta
G
Google Developers Blog
Help Net Security
Help Net Security
美团技术团队
P
Privacy International News Feed
The Hacker News
The Hacker News
Hugging Face - Blog
Hugging Face - Blog
MongoDB | Blog
MongoDB | Blog
N
Netflix TechBlog - Medium
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知

Crazyrouter Blog

Gemini CLI Complete Guide 2026: Repo Automation, CI Agents, and Multi-Model Routing Ideogram AI Guide 2026: Brand Design Automation, API Workflows, and Alternatives GLM 4.6 API Guide 2026: Agents, RAG, Tool Calling, and Bilingual Apps WAN 2.2 Animate Tutorial 2026: Character Consistency, Shot Control, and API Workflows Google Veo3 API Guide 2026: Production Video Pipelines, Prompts, Pricing, and Fallbacks AI API Pricing Comparison 2026: Text, Image, Video, Caching, and Router Costs Codex CLI Installation Guide 2026: Windows, macOS, Linux, Proxies, and CI Setup How to Get a Claude API Key in 2026: Secure Setup for Teams, CI, and Alternatives Gemini Advanced Review 2026: Is It Worth It for Coding, Research, and API Teams? Claude Code Pricing Guide 2026: Team Agent Budgets, API Fallbacks, and Cost Control Seedance 2.0 Pricing: Convert 46 CNY per Million Tokens to Cost per Second Seedance 2.0 计费详解:46元/百万Token换算成每秒多少钱 Seedance 2.0料金解説:100万Tokenあたり46元を1秒あたりコストに換算 Gemini CLI 使用教程 2026:安装、代码示例、代理环境与 API 接入 Gemini 是什么?2026 完整介绍、API 使用教程与价格对比 Qwen2.5-Omni Guide 2026: Real-Time Voice, Vision, and Multimodal Agents Kimi K2 Thinking Guide 2026: Reasoning Workflows, Evals, and Cost Control Google Veo3 API Guide 2026: Batch Video Pipelines, Pricing, and Fallbacks Codex CLI Installation Guide 2026: macOS, Linux, WSL, Proxies, and Dev Containers How to Get a Claude API Key in 2026: Safe Production Setup and Alternatives AI API Pricing Comparison 2026: GPT, Claude, Gemini, Video, and Agent Workloads Gemini Advanced Review 2026: Is It Worth It for Developer Teams? Claude Code Pricing Guide 2026: API Fallbacks, Team Seats, and Budget Control Seedream 4.0 API Tutorial 2026: Batch Image Generation, Product Creative, and Pricing Qwen2.5-Omni Guide 2026: Real-Time Voice, Vision, Text Agents, and API Integration Kimi K2 Thinking Guide 2026: Reasoning Agents, Evaluation Workflows, and API Cost Control WAN 2.2 Animate Tutorial 2026: Character Motion, Shot Control, API Pipelines, and Pricing Google Veo3 API Guide 2026: Production Video Workflows, Prompts, Pricing, and Fallbacks AI API Pricing Comparison 2026: OpenAI, Claude, Gemini, DeepSeek, and Router Costs How to Get a Claude API Key in 2026: Setup, Security, Rotation, and Alternatives Codex CLI Installation Guide 2026: macOS, Linux, WSL, Proxies, and Devcontainers Gemini Advanced Review 2026: Is It Worth It for Developers and API Builders? Claude Code Pricing Guide 2026: CI Agents, Team Seats, and API Budget Planning 一個 API Key 呼叫 GPT、Claude、Gemini:5 分鐘設定教學 AI API Gateway for Singapore and Malaysia Developers: One Endpoint for GPT, Claude and Gemini AI API Gateway for Thai Developers: Use GPT, Claude and Gemini with One Key Cómo usar GPT, Claude y Gemini con una sola API key One API Key for GPT, Claude and Gemini: A Practical Setup for Central Asia Developers Gemini 3.5 Flash vs Claude レスポンスティアモデル:開発者はどちらを選ぶべきか Gemini 3.5 Flash vs Claude Response-Tier Models: Какую модель выбрать разработчику? Gemini 3.5 Flash vs Claude Response-Tier Models: Which One Should Developers Use? Gemini 3.5 Flash vs Gemini 3 Flash vs Gemini 2.5 Flash:実運用APIベンチマーク Gemini 3.5 Flash vs Gemini 3 Flash vs Gemini 2.5 Flash: Real API Benchmark text-embedding-3-large 值不值得用?和 text-embedding-3-small 的成本、效果与选型对比 用 text-embedding-3-large 搭建 RAG 知识库:从切块、向量化到检索排序 text-embedding-3-large 是干什么的?Embedding 模型入门与 RAG 场景详解 How to Test Multiple AI Image Models with One API Key "How to Test Multiple AI Image Models with One API Key" Codex CLI Installation Guide: Setup on macOS, Linux, Windows WSL and CI/CD Gemini CLI 使用教程:开发者终端 AI 助手完全指南 Grok 4 免费使用教程:合法体验路径、API 接入与替代方案 Seedream 4.0 API Tutorial: ByteDance Image Generation for Production Pipelines Kimi K2 Thinking Model: Complete Developer Guide for Reasoning Workflows Luma Ray 2 Review: AI Video Generation Quality, Speed, and API Guide Pika 2.2 New Features Review: Scene Director, Sound Design, and API Updates Google Veo 3 API Guide: Video Generation with Audio for Developers AI Lip Sync Tools Comparison 2026: Best APIs for Talking Avatars and Video Dubbing Gemini Advanced Review May 2026: Is It Worth $20/Month for AI Power Users? Claude Code Pricing in May 2026: Max Plan, Opus 4, and Real Cost Breakdown Hermes Agent + Crazyrouter: One-Click Setup for 627+ AI Models Text-Embedding-3-Small: Complete Guide to OpenAI's Most Popular Embedding Model (2026) Cursor 配置 Crazyrouter 教程:国内用上 GPT-5.4 / Claude 写代码 2026 年国内如何调用 Claude API?Claude Opus / Sonnet 接入完全指南 2026 年国内如何调用 GPT-5.4 API?完整接入指南(含代码示例) AI API 常见报错排查大全:401、429、500、timeout 一篇搞定 2026 年 AI API 中转站哪家好?六大平台横向对比评测 2026 年 DeepSeek R1 API 接入指南:国内最强推理模型怎么调用 Trình Tạo Meme & Sách Tô Màu Bằng AI Với GPT-image-2 — Những Dự Án Vui Mà Vẫn Kiếm Ra Tiền Dự Đoán Em Bé Tương Lai Bằng AI Với GPT-image-2 — Xem Con Bạn Có Thể Trông Như Thế Nào Chuyển Đổi Ảnh Sang Phong Cách Ghibli Với GPT-image-2 — Biến Mọi Bức Ảnh Thành Tranh Anime Tạo Mô Hình Nhân Vật Hành Động Bằng AI Với GPT-image-2 — Biến Bất Kỳ Ai Thành Đồ Chơi Trong Hộp GPT-image-2: Nhận Diện Khuôn Mặt Và Phân Tích Màu Sắc Bằng AI Xem chỉ tay với GPT-image-2 — Tạo bản phân tích chỉ tay chuyên nghiệp chỉ từ một bức ảnh GPT-image-2로 AI 밈 생성기 & 컬러링북 만들기 — 재미있고 수익도 되는 프로젝트 GPT-image-2로 AI 미래 아기 예측 — 우리 아이는 어떤 모습일까? GPT-image-2로 지브리 스타일 변환 — 사진을 애니메이션 아트로 바꾸기 GPT-image-2로 AI 액션 피규어 생성하기 — 누구나 박스형 피규어로 바꾸는 법 GPT-image-2로 AI 관상 분석 & 퍼스널 컬러 진단 — 두 가지 바이럴 활용법 완벽 가이드 GPT-image-2 실전 가이드:AI 손금 분석 — 손바닥 사진 한 장으로 전문 손금 인포그래픽 생성하기 GPT-image-2 で AI ミーム生成 & ぬりえブック制作 — 楽しくて本当に稼げるプロジェクト GPT-image-2 で AI 未来の赤ちゃん予測 — 将来の子どもの顔を見てみよう GPT-image-2 でジブリ風写真変換 — どんな写真もアニメアートに GPT-image-2 で AI アクションフィギュア生成 — 誰でもボックス入りおもちゃに変身 GPT-image-2 で AI 顔相診断 & パーソナルカラー分析 — 2つのバズ活用法を1本で解説 GPT-image-2 で AI 手相占い — 1枚の写真からプロ仕様の手相分析を生成 GPT-image-2 на практике: AI-генератор мемов и раскрасок — весёлые проекты, которые приносят деньги GPT-image-2 на практике: AI-предсказание будущего ребёнка — как будет выглядеть ваш малыш GPT-image-2 на практике: стиль Гибли — превратите любое фото в аниме-арт GPT-image-2 на практике: AI-генератор фигурок — превратите себя в коллекционную игрушку GPT-image-2 на практике: AI-физиогномика и анализ цветотипа — два вирусных кейса в одном гайде GPT-image-2 на практике: AI-хиромантия — генерация профессионального анализа ладони по фото GPT-image-2 实战:AI Meme 生成器 & 涂色书制作 — 好玩还能赚钱的两个项目 GPT-image-2 实战:AI 预测未来宝宝 — 看看你们的孩子长什么样 GPT-image-2 实战:吉卜力风格转换 — 把任何照片变成宫崎骏动画 GPT-image-2 实战:AI 手办生成器 — 把任何人变成盒装公仔 GPT-image-2 实战:AI 面相分析 & 个人色彩诊断 — 两大爆款玩法一文搞定 GPT-image-2 实战:AI 看手相 — 一张手掌照片生成专业手相分析图 AI Meme Generator & Coloring Book Creator with GPT-image-2 — Fun Projects That Actually Make Money AI Future Baby Prediction with GPT-image-2 — See What Your Child Might Look Like Ghibli Style Photo Transformation with GPT-image-2 — Turn Any Photo Into Anime Art
AI 扩图 API 指南 2026:Uncrop、Outpaint、gpt-image-2 和 Nano Banana 路线怎么选
Crazyrouter Team · 2026-05-11 · via Crazyrouter Blog

AI 扩图 API 指南 2026:Uncrop、Outpaint、gpt-image-2 和 Nano Banana 路线怎么选#

AI 扩图 API 工作流封面

把一张裁得太紧的图硬拉宽,结果通常很糟:人物变形、商品边缘发糊、背景纹理重复。AI 扩图的价值不是“把像素撑大”,而是在原画框外生成新内容,让图片能适配横幅、广告位、商品主图和应用内素材。

真正要先判断的是任务类型。只是救比例,用在线 uncrop 工具最快;原图很贵,先用 Photoshop 这类编辑器保住边缘;想用文字把场景继续往外推,可以用对话式图片编辑;需要批量、日志、回放和模型切换,才进入 API 工作流。

这篇 CrazyRouter 示例按本地 crazyrouter-docs 在 2026-05-11 的内容复核。代码没有虚构新参数:gpt-image-2 使用 /v1/images/generations/v1/images/editsnano-banana-2 当前按文档推荐走 Gemini 原生 gemini-3.1-flash-image-preview:generateContentnano-banana-pro 使用 /v1/images/generationsimage_input URL。

要点速览#

真实任务推荐起点API 路线注意点
只想把图片改成横图、竖图或补一点安全边距在线 uncrop 工具暂时不必上 API快,但边缘控制弱
人像、商品、建筑照片需要保持可信Photoshop / 专业编辑器gpt-image-2 编辑可做自动化补充重点是主体不漂移
想用文字连续扩展场景对话式图片编辑gpt-image-2 适合创意编辑遮罩不是硬边界
批量生成博客图、广告图、商品横幅CrazyRouter Images API/v1/images/generations/v1/images/edits需要记录模型、尺寸和返回字段
使用 Nano Banana 2 做图片生成Gemini 原生路径/v1beta/models/gemini-3.1-flash-image-preview:generateContent不要写成稳定 Images API 入口
使用 Nano Banana Pro 做参考图横幅CrazyRouter Images APImodel: "nano-banana-pro" + image_input当前公开承诺 URL 参考图

AI 扩图工具决策图

一句话版本:单张图先选工具,成规模后再选 API。

AI 扩图不是一个任务#

CrazyRouter 图像 API 路线图

“AI 扩图”至少拆成四类。

补比例。原图主体没问题,只是画幅不适合 16:9 横幅、9:16 竖屏或 1:1 方图。这个场景对 API 的需求不强,在线 uncrop 工具通常够用。

保真外扩。人物肩膀、头发、商品边缘、建筑线条贴着边界,扩图后不能看出断裂。这里要用能精修边缘的编辑器,或者用带遮罩的图片编辑 API。

创意扩景。你不是只想“补边”,而是想让画面变成更大的摄影棚、更完整的桌面、更宽的户外场景。对话式图片编辑和 gpt-image-2 这类提示词驱动编辑更顺手。

生产 outpainting。批量处理商品图、博客封面、广告素材或用户上传图时,核心问题变成:请求如何复现,图片如何存储,失败如何重试,模型如何切换,成本如何记录。这里才是 CrazyRouter 这类统一 API 入口的价值。

什么时候不用 API#

如果只是把一张 4:5 图片补成 16:9,API 不是默认答案。在线 uncrop 工具省掉了上传、鉴权、解析返回和存储结果的开发工作,适合临时素材和低风险内容。

Photoshop Generative Expand 更适合重要原图。做品牌图、人物图、商品图时,编辑器里的局部修边能力比一次 API 返回更可靠。AI 外扩经常能补出整体气氛,但文字、Logo、包装边缘和 UI 元素仍需要人工收口。

ChatGPT Images 这类对话式编辑适合找方向。它的优势是低摩擦迭代:选中区域,描述“把左右两侧扩成更宽的摄影棚环境”,继续追问和修正。代价是边界不一定严格,不能把它当成像素级合成工具。

什么时候用 CrazyRouter API#

一旦出现下面任意一个条件,就该考虑 API:

  • 每天生成或编辑几十张以上图片
  • 图片需要进入 CMS、商品系统、广告素材库或用户工作流
  • 需要同一套鉴权调用 GPT Image、Gemini 图片模型、Grok、Qwen、DALL-E 等模型
  • 需要记录模型、输入图、提示词、尺寸、质量和返回 URL
  • 需要在模型不稳定时保留替代路线

CrazyRouter 的基础地址要按客户端区分:

使用方式应填写地址
OpenAI 兼容 SDKhttps://crazyrouter.com/v1
手写 Images API 请求https://crazyrouter.com/v1/images/generations/v1/images/edits
Gemini 原生图片路径https://crazyrouter.com/v1beta/models/{model}:generateContent?key=YOUR_API_KEY

OpenAI 兼容 SDK 会自己拼路径,所以 base_url 只保留到 /v1。手写 curl 请求要写完整端点。

路线一:用 gpt-image-2 生成扩图方向#

gpt-image-2 在 CrazyRouter 文档里使用 OpenAI Images API 格式。生成图片走:

最小请求示例:

Python SDK 写法:

这条路线适合从零生成封面、文章插图、社交配图。它不是严格意义的“基于原图 outpaint”,但很适合先产出方向稿。

路线二:用 gpt-image-2 做遮罩编辑#

真正要保留原图主体时,用编辑端点:

CrazyRouter 文档写明,gpt-image-2 编辑支持原图、遮罩,也支持最多 16 张参考图。遮罩图片里的透明区域是需要编辑的部分。

这个示例适合商品主图、博客封面、广告横幅。关键不是提示词写得长,而是把遮罩做对:透明区域给模型补,主体区域尽量不碰。

多图参考可以用 multipart/form-data

如果你的流程需要透明背景,gpt-image-2 文档也支持生成时设置 background: "transparent" 并使用 PNG。

路线三:Nano Banana 2 当前走 Gemini 原生#

这里最容易写错。

CrazyRouter 文档在 2026-04-14 的复测结论是:nano-banana-2 当前映射到 gemini-3.1-flash-image-preview,推荐直接调用 Gemini 原生 generateContent。不要把 POST /v1/images/generations + model: "nano-banana-2" 写成稳定生产入口。

推荐请求:

返回解析也要按 Gemini 形态处理。优先读:

不要假设它会返回 OpenAI Images 风格的 data[].url

这条路线适合已经准备使用 Gemini 图片能力的团队。它的好处是当前文档路径清晰,代价是客户端要写 Gemini 原生解析逻辑。

路线四:Nano Banana Pro 用 URL 参考图做横幅#

nano-banana-pro 的公开协议不同。CrazyRouter 文档写的是:

它使用 image_input 传参考图 URL,当前公开保守范围写 1 到 2 张参考图,并已验证 1K4K1:121:9pngjpg 等能力。

响应默认消费 data[0].url

限制也要写进开发文档:当前公开协议只承诺 image_input URL 输入,不接受 image 字段,也不要把 data: 或 Base64 当作公开输入协议。

API 路线怎么放进生产#

不要在业务代码里硬编码一个模型。把模型选择放进配置或路由表。

每次请求至少记录这些字段:

字段用途
request_id复现与客服排查
model成本、质量、失败率对比
endpoint区分 Images API 和 Gemini 原生
input_image_url 或文件名追踪原图来源
prompt_version回滚提示词
size / resolution / aspect_ratio复现输出
response_fielddata[].urlb64_jsoninlineData
latency_ms判断模型与路由稳定性
status_code分析 401、429、500、渠道失败

让扩图更干净的操作清单#

AI 扩图稳定性清单

一次少扩一点。15% 到 25% 的边界补充通常更稳,过大的空白会诱导模型重写整张图。

先延续,再创意。第一轮只要求画面自然变宽;第二轮再加道具、场景和风格变化。

主体贴边时用遮罩。人物脸、手、商品轮廓、包装文字都不该只靠提示词保护。

把文字交回设计工具。Logo、包装文案、UI 截图、表格和小字号标注,生成式外扩仍容易出错。

保留原图和参数。图片 API 的“看起来差不多”很难排查,必须把输入图、提示词版本、模型、尺寸和响应字段一起存下来。

FAQ#

AI 扩图、uncrop、outpaint 是一回事吗?#

不是。uncrop 更像快速补画幅;outpaint 更强调在原画框之外继续生成内容;图片编辑 API 通常还会涉及原图、遮罩、参考图和返回格式。

CrazyRouter 上 AI 扩图该先用哪个模型?#

如果你要 OpenAI Images 兼容格式,先测 gpt-image-2。如果你要当前推荐的 Nano Banana 2 路线,走 gemini-3.1-flash-image-preview:generateContent。如果你要用 URL 参考图做高分辨率横幅,测 nano-banana-pro

nano-banana-2 能不能走 /v1/images/generations?#

不建议。CrazyRouter 文档在 2026-04-14 的结论是:nano-banana-2 当前推荐 Gemini 原生路径,不再推荐把 /v1/images/generations 写成稳定入口。

gpt-image-2 编辑图片时遮罩怎么理解?#

/v1/images/edits 使用 multipart 请求。传入原图和可选 mask,透明区域表示需要编辑的部分。商品图 outpaint 时,遮罩应覆盖需要补出的边缘区域,主体尽量留在非透明区域。

API 返回一定是图片 URL 吗?#

不一定。gpt-image-2nano-banana-pro 的 Images API 示例通常消费 data[].url,也可能遇到 b64_jsonnano-banana-2 的 Gemini 原生路径应优先解析 inlineData

文章配图应该用什么路线生成?#

技术博客封面可先用 gpt-image-2 文生图。带参考图的横幅可用 nano-banana-pro。需要把一张已有图扩成横幅并保护主体时,用 gpt-image-2/v1/images/edits

推荐起步方案#

临时修一张图,先用在线 uncrop 或 Photoshop。要做文章封面、广告横幅、商品图批量生成,再把流程接到 CrazyRouter。

生产起步可以这样排:

阶段选择
封面方向稿gpt-image-2 + /v1/images/generations
原图外扩gpt-image-2 + /v1/images/edits
Gemini 图片路线gemini-3.1-flash-image-preview:generateContent
URL 参考图横幅nano-banana-pro + image_input
成本与稳定性复盘按模型、端点、响应字段记录日志

如果目标是把 AI 扩图做成可复现的内容生产管线,下一步不是继续找“万能模型”,而是把输入图、提示词、模型和返回解析固定下来。注册 CrazyRouter,创建一个受限 Token,用上面的四条路线各跑 10 张图,很快就能看出哪条适合你的素材库。