惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Project Zero
Project Zero
量子位
博客园 - 聂微东
月光博客
月光博客
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
有赞技术团队
有赞技术团队
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
雷峰网
雷峰网
人人都是产品经理
人人都是产品经理
V
Visual Studio Blog
IT之家
IT之家
酷 壳 – CoolShell
酷 壳 – CoolShell
Hugging Face - Blog
Hugging Face - Blog
J
Java Code Geeks
V
V2EX
P
Proofpoint News Feed
T
Troy Hunt's Blog
The Hacker News
The Hacker News
H
Hacker News: Front Page
小众软件
小众软件
L
Lohrmann on Cybersecurity
博客园 - 三生石上(FineUI控件)
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
L
LINUX DO - 最新话题
The Last Watchdog
The Last Watchdog
W
WeLiveSecurity
Apple Machine Learning Research
Apple Machine Learning Research
Jina AI
Jina AI
WordPress大学
WordPress大学
G
GRAHAM CLULEY
宝玉的分享
宝玉的分享
博客园 - 【当耐特】
C
CERT Recently Published Vulnerability Notes
S
Secure Thoughts
I
Intezer
Application and Cybersecurity Blog
Application and Cybersecurity Blog
Last Week in AI
Last Week in AI
腾讯CDC
C
Cybersecurity and Infrastructure Security Agency CISA
S
Securelist
博客园_首页
阮一峰的网络日志
阮一峰的网络日志
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
爱范儿
爱范儿
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 叶小钗
博客园 - Franky
Cloudbric
Cloudbric

博客园_首页

Plist 二进制格式 Milvus 和 PGVector,哪个更好? OpenClaw 已过时?在 VS Code 中运行 Hermes Agent! 第30篇文章:一个大三计科生的自白 Manim如何在数学公式中完美显示中文? Docker 部署 RocketMQ 5 并发编程核心概念辨析 C#事务处理最佳实践:别再让“主表存了、明细丢了”的破事发生 CLI 是什么?为什么大厂突然集体卷命令行? 【从0到1构建一个ClaudeAgent】协作-自主Agent UIImageView 设置图片不生效的原因排查 最小二乘问题详解20:无先验约束下的增量式SFM自由网平差 痞子衡嵌入式:大话双核i.MXRT1180之XIP应用里借助MU实现可靠Flash IAP的方法 AI Chat 封装, SemanticKerne.AiProvider.Unified 已发布 Windows下右键编辑js文件无法打开记事本——在注册表中使用环境变量 在后台服务中使用 Scoped 服务,为什么总是报错? H200 安装驱动并使用sglang启动模型 wireshark 抓包Trap上报告警内容 我用 AI 辅助开发了一系列小工具(2):图片压缩工具 [A Primer On MC and CC] 2.1 Memory Consistency 1 - 指令重排序和 SC 模型 Oracle数据库SCN推进技术详解与实践指南 玩转控件:封装个带图片的Label控件 Claude Code 4.7 真正该升级的不是模型,而是你的工作流 前端小白一句话,AI 帮我做了个颜值拉满的桌面媒体播放器。当代码不再是门槛,一句话编程就是现实。 5. WorkBuddy: 小龙虾的灵魂三件套,让你的小龙虾不只是工具 SQLite 分片方案实战:三种分片策略的深度对比 告别简陋 UI!一款基于 Fluent Design 和基于 WinUI 的开源免费、现代化的 Avalonia UI 控件库 关于二进制排列组合枚举的总结 AI开发-python-LangGraph框架(3-27-LangGraph从零实现大模型智能决策工作流) ElasticSearch主分片和副本分片概念详解 【002】HTTPS 粗解:证书、TLS 握手与对后端配置的影响 Hermes Agent 一周暴涨五万 Star,但我劝你别急着追 明明连接的是Redis的DB0,为什么能查到DB3的数据? 【从0到1构建一个ClaudeAgent】协作-Agent团队 熟悉电子元器件之后,电子小白下一步该怎么走? MAF快速入门(23)通过C#类定义Skills .NET 高级开发 | 手写一个对象映射框架 FastAPI数据库ORM怎么选?我肝了三个Demo后,终于不再纠结了 mysqldump 参数拾遗:在遗忘与铭记之间 C# .NET 周刊|2026年3月5期 Claude code入门 - 陈彦斌 一文学习入门 ThingsBoard 开源物联网平台 GitHub 热门项目 | 2026年04月16日 如何为GIT设置全局勾子,为每次提交追加信息 Number.isFinite和isFinite与isNaN()和Number.isNaN的区别 PortSwigger SQL注入LAB2 推荐一个测试人必备的Skills,从功能到性能全搞定(附详细实操和安装下载方式) 筑基期:掌握Odoo基础核心知识点02(Odoo XML 开发方式详解) GLM模型这么火,咱们用vllm也咧一个呗! 深入理解 AbortController:从底层原理到跨语言设计哲学 字符串学习笔记 多租户系统框架的基础模块设计和分析设计 Apache SeaTunnel Zeta 为什么能做到“又快又稳”? AI开发-python-LangGraph框架(3-26-LangGraph基本概念及第一个简单样例) Vue 3 组件通信,别只会用 Props 和 Emits 了,这几个狠活儿你得看看 ElasticSearch7.X版本配置密码 用Manim实现动态交点计算--从一个动点问题说起 团结引擎+Addressable+Instant Game打包抖音小游戏 function call 实战:让 LLM 自动判断 pod 异常、调用日志工具并完成故障分析 bubseek —— 让 Agent 的足迹,变成团队的洞察 通过 C# 读取并导出 PDF 书签 如何用 GitHub Actions 实现 Steam 自动化发布 【从0到1构建一个ClaudeAgent】并发-后台任务 .NET 高级开发 | 定制 ASP.NET Core 框架 电子小白:什么是运算放大器(运放) zero2Agent:面向大厂面试的 Agent 工程教程,从概念到生产的完整学习路线 堆上的ORW HC32F460 USB CDC通信异常:非对齐访问异常排查 20260413-Hyperbridge 攻击事件:发生在默克尔山上的验证绕过 那些喊着AI 要淘汰你的人,正在靠你的焦虑赚大钱! 深度学习进阶(八)Swin Transformer 最小二乘问题详解19:带先验约束的增量式SFM优化与实现 SnapTranslate 3.0 正式发布:全局划词翻译 + 完整英语学习闭环,一站式搞定查词、记词、复习 工作的意义、工作的困难认知再思考 .NET + AI 进阶实战:基于类的技能开发 - 打造可治理的 Agent 能力模块 【从0到1构建一个ClaudeAgent】规划与协调-技能 上周热点回顾(4.6-4.12) 电子小白的工具三件套:面包板、杜邦线、万能板 单表五亿数据的查询优化 | Mysql、StarRocks 2. WorkBuddy:从“我是谁”到“帮我干活” C# 如何减少代码运行时间:7 个实战技巧 基于HelixToolkit.SharpDX 渲染3D模型 - 笺上知微 从零开始的双臂具身VLA起源及现阶段发展综述 - SkyXZ 记对 xonsh shell 的使用, 脚本编写, 迁移及调优 - pluvium27 受够了Vibe Coding的失控?换个起点,让AI事半功倍 从开始配置漏洞环境到漏洞复现流程 - 難しい 关于10年工作经验的程序员对OpenClaw的实战经验分享以及看法 - 虚无境 Any metadata 的内存布局 C# .NET 周刊|2026年3月2期 - InCerry 我帮你测过了,测试圈排名第二的 Skill 依然很牛逼 Skill Discovery | 无监督技能发现的经典工作总结 - MoonOut 上下文工程是什么?过时了么?一文讲明白! - 一枫说码 开了 TUN 模式还是直连?90% 的人都踩过这个坑 AScript扩展多种脚本语言 - rockey627 AI 学习笔记:Agent 的记忆机制 你能被装进一个文件里吗?——7 万人把同事"蒸馏"成了 AI - 我没有三颗心脏 Claude Code 通关手册(七):给 AI 装上技能包——Skills 完全指南 - 暮色之狐 在浏览器中快速编辑代码:VSCode Web 集成实践 - Newbe36524 蒸馏自己 skill?基于 Deepseek 的蒸馏器,丐版蒸馏方式,简单便捷 - To_Carpe_Diem Spring AI Aliababa和AgentScope,哪个更好? - 苏三说技术
Openai Codex 重大更新 已支持接入任意开源大模型
JaguarJack · 2026-06-18 · via 博客园_首页

Openai Codex 重大更新 已支持接入任意开源大模型

如果你还认为 Codex(OpenAI 推出的 AI 编程助手)只能搭配 GPT 系列模型使用,那你可能错过了近期最重要的一次更新。

Codex CLI 现在已经全面支持 OSS 模式(Open-Source Mode),任何兼容 OpenAI API 的模型都可以接入。 无论是本地运行的 Ollama、LM Studio,还是云端网关 OpenRouter,甚至是你自己搭建的推理服务——通通可以。

这篇文章将全面梳理这次更新带来的变化,以及如何配置使用。

什么是 Codex?

Codex 是 OpenAI 推出的 AI 编程代理(coding agent),它不同于简单的代码补全工具。Codex 能够在终端中直接理解项目上下文、执行命令、修改文件、创建 PR,像一个真正的开发伙伴一样工作。

目前 Codex 有三个形态:

  • Codex CLI:基于命令行的 AI 编程代理,开源且本地运行
  • Codex IDE:集成到 VS Code、Cursor、Windsurf 等编辑器的插件
  • Codex Web:基于云的 Codex 智能体,通过 ChatGPT 界面访问

其中 CLI 版本是开源的核心,也是这次「任意模型接入」能力的主阵地。

OSS 模式是什么?

OSS 模式,全称 Open-Source Mode,是 Codex CLI 内置的一个运行模式。开启后,Codex 不再依赖 OpenAI 的专有模型,而是允许用户指定任何兼容 OpenAI API 的后端服务作为模型引擎。

这意味着:

  • 你可以在完全离线的环境下使用 Codex,无需连接 OpenAI
  • 你可以自由选择模型:Qwen、Llama、DeepSeek、Mistral 等
  • 你可以在自己的硬件上运行,数据不出本地
  • 你可以通过 OpenRouter 等网关使用多种商业或开源模型

快速上手 OSS 模式

安装 Codex CLI

如果已安装 Codex CLI,请跳过此步骤。

使用一行命令即可完成安装:

curl -fsSL https://chatgpt.com/codex/install.sh | sh

也支持 npm 和 Homebrew 安装:

npm install -g @openai/codex

# 或者
brew install --cask codex

启动 OSS 模式

Codex CLI 提供了两种方式进入 OSS 模式:

方式一:命令行参数

直接在启动时加上 --oss 标志:

codex --oss

此时 Codex 会使用默认 OSS 配置连接本地 Ollama 服务(localhost:11434),并使用 gpt-oss:20b 模型。

方式二:通过配置文件

编辑 ~/.codex/config.toml,配置自定义模型提供商:

model = "gpt-oss:120b"
model_provider = "ollama"

然后直接运行 codex 即可。

内置模型名称

Codex 为 OSS 模式内置了几个模型别名:

模型名 说明
gpt-oss:20b 20B 参数的轻量级 OSS 模型
gpt-oss:120b 120B 参数的高性能 OSS 模型
gpt-oss:120b-cloud 云端托管的 120B 模型

这些名称会映射到你实际选择的后端模型上,Codex 会根据名称选择合适的元数据配置。

自定义模型提供商:核心配置

Codex 的真正威力在于 config.toml 中的 [model_providers] 配置段。你可以定义任意数量的自定义提供者。

配置语法

以下是一个完整的配置示例:

# 选择使用的模型和提供者
model = "qwen2.5-coder:32b"
model_provider = "ollama"
model_reasoning_effort = "high"

# 定义模型提供者
[model_providers.ollama]
name = "Ollama"
base_url = "http://localhost:11434/v1"
wire_api = "responses"

[model_providers.lmstudio]
name = "LM Studio"
base_url = "http://localhost:1234/v1"
wire_api = "responses"

[model_providers.openrouter]
name = "OpenRouter"
base_url = "https://openrouter.ai/api/v1"
wire_api = "responses"
experimental_bearer_token = "your-openrouter-api-key"

关键配置项说明

  • model:模型名称,可以是任意字符串,Codex 会传递给后端
  • model_provider:指向下方定义的提供者 ID
  • model_reasoning_effort:推理强度,可选 lowmediumhigh
  • base_url:API 服务的完整地址,支持远程地址
  • wire_api:API 协议类型,responses(OpenAI Responses API)或 chat(Chat Completions API)
  • experimental_bearer_token:认证令牌,用于需要 API Key 的服务

实战:接入各种模型服务

使用 Ollama(本地)

Ollama 是目前最流行的本地模型运行工具。配置如下:

model = "qwen2.5-coder:32b"
model_provider = "ollama"

[model_providers.ollama]
name = "Ollama"
base_url = "http://localhost:11434/v1"
wire_api = "responses"

Codex 会自动检测本地安装的 Ollama。确保 Ollama 正在运行,Codex 就能直接使用。

使用 DeepSeek

DeepSeek 提供了与 OpenAI 兼容的 API 接口,国内可直接访问,无需魔法:

model = "deepseek-coder"
model_provider = "deepseek"

[model_providers.deepseek]
name = "DeepSeek"
base_url = "https://api.deepseek.com/v1"
wire_api = "responses"
experimental_bearer_token = "sk-你的DeepSeek-API-Key"

DeepSeek 的编码模型在编程任务上表现出色,且国内访问延迟低,非常适合作为 Codex 的日常推理引擎。

使用 OpenRouter(云端网关)

OpenRouter 提供了访问上百种模型的统一入口,包括 Claude、Gemini、DeepSeek、Mistral 等:

model = "anthropic/claude-sonnet-4-20250514"
model_provider = "openrouter"

[model_providers.openrouter]
name = "OpenRouter"
base_url = "https://openrouter.ai/api/v1"
wire_api = "responses"
experimental_bearer_token = "sk-or-v1-你的Key"

使用自定义 OpenAI 兼容服务

如果你有自己的模型推理服务(如 vLLM、TGI、SGLang 等部署的):

model = "my-custom-model"
model_provider = "self-hosted"

[model_providers.self-hosted]
name = "Self-Hosted"
base_url = "http://192.168.1.100:8080/v1"
wire_api = "responses"
experimental_bearer_token = "local-dev-key"

Profiles 配置 多模型自由切换

Codex 支持 Profiles 机制,可以同时定义多组模型配置,随时切换:

# 默认配置
model = "gpt-oss:120b"
model_provider = "ollama"

# 定义提供者
[model_providers.ollama]
name = "Ollama"
base_url = "http://localhost:11434/v1"
wire_api = "responses"

[model_providers.openrouter]
name = "OpenRouter"
base_url = "https://openrouter.ai/api/v1"
wire_api = "responses"
experimental_bearer_token = "sk-or-v1-xxx"

# 定义 Profiles
[profiles.fast-coder]
model = "qwen2.5-coder:7b"
model_provider = "ollama"
model_reasoning_effort = "low"

[profiles.reasoning]
model = "deepseek/deepseek-r1"
model_provider = "openrouter"
model_reasoning_effort = "high"

使用 Profile 启动:

codex -p fast-coder

这在日常开发中非常实用——日常小改动用轻量模型,复杂架构设计切换到大模型。

对国内开发者的意义

对于国内开发者来说,Codex 的 OSS 模式有几个特别值得关注的价值:

无需魔法。 使用本地模型或国内可访问的 API 服务,Codex 可以直接在终端中流畅运行。

数据安全可控。 如果你有代码安全合规要求,选择本地模型意味着所有代码数据都在你自己的机器上处理。

成本可控。 本地模型完全免费,云端网关按量计费,远低于订阅 ChatGPT Pro 的成本。

灵活的模型选择。 国内优秀的开源模型(如 Qwen 系列、DeepSeek 系列)都可以作为 Codex 的推理引擎。

注意事项

  1. 模型质量差异。 不同模型的编码能力差异较大,建议根据任务复杂度选择合适的模型
  2. MCP 工具兼容性。 部分 OSS 模型在调用 MCP 工具时可能存在限制,社区正在持续改进
  3. 元数据降级。 使用非 OpenAI 模型时,Codex 会使用降级的元数据配置,可能影响部分优化
  4. 远程地址支持。 base_url 支持 LAN 地址,可以将模型部署在其他机器上

总结

Codex CLI 的 OSS 模式是其开源战略的关键一步。它让开发者不再受限于特定模型,可以自由选择最适合自己场景的 AI 引擎。

无论你是追求数据隐私的团队、预算有限的个人开发者,还是想尝试最新开源模型的技术爱好者,Codex OSS 模式都为你打开了一扇新的大门。

现在就去试试吧:

curl -fsSL https://chatgpt.com/codex/install.sh | sh
codex --oss

让最适合你的模型来帮你写代码。

原文
Openai Codex 重大更新 已支持接入任意开源大模型