惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
SegmentFault 最新的问题
G
Google Developers Blog
H
Help Net Security
月光博客
月光博客
阮一峰的网络日志
阮一峰的网络日志
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog RSS Feed
爱范儿
爱范儿
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 三生石上(FineUI控件)
大猫的无限游戏
大猫的无限游戏
人人都是产品经理
人人都是产品经理
GbyAI
GbyAI
D
Docker
Hugging Face - Blog
Hugging Face - Blog
I
InfoQ
博客园 - 司徒正美
Last Week in AI
Last Week in AI
Microsoft Security Blog
Microsoft Security Blog
美团技术团队
Stack Overflow Blog
Stack Overflow Blog
M
MIT News - Artificial intelligence

博客园 - iTech

7万星的AI交易框架:让大模型模拟投行多空辩论,自动做交易决策 71000颗星的AI交易团队:让大模型模拟投行分工,自动做交易决策 13400颗星的开源项目:输入一句话,AI全自动帮你做短视频 102颗星的沙盒:当AI学会自己写代码、跑测试、做部署 AI 技术日报 - 2026-05-08 29k 星的 PageIndex:不用向量数据库,靠推理就能做 RAG 每天花两小时刷信息?这个开源项目帮你全自动搞定 读源码像读小说?试了 DeepWiki 和 Zread,我再也不想裸读 GitHub 了 Matt Pocock 开源的这套 .claude 技能,为什么让工程师集体上头? Cursor Team Kit:Cursor 官方团队在用的 17 个 AI 工作流 AI 技术日报 - 2026-05-07 AI 技术日报 - 2026-05-06 AI 技术日报 - 2026-05-05 Anthropic CEO 说 12 个月内程序员要失业,我扒完他的底牌,发现事情没那么简单 把工程师的肌肉记忆装进 Claude Code,这个 4300 Star 的项目我后悔没早用 AI 技术日报 - 2026-05-04 AI 技术日报 - 2026-05-03 AI 技术日报 - 2026-05-02 六大 Agent 框架横评:谁支持 Skills?谁能自动创建 Agent?MCP 呢? Wechatsync:一个 Chrome 插件,一键把文章同步到 31 个平台 LangChain 开源了 Open SWE:Stripe、Ramp、Coinbase 内部都在造的编程 Agent Cockpit:把 Claude Code 从终端里搬出来,装进浏览器 Cursor 把自家的 AI Agent 开放了:写几行 TypeScript 就能调 Cursor 干活 AI 技术日报 - 2026-05-01 AI 写代码每次结果都不一样?Archon 用 YAML 工作流把 AI 编程变成流水线 AI 写代码比你快了,但你还是得学编程——只不过学法得换 腾讯的龙虾特工队:4 个 AI Agent 同日更新,全家桶正式成型 Agno 不做更聪明的 Agent,它要把所有 Agent 框架包进同一个操作系统 Hermes Agent 终于有了像样的 Web 界面,而且还支持远程访问 Datawhale 出了一套 29 学科知识地图,把 AI 的底牌全掀了
用 Deep Agents CLI 替代 Claude Code:一条命令装好,任意模...
iTech · 2026-05-13 · via 博客园 - iTech

我一直是 Claude Code 的重度用户。但有两个问题一直困扰我:第一,它只能用 Claude 模型;第二,月费 $20。

当我发现 Deep Agents CLI 的时候,第一反应是"这不就是开源版的 Claude Code 吗?"用了一个星期之后,我的结论是:它比 Claude Code 做得更多。

本文提纲

  1. 一条命令装好
  2. 和 Claude Code 有什么不同
  3. TUI 界面长什么样
  4. 远程沙箱:代码不在你机器上跑
  5. 持久记忆和自定义技能
  6. Headless 模式:CI/CD 的好搭档
  7. 实际使用体验

一条命令装好

curl -LsSf https://langch.in/gh-da-cli | bash

完事了。如果你想用特定的模型提供商:

DEEPAGENTS_EXTRAS="nvidia,ollama" curl -LsSf https://langch.in/gh-da-cli | bash

或者用 uv:

uv tool install 'deepagents-cli[nvidia,ollama]'

然后直接跑:

deepagents

OpenAI、Anthropic、Gemini 的支持已经内置。你只需要设置对应的 API key 环境变量。

和 Claude Code 有什么不同

维度 Claude Code Deep Agents CLI
安装 npm install curl / uv
模型 仅 Claude 任意 LLM
开源 ✅ MIT
远程沙箱 Daytona/Modal/Runloop/LangSmith
MCP
Web 搜索 ✅ 内置
持久记忆
自定义技能 ✅ Skills 系统
Headless 模式
人机协作
价格 $20/月 免费

最大的区别在三点:模型自由、远程沙箱、自定义技能

TUI 界面长什么样

Deep Agents CLI 基于 Textual 构建,一个 Python 的终端 UI 框架。效果相当不错:

  • 流式输出 Agent 的回复
  • 工具调用的实时显示
  • Slash 命令支持(类似 Claude Code 的 / 命令)
  • 键盘快捷键丰富
  • 主题可定制

TUI 的代码量相当惊人——app.py 有 350KB,config.py 有 91KB。这不是一个简陋的终端工具,而是一个精心设计的终端应用。

几个实用的快捷键和命令:

  • Ctrl+X — 在外部编辑器中编辑 prompt
  • /help — 查看所有 slash 命令
  • /model — 切换模型
  • /clear — 清空对话
  • /compact — 手动触发上下文压缩

远程沙箱:代码不在你机器上跑

这是 Deep Agents CLI 杀手级的功能。

Claude Code 的所有代码都在本地执行。Deep Agents CLI 可以把代码执行交给远程沙箱:

MERMAID_BLOCK_0

这意味着:
- 安全:Agent 执行的代码和你的系统隔离
- 可扩展:GPU 密集型任务可以跑在 Modal 的 Serverless GPU 上
- 可复现:沙箱环境一致,不存在"在我机器上能跑"的问题

持久记忆和自定义技能

持久记忆

Agent 能记住你上次说过的话。底层是 MemoryMiddleware 加载 AGENTS.md 文件:

<!-- AGENTS.md -->
## 项目约定
- 使用 TypeScript strict mode
- 测试覆盖率 > 80%
- 提交信息遵循 Conventional Commits

每次启动新对话,Agent 都会自动读取这些约定。

自定义技能

技能系统让 Agent 能执行预定义的工作流:

/skill web-research   # 网络研究
/skill arxiv-search   # 论文搜索
/skill create-skill   # 创建新技能

技能本质上是一个目录,包含 SKILL.md(描述和工作流定义)。Agent 看到技能描述后会自动按照定义的流程执行。

内置技能包括:
- skill-creator — 让 Agent 自己创建新技能
- remember — 让 Agent 记住信息
- web-research — 网络研究

Headless 模式:CI/CD 的好搭档

不需要交互界面?用 headless 模式:

deepagents --headless "在 src/ 目录下找到所有 TODO 注释并创建 GitHub issues"

这个模式非常适合:
- CI/CD pipeline 中自动处理代码审查
- 批量任务自动化
- 定时任务执行

non_interactive.py 有 44KB 的代码专门处理非交互模式,支持流式输出、错误处理、超时控制等。

实际使用体验

我用 Deep Agents CLI 做了几个实际任务:

1. 代码重构 — 让它把一个 Python 项目从 requirements.txt 迁移到 pyproject.toml。它自己规划了步骤:读现有依赖 → 生成 pyproject.toml → 创建 uv.lock → 验证安装。全程没让我插手。

2. Bug 调试 — 给它一个报错信息,它自己读日志、搜代码、定位问题、提出修复方案。因为它有 execute 工具,能直接跑测试验证。

3. 文档生成 — 让它读完整个 API 模块后生成文档。它自己用 glob 找文件、用 read_file 读内容、用 write_file 写文档。

体验上最明显的感受是:它不像 ChatGPT 那样等你一步一步指导,而是自己规划和执行。 这就是"深度"的含义——不是一个浅层的问答循环,而是一个有计划、有记忆、能委派子任务的系统。

有一点需要注意:模型的选择对体验影响巨大。Claude Sonnet 4 在工具调用方面表现最好,GPT-4o 也不错,开源模型(通过 Ollama)在复杂任务上还有差距。但好消息是你可以随时切换——这是 Deep Agents 最大的优势。


作者: itech001
来源: 公众号:AI人工智能时代
主页: https://www.theaiera.cn,每日分享最前沿的AI新闻和技术。

本文首发于 AI人工智能时代,转载请注明出处。