惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

F
Full Disclosure
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
AI
AI
博客园 - Franky
博客园 - 叶小钗
MyScale Blog
MyScale Blog
Microsoft Azure Blog
Microsoft Azure Blog
V
Visual Studio Blog
U
Unit 42
C
Check Point Blog
美团技术团队
博客园 - 【当耐特】
MongoDB | Blog
MongoDB | Blog
WordPress大学
WordPress大学
aimingoo的专栏
aimingoo的专栏
A
About on SuperTechFans
G
Google Developers Blog
腾讯CDC
Jina AI
Jina AI
博客园 - 三生石上(FineUI控件)
人人都是产品经理
人人都是产品经理
酷 壳 – CoolShell
酷 壳 – CoolShell
N
Netflix TechBlog - Medium
S
SegmentFault 最新的问题
H
Help Net Security
T
Threat Research - Cisco Blogs
T
Tenable Blog
J
Java Code Geeks
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
T
Threatpost
T
The Blog of Author Tim Ferriss
The Cloudflare Blog
Cyberwarzone
Cyberwarzone
Spread Privacy
Spread Privacy
K
Kaspersky official blog
G
GRAHAM CLULEY
Cisco Talos Blog
Cisco Talos Blog
Project Zero
Project Zero
C
CERT Recently Published Vulnerability Notes
AWS News Blog
AWS News Blog
Know Your Adversary
Know Your Adversary
T
Tor Project blog
S
Secure Thoughts
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
PCI Perspectives
PCI Perspectives
P
Palo Alto Networks Blog
Webroot Blog
Webroot Blog
N
News | PayPal Newsroom
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
C
Cyber Attacks, Cyber Crime and Cyber Security

AI Agent 智能体

MiMo Token 激励计划:你们拿它做出了什么? 分享一个 Claude Code 脚手架: abc-scaffold 被喷了一天后,我觉得技术不值钱这句话应该改一下 中转站的安全性如何保障, Agent 一个提示就是几百个工具调用,几十个 exec 没人会一个一个审核吧。 以后技术鄙视链可能就一句话:你会不会使唤 Agent 最近又造了个轮子,基于 AI 的软件交付工作流引擎 自从有了 AI 之后, Commit 数量是不是已经不适合衡量开发效率了 我发现有了 AI 之后,很多人都在重复造轮子 AI 时代 产品需求文档(PRD) 软件需求文档(SRS) 应该怎么写呢?有推荐的模板吗?有推荐的 SKILL 吗? 征求可行方案:远程操控 + codex 桌面端 computer use 功能 + API 中转 - V2EX 做了个常驻的 AI 金融分析 Agent —— 不给买卖信号,只把事实端给你看 我跑了一晚 RAG,发现问题不在检索层 你们用的桌面 Agent 都是啥, 能操作浏览器么? Ucloud 也下场做中转站了 是不是第一个大厂做 gpt/anthropic 中转站的 怎么做的合规 如果为了本地大模型,卖掉 MacBook Pro M3 Pro 36G,买Μ5 Max 128G,合适吗? 照 AI 这个发展速度,感觉 AI 失控导致世界末日不远了 有用 openclaw 排杂志或者月刊的没?能达到 HTML 的效果吧? - V2EX 做了一个本地查看 Coding Agent API trace 的工具: claude-tap docker sandbox + Codex CLI 这个方案可做开发自动化吗? 把 LLM 当成“人”,才是 Agent 工程进阶的起点 目前无人值守的 AI 开发流程是否有研究前途 - V2EX 你还能回到没有 AI 的过去吗? 最近两周在用向量数据库来给 Hermes 扩充脑容量,直接让我力竭了。 火山新出了 Agent Plan,涨价 2~7.5 倍 - V2EX GLM 崩了? - V2EX 做了个小工具:让本地 AI Agent 操作堡垒机后的远程 Linux 环境 - V2EX “这个确实有点复杂。要不先把这个功能延后到 TODO,今晚先收工?已经凌晨快 2 点了。” - V2EX AI 大趋势,有人转全栈了吗?有没有成功案例可以分享一波的 - V2EX 做了一个给 AI agent 用的"万能钥匙",一个 key 调所有社交平台和数据源 - V2EX memory 真的会让 Agent 变得更好用吗? - V2EX Macbook 上装的 OpenAI Codex App 如何才能使用国内的大模型? 刚接了 hermes agent,这是微信 ClawBot 的 bug 吗? 你们给 agent 配的谁家的模型?求推荐 openclaw 和 hermes agent 支持多个聊天机器人吗 没啥事研究了一下 Hermes agent 原理 OpenClaw, Hermes, Mercury 或其他,哪个个人 Agent 能真正投入使用? 向佬们征集一些实务上遇到的法律实务问题或疑惑 Claude Code 和 Codex 神级联动! Claude code 不想订阅了, API token 选哪家? 你们 CC 都用在新项目?老项目呢? 求一个 iOS 应用,接自定义 API 看看各位的 Vibe Coding 配置 [调研] 主流编程 agent Qoder 要恢复原价了. 价格直接翻倍, 消费不起了.... 简单使用了一周在本地 Mac 的 qwen3.6-35b-a3b 模型 一线城市回县城两年,有回乡或想回乡的可以交流下 有什么龙虾、养虾 OpenClaw 论坛推荐吗 ? codex 有什么好的中转站吗 大家有没有发现下午 2~3 点开始, coding vibe 就开始变慢 VsCode 切换到 TRAE 国际版还是 Cursor? - V2EX 麻烦推荐下比较稳定的梯子,我现在两个梯子美国节点都不能用了 当我让 gemini3.1-pro 评价一下 minimax-m2.7 MiniMax 29 元的套餐访问 BASE_URL 报 404 大模型选择求助 mini-cc:打造你的专属轻量级 AI 编程智能体 别再写 Selenium 了!这个 AI Agent 一条命令搞定浏览器自动化 给用户配置专门的智能聊天机器人,只能人工调教吗 做了个 TS 多 Agent 框架拿了 5700+ stars,但发现国内几乎没人用,想了解下大家的情况 朋友闲聊: AI 的三个核心问题—工具、认知与产业的再思考 kimi 2.6 有没有用过的?和智普 5.1 比如何? - V2EX 我该订阅哪家 AI? Coding Plan 推荐 - V2EX MacOS 上搭建了本地的 Gemma4,如何与它协作最高效? - V2EX [开源] 做了个桌面虚拟陪伴助手 CodeWalkers 各位大佬,有没有遇到过 antigravity 在移动网络不能使用的问题? claude 最近泄露的源码和官方开源的 github.com/anthropics/claude-code 是啥关系? 不考虑中转,有哪些靠谱的个人方案? antigravity 的 Claude 用量是一个谜 🚀 开源发布!全栈 AI Agent 实战项目 & 保姆级教程 Coding Plan 实测额度,给有需要的人 分享一个自用的 全自动开发 多 Agent 编排脚本 求一个 agent 开发交流群 superpowers skills 使用中的问题 我写了款 iOS 输入法,帮 LLM 窥探你的隐私 CrabTalk: 8MB agent daemon 今天在 PH launch, 老板们求助力! - V2EX OpenSpec 还是 Cursor Plan 分享一个 AI 漫剧 Agent 项目: Anime AI Studio,已开源 AI 发展的终极形态是贾维斯吗?如果是的话,在国内真的可能吗? [opencode] 我只能说 bug 太多了 - V2EX 一个不会设计的人,用 ChatGPT+ UIPro-CLI + OpenClaw 做了在线一个拼图工具的反思 求助,如果 ai 钻入了一个错误方向,怎么能重新纠正它的注意力 给 ccem 补了个微信机器人入口,现在能直接用微信远程叫 Claude 干活了 写了个 Rust 版本的 Wechat Bot API 微信支持连接小龙虾了 我是怎么看待 AI 的? 现在千问 Qwen3.5-Plus 都开始饥饿营销了吗? - V2EX 开源智能体系统越来越多,还有必要自己开发吗 Antigravity 修改前端代码会自动打开浏览器检查 - V2EX 准备离职长休搞自己的小项目--求个抗造的大杯 AI 订阅建议 预测下一个词的大语言模型为什么会涌现出智能 [问大家] 同时用多个 AI 服务(ChatGPT/Claude/Kimi),你们怎么追踪费用的? 🦞小龙虾应用第二项:让它加入自己的社区进行学习和探索 抽象一下:无能的丈夫 skill 火山 codeplan 也太慢了 - V2EX 🦞小龙虾应用第一项:自动搜集并更新博客 rust 写了个非常轻量的 meta search tool 告别 brave API 关于最近火热的中转站推广,入门成本有多高 听说有 V 友的龙虾在抓 V 站热帖? 看好腾讯和小米能做出超级 AI 入口 openclaw 纯纯的割韭菜
给大家分享一个,我用 Python 重写的一个完全免费的 5 引擎搜索 MCP
duanshiwen · 2026-06-01 · via AI Agent 智能体

[开源] 各位大佬好,分享一个我最近折腾的项目。

起因是我在用 mrkrsl/web-search-mcp( TypeScript ,⭐ 910 )的时候,发现几个不太够用的地方:没有 Google 和百度、CAPTCHA 直接挂掉、页面提取绑死在搜索流程里……改着改着发现改动量太大了,索性用 Python 从头重写了一遍。

GitHub: https://github.com/duanshiwen/seach-mcp-craft-agent

和原版的核心区别

原版 (TypeScript) 改进版 (Python)
语言 TypeScript + JavaScript Python 3.10+
搜索引擎 Bing / Brave / DuckDuckGo Google / Bing / 百度 / DuckDuckGo / Yahoo
CAPTCHA ❌ 无处理 ✅ 自动检测 + 弹窗等待手动验证
浏览器管理 共享实例 全局队列锁 + per-engine 独立 profile
网页提取 绑在搜索流程里 独立 web_fetch 工具,auto/http/js 三种模式
百度 ✅ 浏览器 + HTTP 双保险
目标用户 本地 LLM ( LM Studio / LibreChat ) 所有 MCP 客户端

原版的引擎层、浏览器生命周期、CAPTCHA 处理等核心模块都绑在 JS 生态里。我的改动涉及这些底层,与其在原版上打补丁,不如用 Python 重写——httpx + selectolax 替代 Axios ,代码更简洁,后续加新引擎也方便。

两个核心改进

1. CAPTCHA 自动检测 + 手动验证

原版遇到 CAPTCHA 直接挂。我的版本用可见浏览器模式搜索,触发 CAPTCHA 时:

  • 自动检测到验证码页面
  • 用户在同一个浏览器窗口手动完成验证
  • 程序每 2 秒轮询,验证通过后自动提取结果并关闭窗口
  • 默认等待 300 秒超时,超时返回空结果并建议换引擎

每个引擎用独立的浏览器 profile ,不会污染你的日常 Chrome 。

2. 独立的 web_fetch 网页内容提取

原版的页面提取是绑在搜索流程里的,我把拆成了独立工具:

{
  "url": "https://example.com/article",
  "render_mode": "auto",
  "extract_mode": "markdown"
}
  • auto 模式先走轻量 HTTP ,检测到 JS-only 页面自动 fallback 到 Playwright
  • 自动去除广告、导航栏等干扰,提取正文
  • 超时上限 12 分钟,SPA 页面也能搞定

搜索完直接用 web_fetch 抓全文,不用再接别的工具。

为什么不用 SerpAPI / Brave Search API ?

这是做这个项目之前我自己纠结过的问题,说说我的判断:

SerpAPI:免费版每月 100 次搜索,付费版 $50/月起。对个人开发者做个 demo 够了,但跑 Agent 工作流每天可能就要几百次搜索,一个月下来成本不低。

Brave Search API:$5/1000 次请求,每月送 $5 额度(≈ 1000 次免费)。价格比 SerpAPI 友好很多,但问题是——它只能搜 Brave 的索引,结果质量和 Google 差距明显,尤其是中文内容。

Google Custom Search API:免费 100 次/天,超出 $5/1000 次。看似便宜,但 100 次/天对 Agent 来说杯水车薪,而且返回的结果不如直接浏览器搜索丰富。

我的选择:直接用浏览器搜索。

  • 结果最全最实时,和你手动打开浏览器搜的一样
  • 完全免费,没有调用限制
  • 支持 5 个引擎,不是只搜一个索引

代价是需要 Playwright 和真实浏览器,比 API 调用重一些。但对 Agent 工作流来说,搜索质量比速度更重要——你宁可多等 3 秒拿到准确结果,也不要秒回一个过时的摘要。

安装

git clone https://github.com/duanshiwen/seach-mcp-craft-agent.git
cd seach-mcp-craft-agent
uv sync  # 或 pip install -e .
playwright install chromium

MCP 客户端配置:

{
  "mcpServers": {
    "search-engine-mcp": {
      "command": "python",
      "args": ["-m", "src.server"],
      "cwd": "/path/to/seach-mcp-craft-agent"
    }
  }
}

使用示例

{
  "query": "Rust async best practices",
  "engine": "google",
  "max_results": 5
}

引擎选择建议:

  • 快速查询 → DuckDuckGo (轻量 HTTP ,1-3s )
  • 要最全结果 → Google (浏览器模式,3-10s )
  • 中文内容 → Bing 或百度

项目结构

src/
├── server.py            # MCP 服务主入口
├── engines/
│   ├── base.py          # HTTP 引擎基类
│   ├── browser_base.py  # 浏览器引擎基类( CAPTCHA 、队列锁、profile 隔离)
│   ├── google.py
│   ├── bing.py          # 浏览器 + HTTP fallback
│   ├── baidu.py         # 浏览器 + HTTP fallback
│   ├── duckduckgo.py
│   └── yahoo.py
├── fetcher.py           # web_fetch 实现
└── types.py / utils.py

加新引擎只需要继承对应基类、实现几个方法就行,README 里有详细说明。

碎碎念

做这个项目过程中的几个观察:

  1. JS 渲染是 2026 年搜索工具的门槛了。Google 的搜索结果甚至需要 JS 执行完才会出现,纯 HTTP 方案基本不可用
  2. 免费方案反而比付费 API 好用。直接浏览器搜结果最全最实时,API 受限太多
  3. 失败兜底比成功路径更重要。CAPTCHA 、超时、页面变化都是常态,双路渲染+队列管理这些"不性感"的设计才是稳定性的基石
  4. 感谢原作者 mrkrsl 的优秀工作

欢迎各位大佬试用提 PR ,有问题直接回复聊~