惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

N
Netflix TechBlog - Medium
月光博客
月光博客
Y
Y Combinator Blog
WordPress大学
WordPress大学
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
雷峰网
雷峰网
美团技术团队
T
Tailwind CSS Blog
小众软件
小众软件
量子位
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
有赞技术团队
有赞技术团队
P
Proofpoint News Feed
G
Google Developers Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Recent Announcements
Recent Announcements
The GitHub Blog
The GitHub Blog
博客园 - 三生石上(FineUI控件)
云风的 BLOG
云风的 BLOG
Vercel News
Vercel News
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
爱范儿
爱范儿
V
Visual Studio Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More

Ruby China

云端 Coding 插件:让 AI 大模型为你的网页实时提优化建议 昨天旁边研究生在学数据库,看范式,我当年也学过,但是工作了以后,发现根本用不到 vs eclipse vim 哪里落后了 金山毒霸推出青春版是不是认为自己不行 【自荐】PriTime:一个可自托管的多端待办任务清单、时间管理应用 omarchy 竟然还有中文宣传 绿标 apollo 音乐逼系统重启 UI 做了一个 zero-noise 的“赛博禅师”:在信息过载时代做个极简 Web 实验 DHH 发布了 agentic linux,作为 Ruby China 老用户也开源发布了 agentic workspace 又拍云的公司好像出问题了 notification 页面出错 【远程】【区块链】后端工程师 MEME 交易方向,欢迎大家来聊 【举报】web3 全栈工程师为 带有病毒的钓鱼贴!各位不要上当! Server+ Training in Pune | Master Server Administration Skills 开发 APP 或小程序,大家后端使用的什么 admin 或 cms 或其它什么解决方案? Omarchy 4 aka Quattro 【杭州】招聘 Ruby on Rails 全栈开发,欢迎加入! 针对 Rails 的 AI 模型评测报告 [深圳] AI 智能硬件 + App 海外产品,招 Ruby on Rails 工程师 想不到浓眉大眼的 DHH 和 Jason Lee 也变心了 懂业务的人用 AI 写代码,反杀了程序员… 台灣小雨外送茶 line 外約瀨 fba988 或 jkf44 和 TG 喝茶@fb15800 現金消費不喜可退換 Gleezy 群組搜 fb158 保證安全健康#高中生#在校生大學生#模特空姐 台灣小雨外送茶 line 外約瀨 fba988 或 jkf44 和 TG 喝茶@fb15800 現金消費不喜可退換 Gleezy 群組搜 fb158 保證安全健康#高中生#在校生大學生#模特空姐 台灣小雨外送茶 line 外約瀨 fba988 或 jkf44 和 TG 喝茶@fb15800 現金消費不喜可退換 Gleezy 群組搜 fb158 保證安全健康#高中生#在校生大學生#模特空姐 pearls 个人开发者做的两个 Chrome 小扩展(基金估值 / 金价),欢迎试用 问一下各位 codex 怎么突破子代理上限哇 jupyter notebook 支持 ruby 怎么不见有人用呢 ruby 有没有 pylance 级别的 lsp? 消失 14 年后回 Ruby China 报到
Agent-Reach 实测:让 AI Agent 一键搜索全网,我踩了 3 个大坑
KEKE666 · 2026-08-04 · via Ruby China

上周在 GitHub Trending 上看到一个项目叫 Agent-Reach,日增 1045 星,简介只有一句话——"Give your AI Agent the ability to search the entire internet"。

给 AI Agent 装上全网搜索能力?这不就是我一直在找的东西吗?

我们团队在做一个行业研究 Agent,需要实时抓取多个平台的讨论数据。之前自己写爬虫,被反爬搞到怀疑人生——Reddit 要 OAuth,Twitter/X 要 API Key(还收费),B 站和知乎各种验证码。维护成本比开发成本还高。

Agent-Reach 号称"无需任何 API Key,一条命令部署,零额外费用"。

我抱着试试看的心态装了。

选型理由:为什么选 Agent-Reach 而不是自建爬虫?

坑 1:小红书搜索不稳定,成功率只有 60%

文档说支持小红书,但实测发现小红书的搜索经常超时。原因是小红书的反爬机制很激进,Agent-Reach 用的是模拟浏览器请求,但没做指纹伪装。

解决方案:我在 Agent-Reach 外面包了一层重试逻辑,3 次超时后换 IP(用代理池),成功率提升到 85%。但这也意味着不能完全"零成本"了,代理池还是要花钱的。

坑 2:返回数据格式不统一,不同平台的字段名不一样

Reddit 返回的数据结构是{title, body, upvotes, comments},Twitter 是{text, likes, retweets},B 站是{title, description, play, danmaku}。每个平台的字段名和结构都不一样,直接灌进 Agent 会导致理解混乱。

解决方案:我写了一个统一适配层,把所有平台的返回数据标准化为{platform, title, content, engagement_score, url, timestamp}格式。engagement_score 是根据各平台的互动指标换算的统一热度值。

对了。顺嘴提一句,技术大厂,前后端 - 测试机会,全国一线及双线城市均有坑位(https://jsj.top/f/o38ijj)待遇和稳定性还不错,感兴趣看看。

坑 3:并发请求太多会被平台封 IP

我在做竞品调研时,一次性搜索了 6 个平台 5 个关键词,总共 30 个并发请求。结果 GitHub 和 Reddit 直接返回 429,Twitter 临时封了我的 IP 2 小时。

解决方案:加了个简单的限流器,每秒最多 3 个请求,每个平台间隔 2 秒。搜索时间从 30 秒变成 3 分钟,但稳定性从 70% 提升到 98%。

最终数据对比: 结论:Agent-Reach 适合"快速验证 + 中等精度"的搜索场景,不适合做高精度的数据采集。如果你的 Agent 需要实时、精确、全量的数据,还是得自建。但如果你只是想让 Agent 能"搜一下最近大家在聊什么",这玩意儿 5 分钟就能跑起来。

项目地址:https://github.com/Panniantong/Agent-Reach