惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

I
InfoQ
G
Google Developers Blog
Engineering at Meta
Engineering at Meta
月光博客
月光博客
博客园 - 聂微东
博客园 - Franky
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
有赞技术团队
有赞技术团队
A
About on SuperTechFans
Microsoft Azure Blog
Microsoft Azure Blog
Blog — PlanetScale
Blog — PlanetScale
U
Unit 42
T
Tailwind CSS Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
云风的 BLOG
云风的 BLOG
S
SegmentFault 最新的问题
F
Fortinet All Blogs
H
Help Net Security
J
Java Code Geeks
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 叶小钗
L
LangChain Blog
Martin Fowler
Martin Fowler
N
Netflix TechBlog - Medium

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
用 Next.js + Claude 做了个 AI 调研助手,一个问题出一份分...
sunfinv · 2026-03-03 · via V2EX

最近自己创业需要做大量市场调研,每次都要:搜一堆网页、挨个打开、提炼要点、整理成文档。重复劳动太多,于是花了两周做了这个工具,现在开源出来。

GitHub: https://github.com/finvfamily/farsight

它能做什么

输入一个问题,自动跑完整个调研流水线:

搜索( Tavily )→ 抓取正文(自研 HTTP 爬虫)→ 提取洞察( LLM )→ 生成报告

实测「 AI 编程工具市场现状」这个 query ,大概 60 秒出报告,包含:

  • 结构化正文(自动分节,每节有数据支撑)
  • 内联引用,[n] 可点击跳转到来源
  • 竞品对比矩阵(识别到是竞品分析意图时自动生成)
  • 一键导出 Markdown / 分享链接

技术实现

核心架构是一个 Skill 调度引擎:

collect → parse → analyze → output

同阶段并行,跨阶段串行。每个 Skill 是独立模块,加新数据源只需新建一个文件。

爬虫没有用 Playwright,自己用 fetch + Readability 实现了一个纯 HTTP 爬虫:

  • 4 个 UA 轮换降低被拦截概率
  • AbortController 超时保护( 12s/页)
  • Readability 提取正文,失败降级为 DOM 文本清洗
  • 批量并发 3 个,Promise.allSettled 处理部分失败
  • 对 JS 渲染的 SPA 自动降级用搜索 snippet 兜底

LLM 支持 Claude 和 MiniMax 双路由,可以用 LLM_PROVIDER 环境变量切换,或者按任务类型自动选择(规划/合成用 Claude ,提取用 MiniMax 省成本)。

本地跑起来

git clone https://github.com/finvfamily/farsight
cd farsight
pnpm install
cp .env.local.example .env.local   # 填入 ANTHROPIC_API_KEY 和 TAVILY_API_KEY
pnpm dev

Tavily 免费额度 1000 次/月,够用来测试。

欢迎贡献新 Skill

加新数据源非常简单,比如企查查、App Store 评论、36 氪 RSS ,只需要:

  1. lib/skills/ 新建一个文件
  2. SKILL_MAP 里注册
  3. 在 Planner 的 system prompt 里加一行描述

就能被 LLM 自动调度。


项目刚开源,代码还比较粗糙,欢迎 issue 和 PR 。如果觉得有用,star 一下也很感谢 🙏

有问题可以在这里回复,或者直接开 issue 。


发帖建议

  • 节点分享创造程序员
  • 配图:附上两张截图(首页场景入口 + 报告页面)
  • 时间:工作日早上 9-10 点或晚上 9-10 点发,曝光最高
  • 互动:前 30 分钟多回复评论,能显著提升热度排名