惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
Google DeepMind News
Google DeepMind News
阮一峰的网络日志
阮一峰的网络日志
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
T
The Blog of Author Tim Ferriss
MongoDB | Blog
MongoDB | Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
B
Blog
AWS News Blog
AWS News Blog
K
Kaspersky official blog
Hugging Face - Blog
Hugging Face - Blog
博客园 - 叶小钗
Last Week in AI
Last Week in AI
T
Threat Research - Cisco Blogs
The Cloudflare Blog
人人都是产品经理
人人都是产品经理
C
Cyber Attacks, Cyber Crime and Cyber Security
L
Lohrmann on Cybersecurity
P
Privacy & Cybersecurity Law Blog
P
Proofpoint News Feed
S
Security @ Cisco Blogs
Recorded Future
Recorded Future
G
GRAHAM CLULEY
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
Secure Thoughts
腾讯CDC
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Simon Willison's Weblog
Simon Willison's Weblog
S
SegmentFault 最新的问题
Google Online Security Blog
Google Online Security Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
A
About on SuperTechFans
S
Schneier on Security
L
LINUX DO - 热门话题
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
Microsoft Security Blog
Microsoft Security Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
Apple Machine Learning Research
Apple Machine Learning Research
NISL@THU
NISL@THU
Recent Announcements
Recent Announcements
Schneier on Security
Schneier on Security
小众软件
小众软件
Stack Overflow Blog
Stack Overflow Blog
Jina AI
Jina AI
V
Visual Studio Blog
TaoSecurity Blog
TaoSecurity Blog
C
Cybersecurity and Infrastructure Security Agency CISA
O
OpenAI News
S
Securelist

AI Agent 智能体

闭坑 老蹬中转站 qzz.io MiMo Token 激励计划:你们拿它做出了什么? 分享一个 Claude Code 脚手架: abc-scaffold 被喷了一天后,我觉得技术不值钱这句话应该改一下 中转站的安全性如何保障, Agent 一个提示就是几百个工具调用,几十个 exec 没人会一个一个审核吧。 以后技术鄙视链可能就一句话:你会不会使唤 Agent 最近又造了个轮子,基于 AI 的软件交付工作流引擎 自从有了 AI 之后, Commit 数量是不是已经不适合衡量开发效率了 我发现有了 AI 之后,很多人都在重复造轮子 AI 时代 产品需求文档(PRD) 软件需求文档(SRS) 应该怎么写呢?有推荐的模板吗?有推荐的 SKILL 吗? 征求可行方案:远程操控 + codex 桌面端 computer use 功能 + API 中转 - V2EX 做了个常驻的 AI 金融分析 Agent —— 不给买卖信号,只把事实端给你看 我跑了一晚 RAG,发现问题不在检索层 你们用的桌面 Agent 都是啥, 能操作浏览器么? Ucloud 也下场做中转站了 是不是第一个大厂做 gpt/anthropic 中转站的 怎么做的合规 如果为了本地大模型,卖掉 MacBook Pro M3 Pro 36G,买Μ5 Max 128G,合适吗? 照 AI 这个发展速度,感觉 AI 失控导致世界末日不远了 有用 openclaw 排杂志或者月刊的没?能达到 HTML 的效果吧? - V2EX 做了一个本地查看 Coding Agent API trace 的工具: claude-tap docker sandbox + Codex CLI 这个方案可做开发自动化吗? 把 LLM 当成“人”,才是 Agent 工程进阶的起点 目前无人值守的 AI 开发流程是否有研究前途 - V2EX 你还能回到没有 AI 的过去吗? 最近两周在用向量数据库来给 Hermes 扩充脑容量,直接让我力竭了。 火山新出了 Agent Plan,涨价 2~7.5 倍 - V2EX GLM 崩了? - V2EX 做了个小工具:让本地 AI Agent 操作堡垒机后的远程 Linux 环境 - V2EX “这个确实有点复杂。要不先把这个功能延后到 TODO,今晚先收工?已经凌晨快 2 点了。” - V2EX AI 大趋势,有人转全栈了吗?有没有成功案例可以分享一波的 - V2EX 做了一个给 AI agent 用的"万能钥匙",一个 key 调所有社交平台和数据源 - V2EX memory 真的会让 Agent 变得更好用吗? - V2EX Macbook 上装的 OpenAI Codex App 如何才能使用国内的大模型? 刚接了 hermes agent,这是微信 ClawBot 的 bug 吗? 你们给 agent 配的谁家的模型?求推荐 openclaw 和 hermes agent 支持多个聊天机器人吗 没啥事研究了一下 Hermes agent 原理 OpenClaw, Hermes, Mercury 或其他,哪个个人 Agent 能真正投入使用? 向佬们征集一些实务上遇到的法律实务问题或疑惑 Claude Code 和 Codex 神级联动! Claude code 不想订阅了, API token 选哪家? 你们 CC 都用在新项目?老项目呢? 求一个 iOS 应用,接自定义 API 看看各位的 Vibe Coding 配置 [调研] 主流编程 agent Qoder 要恢复原价了. 价格直接翻倍, 消费不起了.... 简单使用了一周在本地 Mac 的 qwen3.6-35b-a3b 模型 一线城市回县城两年,有回乡或想回乡的可以交流下 有什么龙虾、养虾 OpenClaw 论坛推荐吗 ? codex 有什么好的中转站吗 大家有没有发现下午 2~3 点开始, coding vibe 就开始变慢 VsCode 切换到 TRAE 国际版还是 Cursor? - V2EX 麻烦推荐下比较稳定的梯子,我现在两个梯子美国节点都不能用了 当我让 gemini3.1-pro 评价一下 minimax-m2.7 MiniMax 29 元的套餐访问 BASE_URL 报 404 大模型选择求助 mini-cc:打造你的专属轻量级 AI 编程智能体 别再写 Selenium 了!这个 AI Agent 一条命令搞定浏览器自动化 给用户配置专门的智能聊天机器人,只能人工调教吗 做了个 TS 多 Agent 框架拿了 5700+ stars,但发现国内几乎没人用,想了解下大家的情况 朋友闲聊: AI 的三个核心问题—工具、认知与产业的再思考 kimi 2.6 有没有用过的?和智普 5.1 比如何? - V2EX 我该订阅哪家 AI? Coding Plan 推荐 - V2EX [开源] 做了个桌面虚拟陪伴助手 CodeWalkers 各位大佬,有没有遇到过 antigravity 在移动网络不能使用的问题? claude 最近泄露的源码和官方开源的 github.com/anthropics/claude-code 是啥关系? 不考虑中转,有哪些靠谱的个人方案? antigravity 的 Claude 用量是一个谜 🚀 开源发布!全栈 AI Agent 实战项目 & 保姆级教程 Coding Plan 实测额度,给有需要的人 分享一个自用的 全自动开发 多 Agent 编排脚本 求一个 agent 开发交流群 superpowers skills 使用中的问题 我写了款 iOS 输入法,帮 LLM 窥探你的隐私 CrabTalk: 8MB agent daemon 今天在 PH launch, 老板们求助力! - V2EX OpenSpec 还是 Cursor Plan 分享一个 AI 漫剧 Agent 项目: Anime AI Studio,已开源 AI 发展的终极形态是贾维斯吗?如果是的话,在国内真的可能吗? [opencode] 我只能说 bug 太多了 - V2EX 一个不会设计的人,用 ChatGPT+ UIPro-CLI + OpenClaw 做了在线一个拼图工具的反思 求助,如果 ai 钻入了一个错误方向,怎么能重新纠正它的注意力 给 ccem 补了个微信机器人入口,现在能直接用微信远程叫 Claude 干活了 写了个 Rust 版本的 Wechat Bot API 微信支持连接小龙虾了 我是怎么看待 AI 的? 现在千问 Qwen3.5-Plus 都开始饥饿营销了吗? - V2EX 开源智能体系统越来越多,还有必要自己开发吗 Antigravity 修改前端代码会自动打开浏览器检查 - V2EX 准备离职长休搞自己的小项目--求个抗造的大杯 AI 订阅建议 预测下一个词的大语言模型为什么会涌现出智能 [问大家] 同时用多个 AI 服务(ChatGPT/Claude/Kimi),你们怎么追踪费用的? 🦞小龙虾应用第二项:让它加入自己的社区进行学习和探索 抽象一下:无能的丈夫 skill 火山 codeplan 也太慢了 - V2EX 🦞小龙虾应用第一项:自动搜集并更新博客 rust 写了个非常轻量的 meta search tool 告别 brave API 关于最近火热的中转站推广,入门成本有多高 听说有 V 友的龙虾在抓 V 站热帖? 看好腾讯和小米能做出超级 AI 入口 openclaw 纯纯的割韭菜
MacOS 上搭建了本地的 Gemma4,如何与它协作最高效? - V2EX
viskem · 2026-04-10 · via AI Agent 智能体

这是一个创建于 65 天前的主题,其中的信息可能已经有所发展或是发生改变。

各位是如何做的?是使用什么对话窗口或是命令行、或者第三方工具? ClaudeCode / Cursor ? 平时我都用 Cursor 。(因为 ClaudeCode 屏蔽比较猛烈)所以本地的如何高效协作还希望参考下大家的优雅作风。

Brightt

1

Brightt      4 月 10 日

搞的多少 B 的模型?

kizunai

3

kizunai      4 月 10 日

没有用,就 M 芯片那个 prefill 速度,也就短点的对话还行,放弃辅助编程吧,别占用硬盘空间了

Hilong

4

Hilong      4 月 10 日

楼上+1 基本长一点的上下文就卡住动不了了。搞搞小的对话还行,写代码还是算了吧

penisulaS

5

penisulaS      4 月 10 日

本地模型笨笨的,有什么需要超大量上下文但不需要高智能的场景吗

diudiuu

6

diudiuu      4 月 10 日

还是笨笨的。你可以使用 vscode ClaudeCode 插件,配置本地模型

dacapoday

7

dacapoday      4 月 10 日

非常适合做总结和提供索引,为更高级的模型提供服务,方便其更好的索引文档(业务总结的文字往往更精辟和专业,全文搜索更容易找到,然后 ai 再根据总结中包含的文件路径找到对应的文件).相当于一个简易的知识图谱,而且在不断丰富语义描述.

dacapoday

8

dacapoday      4 月 10 日

我也在折腾 gemma4, 感觉 V2EX 的人年龄偏大,比较迟钝. 看不懂 ai 的能力. 现在 local llm 的潜力巨大.

tcper

10

tcper      4 月 10 日

26B 模型至少需要 24G VRAM 等同显卡
macbook/mini 48G 内存版或以上(操作系统,浏览器也得吃一大半内存)
以本人对 V 站的了解,大部分人没这个经济实力

darksword21

11

darksword21      4 月 10 日

我还在尝试用 mlx 跑 E2B 的( 16G air )。。。

感觉也就一次性做个翻译之类的工作,

hash

12

hash      4 月 10 日

放弃尝试本地模型这种浪费时间的行为最高效

kirbyzhu

13

kirbyzhu      4 月 10 日 via iPhone

个人感觉用处不大

emberzhang

14

emberzhang      4 月 10 日

卵用没有的。26b a4b 这种玩意给龙虾调用 tool ,一调一个不吱声全是失败

之前大内存 mac 是 70b 、122b 给 cherry studio 聊什么计算 24 点自己骗自己

现在大内存 mac 是 26b 、35b 扔给龙虾心跳,7x24 小时 龙虾屁事没干,人眼看着 omlx token 生成量继续骗自己

viskem

16

viskem      4 月 10 日

@chenzhihuiiiii 就是想让他慢慢熟悉项目和搜罗信息,帮我调整一些项目管理系统的信息,和大家简单推点通知啥的,简单问答一些项目上的信息。(我已经逐步认清现实……)

haohaozaici

17

haohaozaici      4 月 10 日

没有显卡,9950x 本地跑 Gemma4 e4b ,只有 30 token/s ,没法写代码,简单问问题还行

zoozobib

18

zoozobib      4 月 10 日   ❤️ 1

已经用 gemma4 31b q4 量化的版本重构了半个 app 了,现在主力用它,opencode + openclaw + hermes ,接入了几个必用的 mcp ,如 word amap chrome opencli 等等,反正目前写文档、旅游计划、写代码主用这个模型。双显卡 上下文 35-58 所有的 token ,目前从涉及到的所有项目上看,很能打; moe 没试过

zoozobib

19

zoozobib      4 月 10 日

不过我最高开 200K 的上下文,到 120K 以上的上下文 token 速度有所下降

zoozobib

21

zoozobib      4 月 10 日   ❤️ 1

@viskem 没试过 27B 的 gemma4 , btw 有人觉得 qwen3.5 27b 很猛,我之前也用过一段时间,不过它性能一般且废话太多;另外,moe 和 dense 在复杂任务下还是有明显区别的,moe 我之前玩下来 还是可以的,不过上下文别太大,主打一个性能绝佳,跑跑 agent 任务还可以,开 reasoning 的情况下.

zoozobib

23

zoozobib      4 月 10 日   ❤️ 1

@viskem 配置不错,可以关注下 mlx + turboquant 的方案,现在玩家不少了

kevan

25

kevan      4 月 10 日

昨天 5070ti+32GB 跑 26B 真的吃力。

Teresa789

27

Teresa789      4 月 10 日

前两天我同事给我安利,然后昨天我试了下,只能说体验极差,不知道网上说用 mac 跑这个 Gemma4 的是不是受了库克的钱🐶,随便问个简单的问题,都上几百秒的。想 vibicoding 算了吧
本人设备:mac studio m4 64GB

zoozobib

29

zoozobib      4 月 11 日

@nidhogger 32g + x570e + [4080s(或 3090 nvlink) + 3090] + c2000 2t ; 如果双显卡是 nvlink ,性能会比我当前还好,我现在是跑 pcie

zoozobib

30

zoozobib      4 月 11 日

@nidhogger pcie 35-38 左右的 token , --model ./google_gemma-4-31B-it-Q4_K_L.gguf --mmproj ./mmproj-gemma-4-31B.f16.gguf -ngl 99 --tensor-split 14,26 --ctx-size 204800 --flash-attn on --cache-type-k q8_0 --cache-type-v q8_0 --cache-ram 0 -np 1