惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

U
Unit 42
A
About on SuperTechFans
J
Java Code Geeks
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Stack Overflow Blog
Stack Overflow Blog
Recent Announcements
Recent Announcements
GbyAI
GbyAI
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
MongoDB | Blog
MongoDB | Blog
MyScale Blog
MyScale Blog
aimingoo的专栏
aimingoo的专栏
H
Help Net Security
月光博客
月光博客
博客园 - Franky
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Apple Machine Learning Research
Apple Machine Learning Research
The Cloudflare Blog
WordPress大学
WordPress大学
S
SegmentFault 最新的问题
T
Tailwind CSS Blog
Jina AI
Jina AI
有赞技术团队
有赞技术团队
博客园_首页

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
OpenClaw 部署复盘:放弃 API 焦虑,几种“零成本”高智商接入...
Watchdog · 2026-02-09 · via V2EX

前言: 针对坛友 bot 部署中常讨论的 Token 成本与模型智障问题,分享基于我的低成本(纯白嫖)接入方案。本文仅讨论技术实现与体验差异,不涉及推广。

一、API 方案(不推荐):高延迟与低可用性的妥协 API 接入虽然标准,但在“白嫖”或低成本层级下,体验往往受限于 RPM (Requests Per Minute) 和推断速度。

1.NVIDIA NIM (GLM-4.7-Flash): 规格: 免费层提供 GLM-4.7 ,理论性能不错。 实测: 限制 40 RPM 。最大的问题是延迟( Latency ),推断队列极长,导致 Agent 响应迟钝。 结论: 仅适合作为 fallback 或低频任务备用。

2.其他备选: Google AI Studio: 免费层可用,但风控严格。 Modelscope (魔搭):听说还行,没用过。 SiliconFlow (硅基流动): 免费额度甚至不如本地量化模型实用,Pass 。

二、OAuth (你可以白嫖的订阅):我认可的目前的最优解 通过模拟用户会话( OAuth/Cookie )接入,通常能获得该模型满血版的推理能力和更大的上下文窗口。

1.Gemini (Google CLI / Anti-Gravity)

推荐指数: ⭐⭐⭐⭐⭐

接入方式: openclaw 原生支持 Google cli + 反重力 (AntiGravity) 接入。

优势: 智商在线: 完整的 Flash/Pro 体验,非阉割版,还有 Claude opus/sonnet 。 额度池: Flash 与 Pro 额度独立计算。 家庭组策略: 一个主号可开 5 个家庭组子号,配合 OpenClaw 的轮询策略( Round-Robin ),理论上可获得 6 账号 * ((Flash + Pro)*2+Claude) = 30 独立额度,叠加 5h 刷新的 flash ,可以说是其实单账号也是怎么也用不完的逆天额度。 状态: 目前 Edu 邮箱依然存活,建议自行解决账号源,勿通过二手渠道(高风险)。

2.Qwen (海外版)

推荐指数: ⭐⭐⭐⭐

优势: 注册即用,无门槛,openclaw 原生支持。

缺点: 朋友推荐,我没实测。

3.OpenAI (ChatGPT)

推荐指数: ⭐⭐⭐⭐

依然 openclaw 原生支持,本来肯定想放第二位推荐,但白嫖车已开走,适用已订阅用户。

策略: 适合作为 Coding 任务的主力( Gemini 在代码生成的准确性上仍逊于 GPT-5.3-codex )。 免费层额度每周重置,适合高强度突击使用 2-3 天,不适合 7x24 小时挂机,更别拿来挂 heartbeat 。

三、 建议与实操体验 模型路由 (Router): 建议日常对话/总结接 Gemini ,写代码上 codex 或者反重力的 claude 。

权限警示: OpenClaw 作为一个拥有本地 Shell 读写权限的 Agent ,其安全性完全依赖于模型的指令遵循能力。基模( Base Model )智商过低会导致指令误读,进而误删文件或执行错误脚本。

长期使用建议建立 .md 格式的 Memory/Todo/workflow 体系(我自己又加了给人看的日记 journal 和实用手册)。实测 Gemini 拟人化、全能任务最强,基本能达到“伴生助手”的体验。(最舍不得的是白嫖额度实在太 tm 够用了)

真实经验+AI 润色,欢迎补充