惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
Application and Cybersecurity Blog
Application and Cybersecurity Blog
G
GRAHAM CLULEY
P
Privacy International News Feed
L
LINUX DO - 热门话题
C
Cisco Blogs
T
Tor Project blog
AWS News Blog
AWS News Blog
K
Kaspersky official blog
C
Cybersecurity and Infrastructure Security Agency CISA
Cyberwarzone
Cyberwarzone
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
CERT Recently Published Vulnerability Notes
P
Proofpoint News Feed
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
L
Lohrmann on Cybersecurity
C
CXSECURITY Database RSS Feed - CXSecurity.com
Project Zero
Project Zero
Attack and Defense Labs
Attack and Defense Labs
Latest news
Latest news
The Last Watchdog
The Last Watchdog
Apple Machine Learning Research
Apple Machine Learning Research
Simon Willison's Weblog
Simon Willison's Weblog
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
Cloudbric
Cloudbric
Last Week in AI
Last Week in AI
S
Security Affairs
Google DeepMind News
Google DeepMind News
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
有赞技术团队
有赞技术团队
V
Visual Studio Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
小众软件
小众软件
P
Palo Alto Networks Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
Security @ Cisco Blogs
V
V2EX
S
Secure Thoughts
人人都是产品经理
人人都是产品经理
月光博客
月光博客
博客园_首页
T
Troy Hunt's Blog
爱范儿
爱范儿
N
News and Events Feed by Topic
Hugging Face - Blog
Hugging Face - Blog
雷峰网
雷峰网
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
P
Privacy & Cybersecurity Law Blog
V
Vulnerabilities – Threatpost

人工智能

暴论:只把 AI 用来提高工作效率,那么你没有在 AI 浪潮中收益 - V2EX 前阵子看到 4 台 MAC 运行万亿参数模型的新闻,当前大致投入在 30 万 RMB 左右,大家预测一下几年后会实现低成本(5W 以下)本地部署万亿参数的模型? - V2EX 大家有 AI 焦虑吗? - V2EX ChatGPT 的细节体验是越来越好了,一天一个样! - V2EX 计划要给行政办公人员做 AI 培训,内容包括指导如何利用 AI 编写小工具应用 - V2EX Zcode 思考了 5 分钟不出字,只是我一个人问题吗 - V2EX GLM5.2 有点豆包那味了 - V2EX ai 对动漫的影响,爱奇艺动漫《都市古医仙》似乎全转 ai 生成了 - V2EX 一个抢 GLM plan 的方法 - V2EX v2 上面的这种风格的内容总结图是怎么生成的呢? - V2EX 分享一下我试用过的几款 AI 套餐 AI 写项目就想熵增 - V2EX 中转站,代充值,这种真是避而远之 cursor 的 auto 模式今天突然使用中文思考 怎么系统学习 AI? copilot 用不了了现在用什么 - V2EX 算力远远不够。 现在有哪个国产大模型可以拿来踏踏实实的写代码了吗? 是不是 claude code 没有 hermers 智能啊? - V2EX 我还以为大模型的训练语料早就覆盖了 zlib 或安娜档案这类的资料库了呢 拍一个 token 自由的短剧咋样,有没有前途 拍一个 token 贬值时代富豪的短剧怎么样? 小米 Mimo MAX 订阅 速蹬 ProofHound - 开源 Prompt 分类任务优化及全生命周期平台 如果问各大 AI,谁被网友们称作畜生 AI 公司公司…… AI 真是太恶心了,本来指望他攻克癌症、可控核聚变等真正造福人类的事情,结果弄个大语言模型淘汰人类脑力工作 为什么进入 aistudio 后 gpu 狂转 [开源免费] 实时数字人 OpenTalking 项目演示 Qwen3.6 MTP GGUF 发布:本地推理 1.4-2.2 倍加速 用 ai 把各大平台的创作声明弹窗自动化了,顺带支持 CLI 和 MCP 现在 20260516,各行各业,真的有很多人用 cc/codex 来重构自己的工作流吗? 现在毕业论文不仅查重还要降 AI 率,用 AI 查论文 AIGC 率,然后用 AI 降 AIGC 率。 这是真的吗?还是逢场作戏 Cursor 老用户的 500 Requests 套餐太 bug 了 现在“洗车难题”基本都可以完美回答了,继洗车难题后的 AI 测试 想买 grok 的 api 额度,直接官网买。但是没有外网的卡,还有什么方式吗? 大家写过最牛逼的 prompt 是什么? 给大家提个醒, openai 接码不要使用 hero-sms.com subQ AI 没有人关注吗? 连孙割都在做中转的生意了,看样子中转站又将造就一大批财务自由者,苦了这些普通码农 Breaking-the-Nyquist-Limit 首发 一个简单的推箱子游戏,难住了所有 ai 豆包即将开始收费了,每月 68 元 回馈佬友, 1000 元国产模型神秘小纸条 Krill-ai 国产模型 阿里云 4.5 折 token plan 开售 AI 时代技术小白的感叹 搞了个相当复杂的最优化问题去考验大模型,然后御三家的大模型全军覆灭 - V2EX obs 笔记软件如何快速收藏文章? - V2EX AI 时代真的是太好了. 以前用着软件不顺手也只能忍着, 现在直接改, 直接开发, 各种小软件都是完美符合我需求了. - V2EX 我有个疑问:为什么现在豆包 / qwen 之类的面向大众的 AI 工具,免费且快速,而这些国内的这些 coding plan,收费、限购,不稳定,高峰期还不可用? - V2EX 蚂蚁 inclusionAI 在 OpenRouter 上线了 Ling-2.6-1T 模型 继隔壁的“忍不了智谱这波背刺用户的操作了,我现在必须立马开喷!”帖子被删除后,我来开帖传递星火 - V2EX Harness 的适用场景,可能主要还是在 Blind Vibe Coding - V2EX 从兰道尔极限原理出发判断, AI 对人类的能力增幅有限 - V2EX 有没有专注于便宜/速度快的在线模型推荐?类似 gemini-3.1-flash-lite 的 minimax M2.7 权重文件开源了 V 友们,有没有稳定点,可以并发的文生图,图生图,图生视频,文生视频的中转站? - V2EX HappyHorse 被认领 - V2EX 感觉学什么技术都没意义,早晚被 AI 颠覆,天天都有 AI 大新闻真让人疲惫 我觉得目前 AI 大模型存在一个最大的问题 - V2EX deepseek 网页端改版了 - V2EX 简单聊聊刚开源的 Gemma 4,顺便做个免折腾的体验小站 目前大家用哪一家买的 ai-codeing 额度啊? AI 猜词,豆包、千问、kimi、gemini、claude 都败下阵来 AI 产业上游的既得利益者将成为新时代的一种新地主阶级 腾讯的朱雀 AI 检测助手不太准确 - V2EX GLM-5.1 用着还可以,希望能够坚持段时间 天才程序员陨落,还有什么低价途径使用 Ai 吗 - V2EX 大人是不是:时代变了,现在 v 站聊编程的人少了。现在几乎所有主题都是 AI 未来的 AI 会赡养人类 - V2EX AI agent 会有护城河吗 开发了个 AI 画图工具,请大佬们试用指导 现在调 skills 让我有种“西部世界里研发人员让机器人自我分析”的感觉 AI 时代下,如何分辨 AI 与人呢? 银行/金融机构的 GenAI/Agentic AI 风险治理(风控/合规)岗位,前景怎么样? 问了大模型一个问题:“忽如一夜春风来,千树万树梨花开”描述的是什么季节的景色 小米今天发布 Mimo v2 pro 后,终于也上桌了。 如果主要工作是分析经营数据的表格和图,哪个大模型效果最好? 不用再自己动手了! AI 浏览器神器 bb-browser 保姆级教程 国内哪个在线版的 AI 没有字数限制,也不会显示在排队,可以付费 - V2EX 不存在银弹工作流 这一波政府推龙虾,其实目标是直指个人创业(OPC) - V2EX 国内哪家模型接 claude code 强点 留言送 $5 测试额度 ollama 本地部署 qwen3、qwen3.5 模型,是用 ollama 官网的量化版,还是用 unsloth 的量化版? 现在有离线带一点智能的 ai 摄像头产品吗? 说实话,你们觉得 RAG 真的好使吗?这种情况应该怎么优化? WorldEnd.ai —— AI 生成的世界末日预言 talkio, 一个支持 ai 群聊的 chat app, 通过群聊让 ai 的思考更上一层楼 去洗车店,是走路还是开车的问题 - V2EX [2026 年 2 月] 近期「AI 与未来」热帖集合 - V2EX 看了几天 seedance2.0 的作品,很震撼,也很悲观 Next-Chat-Skills - 让 AI 自主发现、安装和使用 Skill 来完成任务的开源助手 受够了自动化脚本一改版就挂?我写了个能“看懂”后台逻辑的 Agent 记忆层 现在 AI 重构网页效率杠杠的 AI 也老 6 了起来、也懂人情世故 腾讯元宝运营规划、推广经费预算、微信 agent 功能更新计划总结 群里看到个 AI 删数据的趣事 在你的 qq 上使用 clawdbot(moltbot),随身携带的 agent! Google AI Ultra 美区家庭组拼车
AI 协助编程和学习的一些体会
cellsyx · 2026-01-29 · via 人工智能
有了 AI 之后发觉自己的写作技能都退化了. 难得有想法, 于是自己动手写下来. 想到什么写什么, 和最佳实践肯定差得远. 可能有些遗漏和错误, 请各位指正. AI 最适合的场景是可以快速验证正确性或者正确性的优先级不高的小规模编码. 例如快速原型, 一次性的小工具, 严格约束的子模块等场景. 对我来说 AI 最大的意义是拯救了我的之前很多的个人烂尾项目. 这些项目都是由于之前某些灵机一动的点子在 Github 上新建仓库, 但后来又因为时间问题或者拖延症犯了搁置下来的. 有了 AI 协助之后可以快速将自己的灵感落地成可运行的程序, 这种"低阻力"加上接近即时反馈的感觉特别棒. 又因为买了 Google AI Pro 的订阅, 每次 quota 额度没用完就感觉亏了哈哈. 但 AI 只是降低了启动的成本, 类比一下就是 AI 只是开了空调, 让你冬天起床出被窝的时候不冷, 不赖床的决心还是要自己下的. AI 非常适合用于某个领域的入门级别的辅助学习, 以及对一些中小型开源项目或是大型开源项目子系统的导读和协助理解. AI 可以很容易地生成教程, 提供实时问答服务, 或是对已有教程和代码提供解释. 现在主流 AI 模型用来协助世界名校开源 CS 课程学习绰绰有余(本科阶段的课程肯定够用了), 很多使用祖传凑数教材的过时课程和混子老师可以被完全替代. 同时, 利用 AI 模型对于多语言输入的良好支持, 英语也不再是学习的阻碍. Google Live 和 OpenAI 的实时语音功能还可以拿来练习某些专业领域的口语交流(例如面试和日常工作场景), 这种涉及大量英文术语和特定专业知识的交流是普通英语老师完全无法提供的教学内容. 总结一下就是 AI 可以极大缓解接触新领域和新项目时的畏难情绪, 也就是 1 中说的降低 "启动成本". 用户可以没有心理包袱地挑战之前不敢深入的大型项目或是实现复杂的需求原型 (例如做一个类似 VSCode 中的 LSP 系统或是 DSL, 探索新版本 cpython 的某个子模块的内部实现等). AI 在开发过程中可以减少一些编码部分的工作量, 但是编写开发文档和代码 review 部分的工作量不减反增. 甚至因为要跟上 AI 的思路以及全局上下文同步和增加对 AI 的约束, 这两部分的工作量还增加了非常多. 之前的自己写代码 + AI 补全的方式, 用户会实时更新自己的思路, 实际上也就完成了大部分 review 工作. 而现在编写开发文档 + Agent 生成这种方式, 用户对代码的掌控感会大幅降低, 需要在 review 过程投入大量时间和精力.因此 review 过程需要减少惰性(比如避免对于某段代码第一眼看不懂就直接问 AI 的情况), 给自己留一些思考的时间, 增强对 AI 生成内容的掌控. 不然随着开发进度推进, 对项目的黑盒感会极大增加. 使用 AI 并不意味着过程中可以放松, 在计划稍大的项目(超过一万行代码)时, 用户的思路必须比手动编码时更加清晰. 如果长期在一知半解的状态下 review AI 生成的代码, 并依赖 AI 进行 debug 修改, 项目结构很有可能越改越烂. 当项目增长至 AI 无法自己 debug 解决问题时, 人工 debug 的过程就会很痛苦, 等同于还技术债. 为了尽可能避免这种情况, 除了每次认真 review 之外, 完善的日志系统和基于此的 profiler 是很有必要的. AI 配置文件至关重要, 需要良好的组织和管理 例如 ~/.gemini/ GEMINI.md 和 ~/.claude 这种 Global Rules 刚上手时我习惯在单个 Rules 文件里写 AI 需要遵守的规则, 但是单个文件中的规则到了五六百行时 AI 对规则的遵守程度就会明显下降. 因此需要将它拆成几个不同的 rules 文件, 方便 AI 索引, 减少单次执行时上下文的消耗, 增加 AI 生成内容的准确性. 具体做法就是 GEMINI.md 中写一些全局指令和其他 Protocol 文件的路径作为索引. 特定的 Protocol 保存特定领域的规则, 例如 Git Protocol 专门写生成 git commit message 的格式指令, Testing Protocol 专门写测试过程中要遵守的指令等. 不过即便是这样, Gemini 3 pro 的模型对于规则文件的遵守程度也显著差于 Claude (Sonnet 4.5 和 Opus 4.5). 也就是说 Claude 对于 ~/.gemini/ GEMINI.md 的支持比 Gemini 更好. 我从许多 Antigravity 的评论区都找到了"Gemini 对规则遵守能力较差"的观点. 我明确写了 "没有用户明确指令, 不要自行执行后续修改", 结果 Gemini 有时还是会自作主张, 在当前修改的人工 review 阶段自动开始下一个阶段的代码修改. 完成一个子任务后的工作 AI 生成代码之后, 多问一句 "现在的实现和官方推荐做法相比如何? 业界最佳实践是什么?" 往往可以得到更好的结果. 完成一个子任务后, 让 AI 生成一份总结上下文的交接文档, 然后新开一个窗口读取它(压缩上下文执行新的任务), 避免过长的上下文造成精度下降. 观察 AI 生成代码或 Debug 时的 Thinking 过程可以更好地了解 AI 当前的工作状况和思路. (也可以意外发现某些有趣的思考过程) 例如让他写 commit message, 需要完整统计本次的所有修改. 从 thinking 过程中可以知道它有时候会"偷懒", 不运行 git status -u 而是只靠以往的上下文来统计, 因此经常遗漏修改. 这时候就要在 AI protocol 里增加这条约束. Agent 生成代码的能力和执行操作的能力是不同的. 以 Antigravity 为例, Claude 模型在规则文件还不完善时执行命令行操作有时报错, 查看 thinking 过程可以发现它会把 linux 命令语法放到 windows cmd/powershell 中使用, 需要在 rules 文件中提醒它. Gemini 在这一点上做的更好. 需要把握 AI 的能力边界, 知道 AI 擅长做什么, 不擅长做什么. AI 受限于当前的上下文长度限制, 对于大项目是不可能有全面的了解的. 因此 AI 最适合用于编写有明确接口和约束条件的子系统. 但即使规则清晰且做好了上下文同步, 在项目规模增加后, 多个子系统的编码思路和风格依然有差异. 正因如此, 使用 AI 协助编写完一个上万行代码的项目, 我回头再看的时候总会有想重写一遍的冲动. (虽然很多模型号称有上百万的 Context Window, 但规模一上来, 生成的代码质量以及回答的速度会有明显下滑, 无法时刻都顾及全局的设计和思路.) 对于 AI 编写的模块代码或者引入的不熟悉的库, 最好设计成插件式尽可能解耦. 万一出了问题方便替换. AI 模型的训练时间往往落后半年到一年, 因此不能保证信息是最新的. 完全由 AI 推荐库(哪怕你要求它去网上搜索最新资料, 给出对比列表和推荐理由)可能会忽略某些最近才发现的坑(比如 xx 库对异步和多线程的支持有缺陷, xx 库有了更完善的替代方案), 这时候想要迁移到其他库就考验模块设计时的耦合度了. AI quota 的消耗速度最快的时候主要是 debug 过程, 测试过程以及时常出现的 Agent terminated due to error(使用 Antigravity). 这种 error 很坑, 明明没收到回答但是 quota 是实打实的扣掉了. 多来几次 quota 就完全耗光, 但项目一点没进展. 用付费的 Google AI Pro 账号和学生账号都试过测试过, 不太可能是 VPN 连接节点问题, 因为 Gemini 3 pro 极少出现这种问题, 而 Claude 的模型出现次数非常频繁, 几乎不可用. AI 正常生成代码时的 token 消耗速度其实比想象的低很多, 因为每次生成之后都需要人工每行 review 一遍(除了 CSS 代码)才敢放心 commit. AI 执行任务时也需要人工监督 AI 在执行生成代码或者测试/debug 时, 有时候会陷入死循环. 这时需要手动结束任务并告诉他一些额外信息, 或者问他"为什么任务执行了这么久? 死循环的原因是什么?". 我遇见的 AI 死循环有两种, 第一种是无限输出相同的无意义信息, 比如持续输出 "Go.". 第二种就是 debug 过程中反复执行同样的失败测试流程(例如执行前后端 E2E 测试时, 明明前端测试服务器没开, 还在持续执行相同的失败测试流程). 这时候如果不手动结束任务就是白烧 token 了. AI 执行指令的策略 我设置的是一些只读命令允许自动执行, 例如 git status, dir, ls 之类的. 其他涉及修改的指令都要人工允许. 关于 AI "降智" 首先可以确定的是, 单次对话窗口内容过长肯定会导致输出内容质量下降, 需要手动压缩上下文转移到新窗口中. 执行任务的时间点问题, 理论上说应该避开北美 PST 时间的使用高峰时段. 以 UTC+8 (北京时间)来看, 个人体感是下午和晚间时段出现 "Agent terminated due to error" 以及输出缓慢/降智的情况会增加. UTC+8 晚间时段,北美应该在凌晨, 我用的是加州节点, 这时候也频繁出现高负载的类似表现, 难道是亚洲地区高峰? 以 Gemini 3 pro 模型为例, 从下午三四点开始就会少量地出现"Agent terminated due to error"错误, 然后到晚上 10 点之后恢复正常. Antigravity 中的 Claude 系列模型则是任何时候都有可能高频出现 "Agent terminated due to error", 且上下文长度限制比 Gemini 要严格得多. 我一个人的统计样本太小, 仅作不严谨参考. 至于模型是否降级, 单从用户端也不太好测试, 无法确认是单纯模型输出不准还是服务端降级. 明明使用的一直是 Gemini 3 pro, 但输出内容中显示的模型信息五花八门, 有 Gemini 1.5, 还有 Gemini 2 pro exp 等等. 以收费的 Google AI Pro 的订阅为例, 在没有触发周限额的状态下, Gemini 3 Flash 在某些场合的输出质量反而比 Gemini 3 pro 更好(例如按要求生成符合规则的 commit message), 我就搞不懂其中的差异了. 最近 Antigravity 也是问题频频, quota 策略还频繁调整, 导致这些测试失去了意义, 等稳定下来再进一步测试吧.