惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
K
Kaspersky official blog
Forbes - Security
Forbes - Security
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
P
Proofpoint News Feed
G
GRAHAM CLULEY
V
Vulnerabilities – Threatpost
Security Latest
Security Latest
Scott Helme
Scott Helme
S
Securelist
美团技术团队
T
Threat Research - Cisco Blogs
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
SegmentFault 最新的问题
W
WeLiveSecurity
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Apple Machine Learning Research
Apple Machine Learning Research
The Cloudflare Blog
AI
AI
L
Lohrmann on Cybersecurity
S
Security Affairs
Cloudbric
Cloudbric
SecWiki News
SecWiki News
爱范儿
爱范儿
雷峰网
雷峰网
Engineering at Meta
Engineering at Meta
C
Cyber Attacks, Cyber Crime and Cyber Security
大猫的无限游戏
大猫的无限游戏
N
News and Events Feed by Topic
I
InfoQ
S
Secure Thoughts
AWS News Blog
AWS News Blog
A
About on SuperTechFans
Schneier on Security
Schneier on Security
酷 壳 – CoolShell
酷 壳 – CoolShell
The Last Watchdog
The Last Watchdog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
Check Point Blog
P
Palo Alto Networks Blog
博客园 - 【当耐特】
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Google DeepMind News
Google DeepMind News
Latest news
Latest news
I
Intezer
博客园_首页
C
CXSECURITY Database RSS Feed - CXSecurity.com
V
V2EX
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
L
LangChain Blog
D
Docker

News Hacker | 极客洞察

Rockstar GTA 6 团队组工会:薪酬透明、灵活工时、反 crunch 古罗马公寓:日常、城市规划与沉浸式体验 AI时代的专家价值:验证、经验与大学角色 Chad Whitacre 退 tech 转离线:Home Depot、印刷杂志、东正教社区 本地 Git remote:共享、隔离与 GitHub 误解 AI只该做琐事,别替代人情与创作 AISlop:检测 AI 生成代码坏味道的多语言 CLI 英国低价值采购系统:每月零申报的官僚负担 郁金香狂热:泡沫神话与理性争议 用 LLM 写代码,也要让人比模型更累 AI会重演前端“失去的十年”吗? AI 编程提产却压缩思考,工程质量与协作承压 Cloudflare 多 agent AI 代码评审引发成本与流程争议 500K AI电影“戛纳首映”被质疑只是公关噱头 8×H200跑2B模型到3k tok/s,“标准GPU”标题引争议 防水夹克演化:材料回潮、帽兜变迁与AI争议 意大利人与荷兰人教学时共享手势本能 Claude Code 隐藏配置考古:文档滞后、版本易碎与自动执行争议 大众汽车用 client assertion 阻断 Home Assistant 接入 Zot 支持 Claude Opus 4.8,评论聚焦 Claude Code 计费与 harness 神秘 Hy3 LLM 在 OpenRouter 霸榜:便宜、刷量与隐私争议 佛州 Blue Origin New Glenn 静态点火爆炸,堪比 N1 联网汽车监控升级:数据售卖、监管失灵与断网自保 Blue Origin New Glenn静态点火爆炸,发射台损毁恐延一年 住宅建造为何难规模化:地段、法规、偏好与收入 十种基础云:观云分类、光学现象与云计算误会 据称被 Shopify 收购后,Garnix 关停并开源 Bot Company疑借Airbnb私测家务机器人,致房屋受损 Coalton:Common Lisp 上的静态类型 Lisp,讨论集中在上手与类型建模 ktx:面向 data agents 的开源可执行上下文层,自动生成语义层与业务 wiki 宿舍起家的 nice!nano 蓝牙键盘模块卖到百万美元 可拆电源线:便利与安全、标准化之争 Bitburner:写脚本的增量游戏,像 Factorio,3.0 改 API 加 Darknet Justine 募捐争议:旧言论、事实失实与生活方式质疑 程序员逐帧考据《Tron: Legacy》终端镜头 LLM 写作、代码与设计的各种“味道” Bricks & Minifigs 被指扣留 20 万美元 LEGO 寄售收藏 日本 randoseru 书包:颜值惊艳,AI文风惹议 写作的“科学”只是反复写改和反馈 Zig Days:LLM 话题要不要软禁 Postgres 做 durable workflows:DBOS、Temporal 与自研队列之争 Google 搜索 AI化:用户、网站和 SEO 被边缘化 Anthropic 65 亿 Series H 融资,9650 亿估值与 run-rate 争议 波士顿—百慕大:低价机票改写度假版图 Raspberry Pi 6 争议:提速、降功耗与 MCU/USB-C 路线 Claude Code 动态工作流:Bun 重写、并行编排与 token 争议 GPT-4o 上更粗鲁的 prompt 略准,样本与语气定义遭质疑 《Permanent Upper Crow》:礼帽消费与债务循环的黑色讽刺游戏 美国量子投资或涉违法:法律、内线交易与科技泡沫之争 Claude Opus 4.8:小幅修正、4.7回退与Mythos悬念 20年聊天记录分析:社交圈收缩、旧友怀旧与隐私争议 纽约通过 pied-a-terre 税:二套房、低估值与避税争议 Zendesk 涨价4倍逼客户48小时重建,评论聚焦PE、AI自建与SaaS护城河 AI agent 权限疲劳小游戏:沙箱、YOLO 与安全提示之争 FPGA上的神经形态 Ising 机:被质疑是 buzzword 拼盘 Google AI Mode逼人迁移,DuckDuckGo涨28%但基数极小 OpenWRT 室内 Wi‑Fi 漫游:802.11r/k/v、uSteer 与兼容性坑 Meshtastic、MeshCore、Reticulum:离网 mesh 的价值与极限 五个 frontier LLM 对 1k 真实 fact-check claim 67% 分歧,No Abstain 争议大 Apple/Google 把 push 通知变成营销与控制战场 YouTube自动标记AI视频:误判、AI slop与过滤争议 EU罚Temu 2亿欧元:非法商品、安全与平台责任争议 Ruby/Java/TypeScript 做 DOCX 插件:MCPB 打包、GraalVM 原生编译与 Ruby 争议 UC教师称数学严重退化,要求STEM招生恢复SAT/ACT Gemini、Gopher、Finger:HTTPS之外的轻量网与反adtech讨论 AMD 收紧 Linux 版 Vivado 许可引发 FPGA 用户反弹 Claude Code显现PMF,但盈利与开源竞争仍存疑 Temu 因危险商品与合规失责被欧盟罚 2 亿欧元 Hallucinate:开源浏览器多人在线Rave 压力破坏海马体记忆整合与推理,教育体系却爱加压 SimCity 3000 4K版:经典等距城建与现代写实之争 企业 AI 账单爆表:tokenmaxxing 与高层乱推 CIA官员家藏4000万美元金条,FBI介入疑涉黑金 Rapira:苏联俄化 Pascal 解释器 Ferrari Luce EV遭讽成iPad车:设计和品牌双翻车 AI提效后:休假、加薪还是裁员? GPU-free AI 数据中心:HPC 旧瓶装新酒? 越狱 Kindle 跑 Rust/Slint,顺带聊 jailbreak 与 Kobo 替代 Go 将支持泛型方法,社区再吵“早该有还是补洞” Lua 的“绿色”能耗优化与 JIT 争议 Qwen3.7-Max 35小时优化未知硬件kernel获10×提速,引发真实性与基准质疑 Typst+Pandoc 模板:Markdown 直出 PDF 工作流 2MB“人类烹饪”被质疑:样本不全,更像食材搭配库 WSL 中 Claude Code 贴图失效:Windows Terminal 抢占 Ctrl+V,桥接可修复 Rands《The Ask》:中层管理、会议官僚与AI争论 Last.fm 独立回归:老用户怀旧、推荐争议与数据主权 依赖别乱更:锁版本、供应链与 CI 争议 Fano 平面式 Raft:少数节点也能达成共识 GitHub PR/API 再故障,评论区质疑 AI、Azure 与微软 Mini Micro虚拟复古电脑:硬件版与开源争议 Claude Code 日用:CLAUDE.md、Skills、subagents、MCP 命令碎片化与锁定争议 加拿大转向瑞典军机,摆脱美国军购依赖 伊朗互联网流量回升:停火信号、经济恢复与网络战争争议 旧 Intel MacBook 过热取暖,M 系列靠编译/LLM 才热 Joanna Rutkowska:自由潜水、具身性与 Claude 隐喻 特拉华 Fenwick Island 允许公司房主投票,空壳漏洞引争议 Steam Deck涨价逾200美元,AI抢RAM与通胀争议升温 Labubu与hyperreal:怪萌、稀缺炒作和中国潮玩出海 GPU 矩阵乘法会因数据可预测而提速 Tech CEO陷AI妄想:LLM迎合放大高层失真
Liquid AI 8B-A1B MoE 训于 38T:许可、性能与工具调用争议
2026-05-30 · via News Hacker | 极客洞察

🎯 讨论背景

Liquid AI 发布的 LFM2.5-8B-A1B 是一个 MoE(Mixture of Experts,专家混合)模型,总参数 8B、每次只激活约 1B,并宣称在 38T tokens 上训练。它以 open-weight 形式提供,但评论立刻指出许可并不等于开源,商业组织可能会被收入门槛限制。讨论还在问它究竟该被当作通用聊天模型、代码模型,还是更像 agentic core(把任务交给工具和外部系统的核心)。很多人把它放进本地推理生态来比较,例如 llama.cpp(常见本地推理引擎)和 Ollama(基于 llama.cpp 的本地运行工具),因为量化和硬件速度直接决定它是否适合桌面端使用。评论里提到的 car wash 常识题,则是拿来检验模型是否真的理解现实前提,还是只会拼接语言模式的例子。

📌 讨论焦点

许可争议

博客把它包装成 open-weight,并声称可以下载、微调和部署不受限制,但有人指出 Hugging Face 许可里对年收入超过 1000 万美元的组织有明显限制。争议点不只是条款细节,而是营销话术与实际商业可用性不一致。对想把模型放进产品或内部平台的公司来说,这会直接影响能不能用、怎么用。

[来源1]

性能分化

实测反馈很分裂:有人在 bug fixing 基准上看到它远逊于 Qwen2.5-Coder-3B,也有人觉得它在长文本摘要上很强、速度很快。旧版 Liquid 模型在世界知识测试里也被说表现一般,甚至不如 Gemma 31B 或 Qwen 35B-A3B。另一层质疑是基准图表可能只展示赢的部分,因此 8B + MoE 的宣传看起来比实际能力更亮眼。

[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13]

agentic 取向

不少人把它理解成更像 agentic core,而不是单纯聊天模型:负责低延迟交互、编排工具、再把复杂任务交给别的系统。这个思路下,离线、本地、异步调用云端更大的模型,才是它真正的价值。可是一试 OpenCode,很多人发现 tool calling 几乎不可用,于是怀疑通用 harness 与模型偏好不匹配。也有人把它拿来做邮件 triage、浏览器任务和其他个人工作流,觉得只要 harness 合适,小模型就有现实价值。

[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9]

本地运行与量化

讨论里大量在比本地部署体验:有人关心它能否在 CPU 上跑,也有人拿 Strix Halo、M5 Max、R9700 这些设备报 token/s。量化层面,Q4/Q6/Q8 的差异被反复提起,普遍观点是 Q8 更接近 FP16/BF16,而更低位宽尤其是 KV-cache 量化会明显伤害技术任务。与此同时,llama.cpp 和 Ollama 的支持、更新速度,以及 MoE 带来的稀疏激活,都被看作它能否成为日常本地模型的关键。

[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13] [来源14] [来源15] [来源16] [来源17]

规模与过拟合

38T tokens 这个数字让不少人怀疑 8B 模型是否已经接近知识压缩的物理边界。有人担心继续堆 token 只会带来 overfitting 和基准过拟合,而不是更好的泛化。也有人拿 Chinchilla scaling 的直觉去算 8B 总参对 1B active 的 token 比例,觉得这个训练强度大得有点夸张。另一派则主张把知识放到工具和上下文窗口里,而不是全塞进权重。

[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8]

常识题争论

car wash 这组老梗成了讨论 LLM 常识的缩影。支持者认为题目本身就故意含糊:如果你已经在车洗店、是维修人员,或只是去店里办别的事,走过去完全说得通,甚至人类平均也不算稳定。批评者则用它证明模型只会拼语言关联,不会补全现实世界的隐含前提;而反驳者反过来说,真正的问题是人类自己平时就靠大量 tacit assumptions 在做判断。这也是为什么有人质疑,若模型连这种题都处理不好,又怎么放心让它进工作流或写代码。

[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13] [来源14] [来源15] [来源16] [来源17] [来源18] [来源19] [来源20] [来源21] [来源22] [来源23] [来源24] [来源25]

📚 术语解释

MoE(Mixture of Experts): 专家混合架构,推理时只激活部分专家,以降低计算量并保留较大总参数规模。

quantization(量化): 把模型权重或缓存压到更低 bit,换取更小内存和更快推理,但可能损失精度。

KV-cache: 推理时保存注意力键值的缓存,长上下文下对速度和质量影响很大。

tool calling: 让模型调用搜索、代码执行、数据库等外部工具来完成任务。

llama.cpp: 常见的本地 LLM 推理引擎,支持 GGUF 和多种量化格式。