惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recorded Future
Recorded Future
Security Archives - TechRepublic
Security Archives - TechRepublic
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Jina AI
Jina AI
I
InfoQ
D
DataBreaches.Net
人人都是产品经理
人人都是产品经理
腾讯CDC
GbyAI
GbyAI
V
Visual Studio Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Microsoft Azure Blog
Microsoft Azure Blog
F
Fortinet All Blogs
博客园 - 聂微东
美团技术团队
The Register - Security
The Register - Security
Engineering at Meta
Engineering at Meta
Apple Machine Learning Research
Apple Machine Learning Research
雷峰网
雷峰网
S
Schneier on Security
量子位
A
About on SuperTechFans
H
Help Net Security
MongoDB | Blog
MongoDB | Blog
S
SegmentFault 最新的问题
Know Your Adversary
Know Your Adversary
Cisco Talos Blog
Cisco Talos Blog
Vercel News
Vercel News
Simon Willison's Weblog
Simon Willison's Weblog
PCI Perspectives
PCI Perspectives
B
Blog
K
Kaspersky official blog
V
Vulnerabilities – Threatpost
aimingoo的专栏
aimingoo的专栏
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
U
Unit 42
G
Google Developers Blog
L
LINUX DO - 最新话题
Forbes - Security
Forbes - Security
AWS News Blog
AWS News Blog
P
Palo Alto Networks Blog
Security Latest
Security Latest
爱范儿
爱范儿
Attack and Defense Labs
Attack and Defense Labs
IT之家
IT之家
L
LINUX DO - 热门话题
D
Docker
P
Proofpoint News Feed
Y
Y Combinator Blog
P
Proofpoint News Feed

分享发现

快连停止了中国大陆地区的业务运营 推荐 2 个好玩的在线游戏站 Claude code 的 Designs 和 Routines 居然是独立额度,我的 Claude Pro 订阅又升值了 - V2EX 偶然看到一篇文章《文化已死:当绝大多数人听的音乐,读的书都来自 10 年前》,给大家推荐一下,非常值得一看 66 个入狱教程 国家超算互联网平台提供 Coding Plan(20 元/100 元两档) supergeo.info 送兑换码 V2EX › 登录 古风提示词 Bright Data 代理和 Browser API 90 天 6 折,优惠码 BESTPROXY60 - V2EX 飞机上 Starlink 测速 zig 写的 100kb 的 wasm 可以 http 读写任意 git 仓库 - V2EX GPT Image 2 韩文 prompt 实测:不是“能看懂”,而是“能还原” 网页端 GPT-5.5 Thinking 体感好快啊,这速度第一反应还以为是降智到 4o-mini 了 新开中转站,有 GPT 包月可以薅,分享给有缘人 google 搜索的 AI 模式(自动右侧弹出)是个谜啊? - V2EX 小红书下场做 app 工厂 做了一个 GEO 工具平台,想听听大家对 AI 搜索优化的看法 XChat 正式上架 App Store 了 大 F 彻底沦为历史了,公司宣布停业。 - V2EX 记一次 QQ 被盗事件记录 codex 5.5 强的离谱 用 Claude 做了视频“关于 ping0.cc 静默上传用户真实 IP” AI 辅助英语学习,无推广,讨论一下 gpt5.5 写完界面,还会进行截图查看效果 DeepSeek4 的数据没清理好啊,估计有得折腾 - V2EX 做了一个自动识别云朵的网站 claude 太抠门了 继上次讨论自媒体问题后,我决定下架流量最大的视频 DeepSeek V4 上线了! deepseekv4 来了 DeepSeek V4 正式发布了! 搞起,试试试试!附官网更新的模型链接 模型之外, Codex 也更新了 Auto-review 功能,不用 Full access 了 DeepSeekV4 来了, 希望可以抗衡御三家 DeepSeek V4 上了,连发布会都省了 DeepSeek V4 终于来了,是牛子是马拉出来溜溜 一个性价比极高的数据冷备份路子 苹果中国官网挂了 Gemini One 免费 4 个月邀请链接,,稳不稳 今日乐子:天星银行(AirStar)改名象象银行(Elebank) 分享两个我刚开源的 Codex 插件: Spec 驱动开发 + 飞书知识库接入 “WildCrad 余额兑换 gpt 会员”, Gemini 警告“疑似诈骗” 支付宝的神券团购怕是自己都没用过吧 《 AI 带来的革命性改变,为何还没发生 》 分享一个用自然语言整理 Chrome 书签的小工具 微信聊天记录时间 BUG - V2EX 我觉得比这个什么问界趴窝更奇葩的是这个豆包 AI,看完雷军得被当场气晕 - V2EX 使用中转站要擦亮眼睛!不说别的,倍率计算 充值好乱。 DeepSeek API 更新新模型了? 图一乐 Prompt|让 GPT-Image-2 根据记忆为你设计一个书房 vibe 了一款记忆训练游戏 3 月工作了 269 个小时,于是奖励了自己一辆唐 L EV 我怀疑最近有人拿 v 站当小红书来使了 - V2EX 简单分享下自己回农村后试图搞短视频/直播电商的经历 - V2EX codex 新模型 大家有更新吗 - V2EX 收集一下对老年人友好的记忆类的小游戏 超顶! GPT-Image 2 图像模型全量上线,很强大 问一下你给 AI 的印象,估计大家估计都是 tony Stark opus 4.7 消耗太快了 说个暴论: gpt plus 比 5x claude code 还耐用啊 今天不小心把 typc-c 线插进电脑 usb-A 母口了,还是不够“防呆” 安徽宿松未婚生子退彩礼案会不会给一些人提供了思路? [填坑] 德国沃达丰 eSIM 手机号充值 & 保号教程 避雷这个中转站,三天两头不行,还不退款 你见过 AI 被“逼疯” 了吗? 手机贴膜之 类纸膜 [虚拟机挂微信也会掉线] 下文 谷歌商店的 Mi Fitness 似乎不能连接国行的小米手环了 招商银行真是奇葩,半夜三更偷偷给你的银行卡签约在线支付 小米+ iPhone 双持体验分享 Aniu——利用 AI 进行全自动操作模拟仓炒股的程序 为什么你该停止使用 Ollama - V2EX 亲测已撸|成功拿下德国 O2 eSIM 卡申请记录分享 [开源分享] transpec,开发框架转换工具 使用 bitwarden 导致 Chrome 浏览器卡顿的问题 Claude Design - V2EX 新发现? qwem3.6 35b a3b 官方模型写刘备文 6 得很 [开源]浏览器里设计 3D 键盘,打开就能玩 今年的 lenny newsletter 年订阅大包 大家觉得值不值? 签到 bug 正好在整十日 喜大普奔, authy 可以收到验证码了 再开一贴,讨论 claude code 的平替 qq 邮箱居然开始有广告了 通过 AI 编程 Token 用量,也能“大概”能看出你靠 AI 的盈利能力 openai 注册不需要手机号了,日本、美国节点测试都可以 中转站三步曲 看看你的中转站到哪一步了 Codex 这个申请权限的交互好有意思 移动下场了。免费送一个月 coding Plan(3w 次调用) Codex 又更新了 我的语言学习,基础打好后,学习就会变得无痛 DESIGN.md 被反诈拦截 第一次在自媒体上赚到钱 用回测筛选因子的一点经验分享 阿里百炼平台上 glm5.1 了 花了两周整理了一份比特浏览器(BitBrowser)中文指南,从下载到指纹防关联全覆盖 v2ex 是 good hacker for spamming program 🤣 我发现支付宝新推出的 AClaw 能够解决账单自动导出的难题! 慢讯, Gemini 推出 Mac 客户端 分享一个自己做的 Nginx 可视化配置工具,实时请求动态预览! [实测生产环境稳定运行半年以上没毛病] claude code 会话团队 hermes 抄袭中国团队 EvoMap 的开源引擎 Evolver
浅试了一下 Qwen3.6-35B-A3B,很强
qdwang · 2026-04-16 · via 分享发现

这是一个创建于 51 天前的主题,其中的信息可能已经有所发展或是发生改变。

感觉比 3.5 强不少,秒 gemma4 。可以说是 24G 内存 mac 或显卡的目前最佳本地模型,稠密的太慢了。

有个很困难的只有 GPT5.4 才能找到的代码 bug ,它当然也是找不出来的。

还是给 openai 充钱吧,开源就只能玩一玩。

  • 模型
  • 本地
  • 付费

    16 条回复    2026-04-20 01:58:21 +08:00

    hanguofu

    1

    hanguofu      4 月 16 日

    谢谢分享,楼主你是在什么硬件上跑的啊?给个参考呗 ~

    C64NRD

    2

    C64NRD      4 月 17 日

    牛,这是刚发布的

    MLawliet

    3

    MLawliet      4 月 17 日 via Android

    24g 内存 mac 跑不了 35b 吧?

    qdwang

    6

    qdwang      4 月 17 日

    @MLawliet 跑的 iq4_xs 量化,运算时刚刚好吃满 23g 内存,不会写 swap ,128k 上下文。

    做了 100k 上下文里乱序随机位置插 26 个关联计算题测试,能做对。

    Hermitist

    7

    Hermitist      4 月 17 日

    我用 omlx 直接下, git clone, hf 下, 都不能完整下来, 不知道什么鸟情况.

    qdwang

    8

    qdwang      4 月 17 日

    @Hermitist mac 不要用 mlx ,mlx 一方面量化模型拉垮,另一方面速度也不快,第三方面内存占用还高,第四方面整个包体积太大。

    gguf 系强太多,少折腾直接上 llama.cpp ,手动下载 gguf 模型

    xing7673

    9

    xing7673      4 月 18 日

    小模型不要太期待有多强的智能,我是觉得可以在 hermes 这种 agent 上让大模型做好 skill ,安排好边界处理后再让小模型去处理,看看这种老师带学生的模式能不能持续比较好。

    Hermitist

    10

    Hermitist      4 月 18 日

    @qdwang 之前跑过 llama.cpp, 没有 omlx 快, 我是 macbookair 32G M5

    qdwang

    11

    qdwang      4 月 18 日

    @Hermitist 快是因为 mlx 量化里,有些关键权重被砍成低量化了,会速度快但是质量差。你测试 gguf 也会发现,同样 4bit 里,iq4_xs 会比 q4_k_m 快很多。

    godymho

    13

    godymho      4 月 18 日

    我的 24G mac iq4_xs 跑不起来。降到了 2bit 试了一下,30token 左右

    wsbqdyhm

    14

    wsbqdyhm      4 月 19 日

    m1max64 跑。直接起飞,最好的开源能跑的模型,没有之一,吊打 gemma4.脚踢 qwen3.5 ,个人用下来有 minimax2.7 ,5-6 成能力了。搭配 openclaw 和 hermes