惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

U
Unit 42
A
About on SuperTechFans
J
Java Code Geeks
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Stack Overflow Blog
Stack Overflow Blog
Recent Announcements
Recent Announcements
GbyAI
GbyAI
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
MongoDB | Blog
MongoDB | Blog
MyScale Blog
MyScale Blog
aimingoo的专栏
aimingoo的专栏
H
Help Net Security
月光博客
月光博客
博客园 - Franky
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Apple Machine Learning Research
Apple Machine Learning Research
The Cloudflare Blog
WordPress大学
WordPress大学
S
SegmentFault 最新的问题
T
Tailwind CSS Blog
Jina AI
Jina AI
有赞技术团队
有赞技术团队
博客园_首页

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
同一种问题换两种问法会得到不同回复, 不同 AI 结果不同, 使...
paopjian · 2025-12-20 · via V2EX

遇到了一个分布式 topk 问题, 用 qwen3 的时候发现的, 快速回答全错就几个 AI 都试了试.
问题一: 现在有上百亿的数据需要取前百万 topk 数据, 由于数据量过大无法直接加入内存, 采用分布式处理, 每个进程取部分数据后不断维护 topk, 最后将各个进程的结果合并维护 topk, 这样可以得到全局 topk 结果吗?
问题二: 有一个算法是求两两相似度, 我有大量的图片, 获取了一个巨量的负样本, 但是因为太大无法保存, 所以我只取 topk 个, 同时因为生成相似对使用了并行计算, 每个进程的百万结果先求一次 topk, 最后再合并结果的时候所有结果求 topk, 这个方案能保证 topk 是全局的 topk 吗?
两个问题方案都是正确的, 因为不让放结果我就精简了
qwen3 开深度思考就对了, 但是很费时
qwen max: 1: 无法保证 2:不能保证。
qwen max 深度思考: 1:正确, 2:"当两个前提均满足时,方案可保证全局 Top-k"
GLM 4.6 很神奇, 开关各个功能结果不同
GLM 4.6 关搜索: 1:是的 2:不能。
GLM 4.6 开搜索: 1:不能 2:不能保证。
GLM 4.6 深度思考: 1:不可以 2:能够保证
claude4.5 Opus4.5 Gemini3pro 都正确回答, GPT5.2 错了
github copilot chat GPT5.2: 1:可以 2:不能保证
github copilot chat claude Sonnet4.5: 1:可行的 2:不能保证, 但是解释原因后的结论: "实际上我重新思考后,这个方案是可以保证全局 top-k 的!"
github copilot chat claude Opus4.5: 1:完全可以 2:你的方案完全正确
github copilot chat Gemini 3 pro: 1: 可以 2:是的
问题二好几个 AI 都是不能, 感觉是触发哪里的隐含思维了默认分布式会丢失局部最优导致的