惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

雷峰网
雷峰网
B
Blog
博客园_首页
云风的 BLOG
云风的 BLOG
S
SegmentFault 最新的问题
罗磊的独立博客
Jina AI
Jina AI
C
Check Point Blog
Martin Fowler
Martin Fowler
J
Java Code Geeks
博客园 - 司徒正美
美团技术团队
MongoDB | Blog
MongoDB | Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
大猫的无限游戏
大猫的无限游戏
有赞技术团队
有赞技术团队
U
Unit 42
Hugging Face - Blog
Hugging Face - Blog
WordPress大学
WordPress大学
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
博客园 - 叶小钗
博客园 - 三生石上(FineUI控件)
小众软件
小众软件

蓝点网

小米开源发布MiMo Code编码工具 基于OpenCode构建 限时免费使用MiMo V2.5模型 - 蓝点网 华尔街日报称OpenAI考虑大幅度降低Token价格与A社打价格战 抢夺企业客户 - 蓝点网 ChatGPT更新对话模型选择器 让用户根据任务选择难度更快还是更努力的模型 - 蓝点网 真是个小机灵鬼!有黑客在恶意代码顶部增加核武器设计提示词 用来对抗AI分析 - 蓝点网 [RegionSpoof] 这个开源项目可在国行设备macOS 27预览版中启用完整苹果AI - 蓝点网 鉴于数据要被A社保留 微软已经限制员工使用Claude Fable 5模型 - 蓝点网 iOS 27 WiFi新增类型说明 用于帮助用户识别WiFi 5/6/7等不同的协议 - 蓝点网 咦?苹果在watchOS 27里删除对讲机应用 可能是很少有用户使用这个功能? - 蓝点网 [解决方案] 微软承认Windows 11 24H2/25H2累积更新存在安装失败问题 - 蓝点网 应对供应链蠕虫攻击 GitHub宣布NPM v12将不再自动执行依赖项安装脚本 - 蓝点网 因礼品卡诈骗日益严重 Steam实体礼品卡将在2026年底售罄后不再发行 - 蓝点网 免费证书颁发机构Let’s Encrypt宣布迈向后量子时代 将采用MTC后量子认证方案 - 蓝点网 美满电子将为谷歌TPU单元定制开发高效网络芯片并使用英特尔18A制程生产 - 蓝点网 抵制基于网络的垃圾应用!微软鼓励开发者基于WinUI为Windows 11开发原生应用 - 蓝点网 微软将改进Windows 11右键菜单 有可能会让用户自定义并隐藏不常用选项 - 蓝点网 知识库应用Notion通过股权交易买下Notion.com域名 后续将不再使用.so域名 - 蓝点网 全球规模最大的加密货币交易所币安宣布停止支持NFT 不再提供任何交易 - 蓝点网 谷歌发布并开源Gemma 4 12B版多模态模型 可在16GB内存/显存上运行 - 蓝点网 现代版掩耳盗铃:Instagram AI漏洞并未被修复 只是从前端隐藏界面且被黑客继续利用 - 蓝点网 谷歌宣布网站/发布商可以主动退出谷歌搜索AI概览 不允许AI概览调用内容 - 蓝点网 摩根士丹利称搭载英伟达RTX SPARK N1X芯片的PC售价将达到2,900美元 - 蓝点网 真重置!Codex因昨日连续发生的多次故障重置本周额度 继续向后顺延7天 - 蓝点网 豆包将降低基础功能体验推动用户购买专业版?字节发布公告称相关说法不实 - 蓝点网 研究人员不满微软安全团队的做法 公开爆出VS Code漏洞可窃取私有凭证 - 蓝点网 [折扣代码] ChatGPT商业版向8个国家用户提供买1送1优惠 至少开通2个席位 - 蓝点网 Codex大部分账号已经无需绑定或验证手机号 但仍有部分账号还需验证 - 蓝点网 [指南] Codex账号需要绑定手机号码的临时绕过方案 (不是已绑账号跳过验证码) - 蓝点网 Codex已重置本周使用限额 原因似乎与部分模型出现的故障有关 - 蓝点网 群联展示新款PCIe 6.0 16通道X3控制器 速度可达28,000MB/秒 最高可做到单盘2PB - 蓝点网 微软发布Surface RTX SPARK开发工作站 利用英伟达芯片提供本地AI算力 - 蓝点网
稀宇科技推出MiniMax-M3模型 支持1M窗口在编码和智能体任务中...
山外的鸭子哥 · 2026-06-01 · via 蓝点网

# 人工智能 稀宇科技发布 MiniMax-M3 模型,支持 1M 窗口且为原生多模态模型,支持文本 / 图像 / 视频等不同类型的输入。基准测试显示,M3 模型在编码任务上超过 GPT-5.5 和 Gemini 3.1 Pro,接近 Claude Opus 4.7 模型,后续 M3 也将发布开源权重模型。查看详情:https://ourl.co/113197

稀宇科技日前推出新款旗舰级开源模型 MiniMax-M3,该模型最高支持 1M 窗口且为原生多模态模型,支持文本 / 图像 / 视频等不同类型的输入,在编程、智能体、多模态理解以及长上下文处理等关键领域,M3 模型均达到国际领先水平,部分评测成绩甚至超过 GPT-5.5 和 Gemini 3.1 Pro 接近 Claude Opus 4.7 模型。

根据计划稀宇科技将在未来 10 天陆续发布 M3 模型的技术更新文档以及准备开源相关事宜,也就是稀宇科技将发布 M3 的开放权重模型给整个社区,当前用户可以通过订阅 MiniMax Token Plan 在智能体和编码工具里提前使用 M3 模型。

稀宇科技推出MiniMax-M3模型 支持1M窗口在编码和智能体任务中表现突出

基于自研的 MSA 注意力架构:

对智能体而言如何处理越来越长的内容始终是难度非常大的技术挑战,传统全注意力机制其计算复杂度会随着上下文长度增长而呈现平方级上升,当上下文达到百万级别的长度时,计算和显存开销都会急剧增加。为此稀宇科技在 M3 模型中带来自研的全新稀疏注意力架构 MSA。

MSA 架构属于兼顾效率、精度与工程落地性的全新注意力机制,通过更精准的 KV 分块策略和全新的访存优化方式,在保持模型能力的同时大幅度降低计算成本,例如在百万内容长度的场景下,每个 Token 计算量仅为前代模型的 1/20,这可以显著降低整体计算成本,但 MSA 架构的整体能力与全注意力模型基本持平。

编码与智能体能力表现突出:

根据稀宇科技公布的模型基准测试结果,M3 模型在编程与智能体任务等领域的表现非常出色:SWE-Bench Pro 59.0%、Terminal Bench 2.1 66.0%、SWE-fficiency 34.8%、KernelBench Hard 28.8%、MCP Atlas 74.2%。

其中最受关注的就是 SWE-Bench Pro 基准测试,根据基准测试结果,M3 模型的表现已经超过 OpenAI GPT-5.5、Google Gemini 3.1 Pro 并接近 Anthropic Claude Opus 4.7 模型,在 SVG-Bench 图形生成测试中,M3 模型的表现甚至超过 Claude Opus 4.7。

传统测试仍存在局限性:

稀宇科技认为当前行业对于编码能力的测试仍然存在明显的局限性,大量基准测试仍然基于单轮任务构建,而真实开发过程往往是持续数小时甚至是持续数天的协作过程,因此稀宇科技构建新的交互式用户模拟器训练框架,让模型在训练过程中持续面对需求补充、方案讨论、反馈修正、连续任务切换、长周期项目迭代等。

稀宇科技认为未来智能体编码竞争的核心不再只是代码生成能力,而是长期的协作能力、规划能力、自主迭代能力、人机协同效率等。

活动推荐:腾讯云618活动上线:99元/年版境外CN2服务器补货 另有3年超低价服务器