惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

MongoDB | Blog
MongoDB | Blog
B
Blog RSS Feed
MyScale Blog
MyScale Blog
M
MIT News - Artificial intelligence
H
Hackread – Cybersecurity News, Data Breaches, AI and More
J
Java Code Geeks
U
Unit 42
Blog — PlanetScale
Blog — PlanetScale
L
LangChain Blog
C
Check Point Blog
WordPress大学
WordPress大学
Last Week in AI
Last Week in AI
人人都是产品经理
人人都是产品经理
T
Tailwind CSS Blog
Vercel News
Vercel News
腾讯CDC
GbyAI
GbyAI
有赞技术团队
有赞技术团队
S
SegmentFault 最新的问题
H
Help Net Security
博客园 - 三生石上(FineUI控件)
D
DataBreaches.Net
Microsoft Security Blog
Microsoft Security Blog
小众软件
小众软件

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
Subquadratic发布 SubQ 1.1 Small , 12M超长上下文
Bunn · 2026-06-17 · via LINUX DO - 最新话题

前提:Subquadratic推出全球首个全亚线性大模型SubQ,1200万上下文长度 长久以来,企业级AI面临一个共同难题:难以对完整的庞大资产(如整个代码库、大型文档集或财务报表)进行直接推理。传统模型由于其底层密集注意力机制的计算量随上下文长度呈二次方(O(n^2))增长,导致处理超长文本成本高昂,只能依赖信息检索或分块等权宜之计。为了打破这一计算瓶颈,SubQ 正式发布了采用次二次稀疏注意力(SSA)架构的 SubQ 1.1 Small 模型。 在大海捞针测试中,该模型在 1M、2M、6M 甚至高达 12M Token 的长度下均实现了近乎完美的精准检索,并且将注意力计算量减少了近 1000倍。SSA 机制用呈线性扩展的稀疏形式取代了 O(n^2) 的密集注意力。在处理 1M Token 时,SubQ 的计算需求比传统密集注意力低 64.5倍,运行速度比 FlashAttention-2 快 56倍。在优化长上下文的同时,模型保留了强大的通用推理能力。在 GPQA Diamond(85.4%)和 LiveCodeBench(89.7%)等基准测试中,其得分紧逼顶级...