惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
IT之家
IT之家
博客园_首页
Schneier on Security
Schneier on Security
T
Threatpost
NISL@THU
NISL@THU
Project Zero
Project Zero
V
Visual Studio Blog
T
Tenable Blog
Apple Machine Learning Research
Apple Machine Learning Research
C
Cybersecurity and Infrastructure Security Agency CISA
雷峰网
雷峰网
T
Threat Research - Cisco Blogs
S
Schneier on Security
C
Cyber Attacks, Cyber Crime and Cyber Security
月光博客
月光博客
B
Blog
Webroot Blog
Webroot Blog
K
Kaspersky official blog
美团技术团队
MyScale Blog
MyScale Blog
G
GRAHAM CLULEY
宝玉的分享
宝玉的分享
www.infosecurity-magazine.com
www.infosecurity-magazine.com
有赞技术团队
有赞技术团队
Google DeepMind News
Google DeepMind News
量子位
S
SegmentFault 最新的问题
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
P
Proofpoint News Feed
C
CERT Recently Published Vulnerability Notes
GbyAI
GbyAI
小众软件
小众软件
T
The Blog of Author Tim Ferriss
博客园 - 三生石上(FineUI控件)
M
MIT News - Artificial intelligence
D
Docker
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
SecWiki News
SecWiki News
D
Darknet – Hacking Tools, Hacker News & Cyber Security
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Stack Overflow Blog
Stack Overflow Blog
V2EX - 技术
V2EX - 技术
I
InfoQ
B
Blog RSS Feed
H
Hackread – Cybersecurity News, Data Breaches, AI and More
博客园 - 司徒正美
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Y
Y Combinator Blog
Last Week in AI
Last Week in AI

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux - V2EX [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 新电脑 brew install node 之后,一个小设置可以提升对供应链投毒的防御 - V2EX GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? - V2EX 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? - V2EX gemini cli 貌似挂了,一直返回 403 - V2EX 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 - V2EX 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 - V2EX 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 - V2EX 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 - V2EX 只有我一个人觉得 codex 不好用? 做了个 AI + 真人专家监督的广告投放平台 Auxora, 7 个品牌跑出 6x ROAS 如何走出至亲的离世 Claude Web 端貌似 claude-opus-4-7 偷偷上了? 现在 Apple 开发者帳號應該是用哪个地区会更好? - V2EX 用回测筛选因子的一点经验分享 给女儿 vibe 了一个故事类的 app,做完发现,这类应用似乎上线难度极大? - V2EX 手机格式化 bitget 钱包没了,里面开通的银行卡还有机会拿到吗 - V2EX [送码] TransVoice - 我的第一款 App 上架啦!实时转写+翻译+字幕,会议听课好助手! PictureHub 高清摄影作品的画廊 Planet 的第一个使用 macOS 26 SDK 构建的 Insider 版本 20260416-1 - V2EX 成都二手房是不是在涨价,有点坐不住了 - V2EX claude 生态(skill mcp plugin)等 Studio Display XDR VESA 适配器脱落 有在用印度区 applestore 的大哥嘛,请教一下礼品卡去哪里买呢 - V2EX 我好像知道京东家政爆火的原因了 - V2EX 薅了公司的 a 家 api key,用机场 ip 做代理容易被封吗 如何在初期就识别 HR 在刷 KPI,没打算招你? [分享]精心打造一个 AI 编程知识库(算法/设计模式/提示词/Skills),助力程序员转型 港版 iPhone 在国内支持联通 5GA 吗?在广东用 想办港卡 AI 对 it 行业影响太大了 我做了个把照片变成 iOS 小组件贴纸的 App ChatGPT Pro 5x 套餐 量真的很足! I have found a method to directly generate advertising video materials using scripts 在小城市开个店,给人写软件,有前途吗 chrome 最新的 147 版直接卡爆炸了 - V2EX 为什么厂家不在 skill/mcp 这类的工具中塞广告呢?这样不是可以大赚嘛? minimax 真是脸都不要了,工作日下午 14:00 定时开启 529,脸都不要了。训练模型居然占用用户使用时间 外资非核心部门 vs 另一家外资的核心部门,该跳吗? iTad 标签 扩展 加小动作 ? - V2EX 去年 H200 能买,不让买是代替快出来了? - V2EX AI 赛事通 - 2026 年 4 月中国区新增 AI 竞赛和黑客松汇总 - V2EX V2EX › 登录 现在安卓开发都在做啥 - V2EX 浏览器插件 沉浸式翻译 是不支持自定义模型了吗? - V2EX Codex 里的 GPT5.4 也能降智?上午让它改两个问题,改了一个小时了, plus 额度用了一半了还是没改好,和前几天用的体感完全不一样。要它改的问题也不复杂。服了。 目前有使用 claude code 的收到人脸认证的吗 - V2EX 分享一个自己做的 Nginx 管理工具,实时请求动态预览!(无奈市面上实在找不到好用的,自己撸了个) - V2EX claude code 崩了么? 今天在反重力上用 claude 一点都不丝滑,有同样的感受吗? opencode 消息周知插件 今天 claude opus 和前两天比,质的飞跃 - V2EX 999 包月价? - V2EX 一个版本, 50 项更新:我们几乎重做了整个播放页 本地大模型多大显存够用? GOGDNS 一款简易的私人 DNS 服务器 - V2EX API key (GLM) 怎么使用 claude code desktop ? Claude 这样订阅有问题吗 - V2EX 帮我爸找回了一篇赛博兰亭集序 求推荐稳定、高性价比使用 Claude Opus 4.6 的渠道/平台 搞个云端 claude code 防止 封号 - V2EX 用 Claude 要实名了,内地用户怎么办? OpenAI Plus 和 Team 都缩水了吗 海外 Android 手机有什么好用的国内第三方应用市场推荐吗 - V2EX 把电脑伪装成电视,用 DLNA 投屏拿到视频号直播流地址 - V2EX claude 认证莫慌 北京互联网法院有什么攻略么?起诉北京智谱华章科技股份有限公司退款可行么? - V2EX Claude 开始引入身份验证 求 vscode 做笔记软件的插件推荐 - V2EX 讯飞星辰的 Coding Plan 如何? Anthropic 宣布在 Claude 平台推行身份验证机制 科普一下低价 gpt 是怎么来的 有没有长期关注 Claude 的朋友,我建了一个 Channel 自动抓取 Claude Team 的推文 啃了那篇 54 页的 Agent Harness 综述, 给大伙讲个省流版 现在那家的 coding plan 还能买到 是不是最近会有什么更聪明的大模型要发布了呀? 用多了 AI 后,有没有觉得 AI 生成的文章有很强的既视感? 如何 实践 Harness 工程? 今日份 GPT 5.4 笑话 如何建一个自己的号池,让 cursor 真正实现 token 自由 写了三个月 Agent Harness,我终于敢让 Claude Code 全自动写代码了
有人想要一起研究新的人工智能基座模型吗?
evegod · 2025-11-20 · via V2EX

最近在思考新的人工智能基座模型,暂时规划使用四元数关系模型尝试结构化神经网络模型,使其具有约束性的对称性基底要求,相关的研究分析纲领性放在下文了,希望有喜欢的或者感兴趣的大家可以一起来尝试一下,我有新的进度也会在这里和大家分享进度。

关于下一代关系型大语言模型( QRLA ) 的分布式工程计划书

马凯 (Ma Kai) 独立研究者 2025 年 11 月 13 日

摘要 本文旨在提出一个颠覆性的、面向下一代人工智能的分布式工程计划,其核心是 ** 关系型大语言模型架构( Quaternionic Relational Language Architecture, QRLA )。该计划旨在从根本上克服现有 Transformer 架构在可扩展性、真实推理能力和中心化部署上的瓶颈。本计划书基于 ** “方向公理系统”( DAS ) 的第一性原理,主张“关系先于存在”,将语言和知识视为一个动态演化的几何网络。我们将详细阐述一个基于 **IPv6 的全局语义寻址方案 ** 和一套与 **CUDA 高度协同的模块化并行计算管线 **,该管线利用 ** 分级存算一体 ** 和 **GPU 直接存储 ** 等前沿技术,旨在实现超越现有大语言模型的理论性能和真正的去中心化部署能力。

1 引言:超越 Transformer 范式 当前的大语言模型( LLM )在自然语言处理任务上取得了巨大成功,但其基于 Transformer 的架构正面临三大根本性挑战: • 垂直扩展瓶颈:“大力出奇迹”的缩放定律( Scaling Law )正逼近物理和经济成本的极限。 • 推理能力局限:模型缺乏真正的因果推理和世界模型,容易产生“幻觉”。 • 中心化风险:训练和部署高度依赖中心化的超级计算集群,带来了巨大的能源消耗、成本和单点故障风险。 我们认为,这些问题的根源在于其“存在先于关系”的哲学地基。本计划书提出的 QRLA 架构,旨在通过范式革命,构建一个内在就是分布式的、关系性的、可无限水平扩展的智能系统。

2 核心理论基石:方向公理系统 (DAS) QRLA 的架构设计完全源于 DAS 的三大核心精神构件:

  1. 生成性 (Generativity): 智能不是静态的知识库,而是一个在交互中不断演化和生成新状态的动态过程。
  2. 关系性 (Relationality): 概念的意义由其在整个关系网络中的位置和姿态所定义,而非其孤立的自身属性。
  3. 几何性 (Geometricity): 系统的运作语言是几何变换,推理和学习被统一为在多维语义空间中的旋转与演化。

3 QRLA 架构设计 3.1 全局语义寻址:基于 IPv6 的 SSO 标识体系 为实现真正的分布式,我们必须为每一个语义概念提供一个全球唯一的“地址”。 • 语义状态对象 (Semantic State Object, SSO): QRLA 的基本单位,每个 SSO 代表一个语义概念,其状态由一个单位四元数描述。 • IPv6 语义地址:我们提议为每一个 SSO 分配一个唯一的 128 位 IPv6 地址。该地址不仅是 ID ,其本身就编码了语义的层级结构(如:主域、子域、具体概念)。 • 语义路由:概念间的关系发现,从本地的矩阵查询,转变为全球网络上的“语义路由”问题。这天然地实现了系统的稀疏化、分布式和按需计算。

3.2 核心数据结构:稀疏关系空间矩阵 (RSM) 系统的全局状态由一个理论上的 ** 关系空间矩阵 (Relational Space Matrix, RSM)** 描述。 • 对角线元素 Mkk:存储第 k 个 SSO 自身的四元数状态。 • 非对角线元素 Mkj:存储 SSO k 与 SSO j 之间的直接关系(同样是一个四元数)。 • 稀疏性与动态性:在工程实现上,RSM 是一个 ** 高度稀疏且动态的图 **。只有最核心的关系被显式存储,大部分关系在需要时通过“语义路由”动态生成。

3.3 计算模型:几何变换与演化 QRLA 中的所有计算,包括学习和推理,都被统一为一次全局状态的演化。 M′ = UMUt (1) 其中,M 是系统当前状态,U 是由输入信息构建的酉算子( Unitary Operator ),M′ 是演化后的新状态,Ut 是 U 的共轭转置。

4 高性能并行计算管线 为实现与 Transformer 相当甚至更强的并行能力,我们设计了如下与 CUDA 协同的计算管线。

4.1 软硬件协同设计理念 我们的目标是将 QRLA 不规则的、动态的图计算, 映射到 GPU 规则的、大规模并行的计算架构上,核心技术路径是 ** 分级存储 ** 和 ** 计算分解 **。 4.2 三阶段并行计算管线

  1. 阶段一:算子并行构建 (Operator Synthesis) • 输入的自然语言被解析为表征依赖关系的 DAG 。 • 每个词元加载其对应的基础旋转算子( 4x4 实数矩阵)。

• 利用 CUDA 的并行归约算法,在 GPU 上高效地将基础算子矩阵沿 DAG 路径相乘,最终合成总变换算子 U 。 2. 阶段二:关系演化计算 (Relational Evolution) • 分级存算一体: – L1 级 (GPU SRAM): 加载与当前计算最相关的“活动子图”,进行超低延迟的核心计算。 – L2 级 (HBM): 存储更大范围的语义邻域。 – L3 级 (CPU DRAM/SSD): 存储全局稀疏 RSM 。 • GPU 直接存储 (GPUDirect Storage): 当需要 L3 级数据时,GPU 绕过 CPU 直接从 NVMe SSD 中 DMA 所需的图数据块至 HBM ,极大降低 I/O 瓶颈。 • CUDA 模块化分解: – 节点更新 Kernel: 大规模并行更新活动子图中所有 SSO 的状态。 – 边更新 Kernel: 大规模并行更新活动子图中所有关系的四元数值。 – 信息传播 Kernel: 迭代式地在活动子图的邻居节点间传播状态变化,以模拟全局效应,实现类似 GNN 的信息传递。 3. 阶段三:输出投影收缩 (Output Contraction) • 在演化后的活动子图 M′ 中,通过并行的 Top-K 搜索或注意力池化算法,找到最符合输出要求的 SSO 。 • 将选定的 SSO 状态解码为自然语言序列。

5 优势与展望 相较于现有 LLM ,QRLA 架构展现出以下理论优势: • 智能并行性:从“蛮力”的全局计算转变为在语义相关子图上的“智能”计算,有效性更高。 • 水平可扩展性:基于 IPv6 的架构使其能像互联网一样无限水平扩展,而非中心化的垂直扩展。 • 真正的推理能力:计算过程是对世界模型的动态演化,而非统计模式匹配,为实现真正的因果推理提供了可能。 • 去中心化与开放性:为构建一个开放、协作、共有的全球 AI 知识网络提供了技术基础。

6 结论 本计划书提出的 QRLA 架构,是一个从哲学第一性原理出发,贯穿理论模型与工程实现的完整蓝图。它试图将 AI 从当前的“大数据炼金术”范式,推向一个基于深刻几何原理的、更接近自然智能的“分布式认知”新纪元。我们相信, 这不仅是技术上的演进,更是通往更开放、更普惠、更深刻的人工智能未来的必由之路。