인셔셔RSS 관심 있는 블로그, 뉴스, 기술 정보를 효율적으로 추적하고 읽으세요
원문 읽기 InertiaRSS에서 열기

추천 피드

Apple Machine Learning Research
Apple Machine Learning Research
Google DeepMind News
Google DeepMind News
小众软件
小众软件
GbyAI
GbyAI
酷 壳 – CoolShell
酷 壳 – CoolShell
F
Fortinet All Blogs
博客园 - 三生石上(FineUI控件)
B
Blog
量子位
B
Blog RSS Feed
Vercel News
Vercel News
Blog — PlanetScale
Blog — PlanetScale
Last Week in AI
Last Week in AI
博客园 - 叶小钗
MongoDB | Blog
MongoDB | Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
爱范儿
爱范儿
Jina AI
Jina AI
C
Check Point Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
IT之家
IT之家
H
Hackread – Cybersecurity News, Data Breaches, AI and More
云风的 BLOG
云风的 BLOG

阮一峰的网络日志

科技爱好者周刊(第 396 期):互联网通信的替代方案 科技爱好者周刊(第 396 期):互联网通信的替代方案 - 阮一峰的网络日志 科技爱好者周刊(第 395 期):软件开发的第三种方式 科技爱好者周刊(第 395 期):软件开发的第三种方式 - 阮一峰的网络日志 科技爱好者周刊(第 393 期):脑腐状态 科技爱好者周刊(第 392 期):axios 投毒与好莱坞式骗术 科技爱好者周刊(第 391 期):AI 的贫富分化 科技爱好者周刊(第 390 期):没有语料,大模型就是智障 套壳中国大模型撑起500亿美元估值?扒一扒 Cursor 的"套壳"疑云 科技爱好者周刊(第 389 期):未来如何招聘程序员 科技爱好者周刊(第 388 期):测试是新的护城河 零安装的"云养虾":ArkClaw 使用指南 科技爱好者周刊(第 387 期):你是领先的 科技爱好者周刊(第 386 期):当外卖员接入 AI 字节全家桶 Seed 2.0 + TRAE 玩转 Skill 科技爱好者周刊(第 385 期):马斯克害怕中国车企吗? 智谱旗舰 GLM-5 实测:对比 Opus 4.6 和 GPT-5.3-Codex 科技爱好者周刊(第 384 期):为什么软件股下跌 科技爱好者周刊(第 383 期):你是第几级 AI 编程 Kimi 的一体化,Manus 的分层 科技爱好者周刊(第 382 期):独立软件的黄昏 AI native Workspace 也许是智能体的下一阶段 科技爱好者周刊(第 381 期):中国 AI 大模型领导者在想什么 科技爱好者周刊(第 380 期):为什么人们拥抱"不对称收益" 科技爱好者周刊(第 379 期):《硅谷钢铁侠》摘录 我如何用 AI 处理历史遗留代码:MiniMax M2.1 升级体验 科技爱好者周刊(第 378 期):预测是新的互联网热点 科技爱好者周刊(第 377 期):14万美元的贫困线 科技爱好者周刊(第 376 期):太空数据中心的争议 科技爱好者周刊(第 375 期):一扇门的 Bug
字节序探析:大端与小端的比较
阮一峰 · 2022-06-03 · via 阮一峰的网络日志

今天谈谈一个重要的计算机概念,大家可能都听说过它,但是很少深究,那就是字节序(Endianness)。

一、概念

字节序指的是,多字节数据的内存排列顺序。这样说比较抽象,使用图形解释就很好懂。

内存好比一排房间,每个字节是一间房。每间房都有门牌号(内存地址),从0号开始,然后是1号、2号......

0号字节的地址小,称为低位内存;3号字节的地址大,称为高位内存。

现在有一个数值abcd要放进这些房间,每个房间放一个数字,那么有两种放法。

第一种放法是,第一位a放在低位地址(0号),最后一位d放在高位地址(3号)。

这种排列称为"大端序"(big-endian,简称 BE),即大头在前,因为aabcd的大头(最重要的数字)。

第二种放法是,第一位a放在高位地址(3号地址),最后一位d放在低位地址(0号地址)。

这种排列称为"小端序"(little-endian,简称 LE),即小头d在前。

大端序和小端序合称字节序,这两个名字来自18世纪的英国小说《格列佛游记》。某国分成两派,一派认为鸡蛋应该从大头吃起,称为"大端派";另一派认为,鸡蛋应该从小头吃起,称为"小端派"。两派相执不下,谁也无法说服谁,最后甚至为此交战。

二、可读性

对于人类来说,不同字节序的可读性是不一样的。大部分国家的阅读习惯是从左到右阅读。

大端序的最高位在左边,最低位在右边,符合阅读习惯。所以,对于这些国家的人来说,从左到右的大端序的可读性更好。

但是现实中,从右到左的小端序虽然可读性差,但应用更广泛,x86 和 ARM 这两种 CPU 架构都采用小端序,这是为什么?

或者换一种问法,两种不同的字节序为什么会并存,统一规定只使用一种,难道不是更方便吗?

原因是它们有各自的适用场景,某些场景大端序有优势,另一些场景小端序有优势,下面就逐一分析。

三、检查奇偶性

小端序优势最明显的,大概就是检查奇偶性,即通过查看个位数,确定某个数字是奇数还是偶数。

123456为例,大端序从左到右排列,计算机必须一直读到最后一位的个位数6,才能确定这是偶数。

小端序是从右到左排列,个位数在第一位。所以,只要读取第一位,就能确定它是偶数。

四、检查正负号

一个类似的场景是检查正负号,确定一个数是正数还是负数。

大端序的符号位在左边第一位,小端序的符号位在右边最后一位。所以,大端序有优势,只看第一位就能知道是不是负数。

五、比较大小

下一个操作是比较大小。现在有三个数字,需要比较大小:43662576,594,2。

上图是大端序排列,因为是从左到右排列,所以三个数字在右边个位数对齐。比较大小时,计算机就不得不读取每一个数的所有位,直到个位数,再进行比较。

如果改成小端序,就是下面的排列方式。

小端序是从右到左,所以三个数字在第一位对齐。计算机就不需要读取所有位,哪个数字先读不到下一位,就是最小的。比如,2这个数字就没有第二位,所以读到第二位时,就知道它是最小的。

所以,比较大小时,小端序有优势。

六、乘法

接下来,再看乘法操作。

乘法是逐位相乘,每一轮乘法都要向前进位。

上图是大端序的24165乘以3841。大端序的乘法是向左进位,也就是向左边扩展,必须等到每一轮的结果都出来(上例是四轮),再相加统一写入内存。

如果改成小端序的乘法,就不需要等待下一轮的结果,每一轮都可以直接写入内存。

上图是小端序的24165乘以3841。小端序的乘法是向右进位,也就是向右边扩展,左边的边界不变。每一轮结果写入内存后,就不需要移动,后面有变化只需要改动对应的位就行了。

因此,小端序的乘法有明显优势。

七、任意精度整数

上一个例子的从低位开始计算的特性,对于任意精度整数特别有用。任意精度整数又称大整数,可以存放任意大小的整数。

它的内部实现是把整数分成一个个较小的单位,通常是 uint32(无符号32位整数)或 uint64(无符号64位整数),按顺序组合在一起。

如果是大端序,第一个 u64 就是这个整数最大的部分。运算时,一旦这个数发生变化,需要进位,后面的所有位都必须移动和改写。小端序发生进位时,往往就不需要所有位移动。

小端序的另一个好处是,如果逐字节的运算从个位数开始(比如乘法和加法),可以从左到右依次运算一个个 u64,算完上一个再读取下一个。大端序就不行,必须读取整个数以后再进行运算。

八、更改类型

最后一个例子是,C 语言有一种 cast 操作,可以强制改变变量的数据类型,比如把32位整数强行改变为16位整数。

上图中,32位整数0x00000001更改为16位整数0x0001,大端序是截去前面两个字节,这时指向这个地址的指针必须向后移动两个字节。

小端序就没有这个问题,截去的是后面两个字节,第一位的地址是不变的,所以指针不需要移动。

九、总结

综上所述,大端序和小端序各自的优势如下。

如果需要逐位运算,或者需要到从个位数开始运算,都是小端序占优势。反之,如果运算只涉及到高位,或者数据的可读性比较重要,则是大端序占优势。

十、参考链接

(完)