惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Stack Overflow Blog
Stack Overflow Blog
J
Java Code Geeks
Last Week in AI
Last Week in AI
人人都是产品经理
人人都是产品经理
博客园 - 【当耐特】
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
C
Check Point Blog
月光博客
月光博客
腾讯CDC
Engineering at Meta
Engineering at Meta
博客园 - Franky
Vercel News
Vercel News
D
Docker
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
F
Fortinet All Blogs
Microsoft Security Blog
Microsoft Security Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
雷峰网
雷峰网
Google DeepMind News
Google DeepMind News
Martin Fowler
Martin Fowler
GbyAI
GbyAI
B
Blog
Hugging Face - Blog
Hugging Face - Blog
T
Tailwind CSS Blog

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
[golang编码小技巧]对数组元素赋值时,先赋值尾部再赋值头部...
ahfuzhang · 2026-05-06 · via 博客园_首页

作者:张富春(ahfuzhang),转载时请注明作者和引用链接,谢谢!


最近看到一个非常棒的 protobuf 的库:github.com/planetscale/vtprotobuf
其性能非常强悍,我自己写的版本始终没干过它。(在我的新版推出以前)vtprotobuf 可以算是 golang 领域最快的 protobuf 库。

为什么我就比不过它呢?我看到了这样的看不懂的代码:

func (m *Child) MarshalToSizedBufferVT(dAtA []byte) (int, error) {
	if m == nil {
		return 0, nil
	}
	i := len(dAtA)
	_ = i
	var l int
	_ = l
	if len(m.ChildName) > 0 {
		i -= len(m.ChildName)
		copy(dAtA[i:], m.ChildName)
		i = protohelpers.EncodeVarint(dAtA, i, uint64(len(m.ChildName)))
		i--
		dAtA[i] = 0x12
	}
	if m.ChildId != 0 {
		i = protohelpers.EncodeVarint(dAtA, i, uint64(m.ChildId))
		i--
		dAtA[i] = 0x8
	}
	return len(dAtA) - i, nil
}

可以发现,这个库的特点是: 先对数组的尾部赋值,然后下标向前偏移,然后再对数组首部进行赋值
难道这样就会变快?

Yes!
下面我就拆解一下变快的原因:

先看下面的两个函数:

func f1(arr []byte) {
    arr[0] = 1
    arr[9] = 2
}

func f2(arr []byte) {
    arr[9] = 2
    arr[0] = 1
}

功能完全一样,只是顺序不同。

下面用命令行来检查数组越界检查:

go tool compile -d=ssa/check_bce/debug=1 bce.go

可以发现:

func f1(arr []byte) {
    arr[0] = 1 // 仍有 bounds check
    arr[9] = 2 // 仍有 bounds check
}

func f2(arr []byte) {
    arr[9] = 2 // 仍有 bounds check
    arr[0] = 1 // 没有 Found,说明这个检查被消掉了
}

由此说明:如果先出现了比较大的下标,再出现小的下标,那么编译器就能推断后续的数组访问一定没越界,由此便不再产生越界检查的代码。

从 golang 源码本身也能发现证据:
Go 编译器源码证据主要在 cmd/compile/internal/ssa/prove.go。OpIsInBounds 表示一次下标越界检查;当它为真时,编译器会学习到 0 <= index < length。源码注释直接写了:对于 OpIsInBounds,正分支会学习 signed 域里的 0 <= a0 < a1,以及 unsigned 域里的 a0 < a1,然后调用 ft.update 记录 index 和 length 之间的关系。

希望对你有用。
Have func. 😃