惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

J
Java Code Geeks
G
Google Developers Blog
有赞技术团队
有赞技术团队
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Blog — PlanetScale
Blog — PlanetScale
罗磊的独立博客
博客园 - 聂微东
V
Visual Studio Blog
博客园_首页
D
DataBreaches.Net
腾讯CDC
I
InfoQ
F
Fortinet All Blogs
量子位
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 【当耐特】
Google DeepMind News
Google DeepMind News
人人都是产品经理
人人都是产品经理
云风的 BLOG
云风的 BLOG
月光博客
月光博客
Recent Announcements
Recent Announcements
MongoDB | Blog
MongoDB | Blog
C
Check Point Blog

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
HC32F460 USB CDC通信异常:非对齐访问异常排查
2026-04-15 · via 博客园_首页

一个项目中用到了HC32F460的官方USB库,使用官方的CDC例程发现收发数据时可能会进入HardFault中断,通过在线调试可以确认异常原因是“用法错误,非对齐访问”。

fault_report

故障仅发生在开启编译优化时,且和编译器有关,在我使用的Keil版本中,如果切换编译器版本为ARMCC v6.16(没有测试其他编译器版本)或完全关闭编译优化则无法复现问题。

环境

  • 芯片平台:HC32F460
  • 测试程序:HC32F460_DDL_Rev3.3.0\projects\ev_hc32f460_lqfp100_v2\applications\usb\usb_dev_cdc
  • 编译器版本:ARMCC v5.06
  • 编译选项:-c99 -O3,在编译优化配置为O0时无法复现问题。
  • 复现条件:官方CDC例程是将虚拟串口的操作映射到一个实体串口外设上,实现一个USB-USART的透传效果。通过USB连接并打开虚拟串口,实体串口外设收到数据时会通过USB发送到主机端,此时大概率会触发异常。

分析过程

在可以在线调试的环境中,我们可以直接查看调用堆栈确认异常出现的具体位置。首先通过Keil自带的“Call Stack + Locals”窗口,我们可以看到进入异常中断前程序正在执行usb_wrpkt函数。

call_stack

更进一步,通过查看具体的堆栈信息我们可以确定触发异常的具体汇编命令。

首先查看当前SP指针指向的堆栈栈顶地址,然后可以通过在线调试直接读取对应的RAM地址,观察进入异常前M4内核自动压栈的栈帧。通过其中的PC寄存器我们可以定位到具体发生异常的代码。

stack_top

stack_frame

通过上述步骤可以确定异常发生在一个LDM汇编指令上:

ldm_with_r1

出错的这行汇编代码执行两件事,加载寄存器r1指向的32位数据到r4寄存器,然后将寄存器r1的值增加4。

此时对照源码,可以确定引发异常的代码是WRITE_REG32(*fifo, *pu32Src++),源码:

void usb_wrpkt(LL_USB_TypeDef *USBx, const uint8_t *pu8src, uint8_t ch_ep_num, uint16_t len, uint8_t u8DmaEn)
{
    __IO uint32_t *fifo;
    uint32_t u32Count32b;
    uint32_t u32Tmp;
    uint32_t *pu32Src = (uint32_t *)(uint32_t)pu8src;
    if (u8DmaEn == 0U) {
        u32Count32b = (len + 3UL);
        u32Count32b = u32Count32b >> 2U;
        fifo = USBx->DFIFO[ch_ep_num];
        u32Tmp = 0UL;
        while (u32Tmp < u32Count32b) {
          WRITE_REG32(*fifo, *pu32Src++);
            u32Tmp++;
        }
    }
}

从源码不难看出,该函数对传入的地址pu8Src做了强制类型转换,直接通过32位宽度去访问数据,当传入的地址不是对齐地址时,这行语句必然会触发非对齐访问。

但是Cortex-M4内核支持内存非对齐访问,为什么这里会触发异常?为什么调整编译优化可以规避问题?

带着问题查阅资料可以发现,Cortex-M4内核的内存非对齐访问仅支持单地址操作(LDR,LDRH,STR,STRH),不支持多地址(LDM,STM等)。

m4_unaligend_limit

m4_unaligend_limit2

与此同时,不开启编译优化时,问题代码对应是通过LDR实现的。LDR在M4内核上可以正确执行非对齐访问。这就解释了为什么关闭编译优化后无法复现问题。

asm_with_o0

如何解决?

源码中使用强制类型转换的引诱编译器对该处进行优化,使用更高效的LDM命令而不是LDR+ADD来实现数据加载和递增,最终引发悲剧。要根治问题,可以选择放弃一点性能换取鲁棒性,逐字节从pu8Src指向的内存中读取数据。例如:

while (u32Tmp < u32Count32b) {
    uint32_t dataTemp = ((uint32_t)*pu8Src) | ((uint32_t)*(pu8Src + 1)) << 8 | ((uint32_t)*(pu8Src + 2)) << 16 | ((uint32_t)*(pu8Src + 3)) << 24;
    WRITE_REG32(*fifo, dataTemp);
    u32Tmp++;
    pu8Src += 4;
}

参考资料

[1] ARM Ltd. "Arm Cortex-M4 Processor Technical Reference Manual".
[2] Joseph Yiu. "The Definitive Guide to ARM Cortex-M3 and Cortex-M4 Processors". 3rd Edition
[3] Ryy. "ARM Cortex-M3/M4的异常/中断处理流程" https://www.renyunyang.cn/archives/arm01.html