惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

雷峰网
雷峰网
Recorded Future
Recorded Future
B
Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 聂微东
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
量子位
GbyAI
GbyAI
IT之家
IT之家
Microsoft Azure Blog
Microsoft Azure Blog
I
InfoQ
S
SegmentFault 最新的问题
T
Tailwind CSS Blog
有赞技术团队
有赞技术团队
M
MIT News - Artificial intelligence
罗磊的独立博客
MongoDB | Blog
MongoDB | Blog
The Cloudflare Blog
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
腾讯CDC
小众软件
小众软件
博客园 - 三生石上(FineUI控件)
aimingoo的专栏
aimingoo的专栏
博客园 - Franky
Martin Fowler
Martin Fowler
P
Proofpoint News Feed
月光博客
月光博客
博客园_首页
C
Check Point Blog
宝玉的分享
宝玉的分享
Security Archives - TechRepublic
Security Archives - TechRepublic
T
Tenable Blog
Vercel News
Vercel News
SecWiki News
SecWiki News
Security Latest
Security Latest
Microsoft Security Blog
Microsoft Security Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
阮一峰的网络日志
阮一峰的网络日志
Hacker News - Newest:
Hacker News - Newest: "LLM"
Google Online Security Blog
Google Online Security Blog
N
News and Events Feed by Topic
Y
Y Combinator Blog
U
Unit 42
The Register - Security
The Register - Security
云风的 BLOG
云风的 BLOG
K
Kaspersky official blog
WordPress大学
WordPress大学
Blog — PlanetScale
Blog — PlanetScale
N
Netflix TechBlog - Medium
Jina AI
Jina AI

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12) Snack JSONPath 项目架构分析 Claude Code Buddy 小析:一个非核心功能,如何体现产品的细节完成度 AI新时代下的图床管理方案-Cloudflare图床+MCP+Skills方案指南 化繁为简:顺丰速运App如何通过 HarmonyOS SDK实现专业级空间测量 从零实现富文本编辑器#13-React非编辑节点的内容渲染 AI开发-python-langchain框架(3-23-OpenAI Functions风格Tool Calling智能助手) .NET + AI 进阶实战:基于类的技能开发 - 打造可治理的 Agent 能力模块 【从0到1构建一个ClaudeAgent】规划与协调-技能 上周热点回顾(4.6-4.12) 电子小白的工具三件套:面包板、杜邦线、万能板 单表五亿数据的查询优化 | Mysql、StarRocks 2. WorkBuddy:从“我是谁”到“帮我干活” C# 如何减少代码运行时间:7 个实战技巧 基于HelixToolkit.SharpDX 渲染3D模型 - 笺上知微 从零开始的双臂具身VLA起源及现阶段发展综述 - SkyXZ 记对 xonsh shell 的使用, 脚本编写, 迁移及调优 - pluvium27 受够了Vibe Coding的失控?换个起点,让AI事半功倍 从开始配置漏洞环境到漏洞复现流程 - 難しい 关于10年工作经验的程序员对OpenClaw的实战经验分享以及看法 - 虚无境 Any metadata 的内存布局 C# .NET 周刊|2026年3月2期 - InCerry 我帮你测过了,测试圈排名第二的 Skill 依然很牛逼 Skill Discovery | 无监督技能发现的经典工作总结 - MoonOut PbootCMS 网站内容数量多导致访问慢?这些实用优化方案帮你提速! - 家兴网络技术工作室 上下文工程是什么?过时了么?一文讲明白! - 一枫说码 网站漏洞怎么发现并修复?一篇实用指南(附完整流程) - 家兴网络技术工作室 开了 TUN 模式还是直连?90% 的人都踩过这个坑 Github日报|2026年04月12日 - AI一族 AScript扩展多种脚本语言 - rockey627 AI 学习笔记:Agent 的记忆机制 你能被装进一个文件里吗?——7 万人把同事"蒸馏"成了 AI - 我没有三颗心脏 Claude Code 通关手册(七):给 AI 装上技能包——Skills 完全指南 - 暮色之狐 在浏览器中快速编辑代码:VSCode Web 集成实践 - Newbe36524 蒸馏自己 skill?基于 Deepseek 的蒸馏器,丐版蒸馏方式,简单便捷 - To_Carpe_Diem Spring AI Aliababa和AgentScope,哪个更好? - 苏三说技术 Etsy 把 1000 个 MySQL 分片迁进 Vitess:425TB 数据背后的真正问题不是性能,而是运维规模 MicroPython LVGL基础知识和概念:底层渲染与性能优化 - FreakStudio 数据库草图算法 Python 潮流周刊#146:CPython 引入 Rust 的进展 - 豌豆花下猫 最小生成树 - mofei1116 红日靶场七:从外网入口、容器逃逸到 AD 接管的完整利用链复盘 - YouDiscovered1t 分享四款开源且实用的 Kafka 管理工具 - 追逐时光者 vLLM 权重加载机制全解析:从挑战到理想架构 LCT 学习笔记 - ACehomoxue Avalonia UI 12.0.0 正式发布:架构演进和性能飞跃 - 张善友 当 AI Agent 把调用链拉长,延迟开始成为一门生意 conhost.exe 无法显示 U+2717 - 145a 太秀了,我把自己蒸馏成了 Skill!已开源 - 程序员鱼皮 ASP.NET Core 内存缓存实战:一篇搞懂该怎么配、怎么避坑 基于 Ghostty 带有分割标签页和为 Claude 编程设计的通知终端 - BugShare AI 焊死入口:教育的“操作系统级”重塑 - 郝hai 初级Java开发工程师使用sql脚本编写代码的过程是简单而且不糊涂 - CoderOilStation Claude Code通关手册(六):MCP协议完全指南 - 暮色之狐 边框灯光环绕动画特效实现指南 - Newbe36524 开源:子木蒸馏版的 SEO 审计工具 seo-audit-skill v1.0 我所理解的Python元模型 【从0到1构建一个ClaudeAgent】规划与协调-TodoWrite - 程序员Seven Claude 和 Codex 在审计 Skill 上性能差异探究 - ACai_sec AScript如何实现中文脚本引擎 - rockey627 【渗透测试】HTB Season10 Garfield 全过程wp - dynasty_chenzi Android 开发者为什么必须掌握 AI 能力?端侧视角下的技术变革 树状数组正确性证明 - AC-wyr 你的 AI 焦虑,可能比 AI 本身更危险——ATM 机没有消灭银行柜员,但恐慌消灭了你的判断力 - 我没有三颗心脏 一个拉胯的分库分表方案有多绝望?整个部门都在救火! - 冰河团队 动态规划入门必学之走方格问题 - Ofnoname PostgREST 与 PostgreSQL 角色权限配置全解析(生产级实践) - SheepDog1998 使用 UEFI 图形输出协议 GOP 在屏幕上显示图像的方法 - 阿源- Claude Code通关手册(五):组建你的AI专家团队,子代理系统 - 暮色之狐 一个程序员到架构师的催婚路之感悟(整整10年后的催婚相亲感悟) - MisterLip 用 Agent Skill 自动生成工作周报 - 赵康
龙芯2k0300 - 智能车走马观碑组目标检测算法
大奥特曼打小怪兽 · 2026-05-11 · via 博客园_首页

第二十一届走马观碑赛题引入目标板识别环节,车模需要检测目标板、判断类别,并执行对应通行策略。官方演示方案采用 YOLOv5 + ONNX + OpenCV DNN。本文按 Linux 环境整理完整流程,覆盖环境搭建、数据集构建、模型训练、ONNX 转换和龙芯平台部署。

当前子工程目录名为 tb_yolo,其中 tb 表示 target boardyolo 表示 yolo v5 检测方案。

一、环境与资源准备

本节进行 Linux 下训练环境搭建。当前项目通常在专用虚拟机中配合 VS Code 开发,因此直接使用系统 Python 环境。

1.1 安装系统依赖

Ubuntu/Debian 类系统中执行:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ sudo apt update
zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ sudo apt install -y python3 python3-pip

1.2 初始化 Python 环境

在仓库根目录执行:

zhengyang@ubuntu:~$ cd /opt/2k0300/loongson_2k300_lib/tb_yolo/
zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ ./scripts/setup_env.sh

该脚本会完成:

  • 检查当前 python3pip 是否可用;
  • 安装 tb_yolo/requirements-linux.txt 中的辅助依赖;
  • 安装 yolo v5 自带 requirements.txt

1.3 子工程目录结构

当前 tb_yolo 目录按职责划分如下:

tb_yolo/
  vendor/
    yolov5/                        # 第三方 YOLOv5 上游源码
  configs/
    target_board.names             # 类别名
    target_board.yaml              # YOLOv5 数据集配置
  dataset/
    images/train/
    images/val/
    labels/train/
    labels/val/
    # 已迁入演示数据集:train 401 张,val 51 张
  models/
    pretrained/yolov5n.pt          # 轻量级预训练权重
    demo/best.pt                   # 演示包已有 PyTorch 权重
    demo/best.onnx                 # 演示包已有 ONNX 模型
  outputs/
    train/                         # 新训练输出
  scripts/                           # 本项目流程脚本
  docs/                            # 部署和训练记录文档

vendor/yolov5 是第三方源码目录,里面自带 data/models/utils/ 等目录。外层的 configs/dataset/models/outputs/ 才是本目标板项目自己的配置、数据集、权重和输出。日常操作优先使用外层目录和 scripts/ 脚本。

原本放在 vendor/yolov5/dataset02 的数据集已经迁移到外层 tb_yolo/dataset/vendor/yolov5 只保留 yolo v5 源码和上游自带示例文件,不再作为项目数据目录使用。

1.4 已接入的本地模型

当前已经整理出:

vendor/yolov5
models/pretrained/yolov5n.pt
models/demo/best.pt
models/demo/best.onnx
dataset/images/train
dataset/images/val
dataset/labels/train
dataset/labels/val

权重下载地址可作为备用来源:《yolo v5权重文件下载》。

二、数据集构建与配置

2.1 测试数据集

2.1.1 数据来源

测试数据集来自官方演示数据包,主要用于快速验证当前 yolo v5 训练、导出和推理流程是否跑通。该数据集已经迁移到外层 dataset/,不再放在 vendor/yolov5 源码目录中。

2.1.2 目录结构

当前测试数据集结构如下:

dataset/
  images/
    train/
    val/
  labels/
    train/
    val/
2.1.3 数据规模

当前数据量如下:

images/train: 401
labels/train: 401
images/val:   51
labels/val:   51
2.1.4 类别文件

测试数据集对应的类别文件为:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ cat configs/target_board.names

当前演示包类别为:

Mouse
Printer
drill
Wrench
Screwdriver
2.1.5 快速验证

如果只是验证流程,可以直接使用该测试数据集训练:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ ./scripts/train_yolov5_linux.sh

注意:智能车项目,应按实际目标板重新采集图片、标注标签,并更新类别文件。

2.2 用户目标数据集

用户目标数据集指自己采集、标注并用于最终训练的真实目标板数据。以本项目为例,就是走马观碑赛题中的目标板图片数据。

2.2.1 数据集目录规范

yolo v5 数据集需要图片和标签分开存放,训练集和验证集也需要分开。最终训练目录仍统一整理到:

dataset/
  images/
    train/
    val/
  labels/
    train/
    val/

关键原则:

  • images/trainlabels/train 一一对应;
  • images/vallabels/val 一一对应;
  • 图片名和标签名除后缀外必须一致;
  • 无目标负样本也可以保留空 txt 标签文件。
2.2.2 准备原始图片

建议先建立临时原始数据目录:

raw_dataset/
  images/       # 全部原始图片
  labels/       # LabelImg 输出的 YOLO 标签

将采集到的目标板图片放入:

raw_dataset/images/

建议覆盖以下场景:

近距离、中距离、远距离
正视、左偏、右偏、俯仰角变化
强光、弱光、背光、阴影
运动模糊、轻微失焦
赛道背景干扰
目标板边缘不完整
2.2.3 使用 LabelImg 标注

安装和启动:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ labelimg

LabelImg 设置:

标注格式切换为 YOLO
Open Dir 选择 raw_dataset/images
Change Save Dir 选择 raw_dataset/labels

常用快捷键:

W       创建矩形框
A       上一张
D       下一张
Ctrl+S  保存

标注完成后,raw_dataset/labels/ 中应生成同名 .txt 文件,例如:

0001.jpg -> 0001.txt
0002.jpg -> 0002.txt

yolo标签格式如下:

class_id center_x center_y width height

其中坐标均为 0-1 的归一化值。

2.2.4 划分训练集和验证集

执行:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ python3 scripts/split_dataset.py \
  --images raw_dataset/images \
  --labels raw_dataset/labels \
  --out dataset \
  --val-ratio 0.2 \
  --copy

说明:

--val-ratio 0.2  表示 20% 数据作为验证集
--copy           表示复制文件,不移动原始 raw_dataset

执行后,raw_dataset/ 中的原始数据会按比例整理到 dataset/。如果 dataset/ 中原本是测试数据集,请先确认是否需要备份,再覆盖为真实目标板数据。

2.2.5 类别文件

编辑:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ vim configs/target_board.names

每行一个类别。当前演示包类别为:

Mouse
Printer
drill
Wrench
Screwdriver

训练自己的目标板时,将其改成真实目标板类别,例如:

left
right
straight
stop
slow

注意:target_board.namesLabelImg 生成的 classes.txt、推理代码中的类别数组,三者顺序必须完全一致。

2.2.6 生成 yolo v5 数据集配置

执行:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ python3 scripts/update_yaml_from_names.py

生成:

configs/target_board.yaml

示例内容:

path: /opt/2k0300/loongson_2k300_lib/tb_yolo/dataset
train: images/train
val: images/val
test: null
names:
  0: Mouse
  1: Printer

其中 path 为绝对路径,避免 yolo v5从不同工作目录启动时找错数据集。

三、模型训练与转换

3.1 推荐训练参数

当前封装脚本默认参数如下:

weights: models/pretrained/yolov5n.pt
data:    configs/target_board.yaml
imgsz:   64
epochs:  150
batch:   4
device:  cpu
project: outputs/train
name:    exp_ls2k
workers: 0
cache:   disk

参数说明:

--weights      预训练权重,默认 yolov5n.pt
--data         数据集配置文件
--epochs       训练轮次,建议 100-200
--batch-size   每批图片数量,CPU 或小显存建议 2-4
--imgsz        输入尺寸,智能车建议 64 或 96
--device       cpu 或 cuda:0
--workers      数据加载线程,稳定起见默认 0
--cache        disk,缓存到磁盘

3.2 启动训练

默认训练:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ ./scripts/train_yolov5_linux.sh

指定训练参数:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ IMG_SIZE=96 EPOCHS=200 BATCH_SIZE=4 DEVICE=cuda:0 RUN_NAME=exp_target_96 \
  ./scripts/train_yolov5_linux.sh

也可以显式指定配置和权重:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ ./scripts/train_yolov5_linux.sh \
  configs/target_board.yaml \
  models/pretrained/yolov5n.pt

训练完成后,最优权重位于:

outputs/train/exp_ls2k/weights/best.pt

训练得到的 .ptPyTorch 权重,龙芯平台 OpenCV DNN 推理需要使用 .onnx

3.3 安装导出依赖

初始化脚本已经安装了:

  • onnx
  • onnxruntime
  • onnxsim

如果需要手动安装:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ python3 -m pip install onnx onnxruntime onnxsim

3.4 导出 ONNX

默认导出新训练结果:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ ./scripts/export_onnx_linux.sh

指定权重和输入尺寸:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ IMG_SIZE=96 OPSET=12 \
  ./scripts/export_onnx_linux.sh \
  outputs/train/exp_target_96/weights/best.pt

等价 yolo v5原生命令:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ python vendor/yolov5/export.py \
  --weights outputs/train/exp_ls2k/weights/best.pt \
  --include onnx \
  --opset 12 \
  --imgsz 64

导出后会在 best.pt 同级目录生成:

best.onnx

注意:导出时的 --imgsz 必须与训练时一致。

3.5 使用演示 ONNX

如果只是验证官方演示模型,可以直接使用:

models/demo/best.onnx

3.6 模型测试与上车验证

模型训练完成后,不建议直接上车。建议按以下顺序测试:

训练机图片测试 -> 导出 ONNX -> 龙芯平台离线推理测试 -> 智能车实车测试
3.6.1 训练机图片测试

先用训练得到的 best.pt 在本机跑图片检测,确认类别和框位置基本正确:

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ python3 vendor/yolov5/detect.py \
  --weights outputs/train/exp_ls2k/weights/best.pt \
  --source dataset/images/val \
  --data configs/target_board.yaml \
  --imgsz 64 \
  --conf-thres 0.25 \
  --project outputs/detect \
  --name exp_ls2k_val

检测结果会保存到:

outputs/detect/exp_ls2k_val/

重点检查:

  • 类别是否识别正确;
  • 目标框是否覆盖目标板主体;
  • 背景干扰是否产生明显误检;
  • 远距离、小目标、强光和运动模糊图片是否仍能识别。
3.6.2 导出并检查 ONNX

本机图片测试通过后,再导出 ONNX

zhengyang@ubuntu:/opt/2k0300/loongson_2k300_lib/tb_yolo$ ./scripts/export_onnx_linux.sh \
  outputs/train/exp_ls2k/weights/best.pt

随后使用 Netron 检查模型输入输出,确认:

输入尺寸与训练 imgsz 一致
输出节点名通常为 output0
输出最后一维等于 类别数 + 5
3.6.3 龙芯平台离线推理测试

将导出的模型复制到智能车或龙芯开发环境中,例如:

outputs/train/exp_ls2k/weights/best.onnx

然后在官方 OpenCV DNN 推理工程中同步类别数量、类别名称、输出长度和输出节点名。关键修改项见第四章 4.2 龙芯 OpenCV DNN 推理工程适配

建议先用保存的摄像头图片或测试图片做离线推理,不要直接跑车:

输入:单张目标板图片或录制视频帧
输出:类别、置信度、目标框坐标
判断:结果是否与训练机 detect.py 输出趋势一致
3.6.4 智能车实车测试

离线推理稳定后,再接入智能车主程序。实车测试建议分阶段进行:

  • 静态测试:目标板固定不动,检查识别类别和置信度;
  • 低速测试:车模低速接近目标板,检查连续帧识别是否稳定;
  • 策略测试:确认不同类别目标板能触发正确通行策略;
  • 干扰测试:加入光照变化、背景干扰、角度变化和运动模糊。

如果实车误检或漏检明显,优先补充对应场景的数据重新训练,再调整置信度阈值和输入尺寸。

四、部署与常见问题

4.1 使用 Netron 检查模型

导出后建议用 Netron 打开 best.onnx,确认输入输出:

输入节点:images
输入尺寸:float32[1,3,64,64] 或 float32[1,3,96,96]
输出节点:output0
输出维度:float32[1,N,classes + 5]

示例:如果类别数为 5,则最后一维应为:

5 + 5 = 10

4.2 龙芯 OpenCV DNN 推理工程适配

详细说明见:

docs/deploy_opencv_dnn.md

在官方模板类似 Libraries/Driver/LQ_YOLO.cpp 的位置,需要同步:

Category_NUM = 实际类别数量
DATA_LEN = Category_NUM + 5
类别名称数组 = 按 configs/target_board.names 顺序填写
conf = 置信度阈值
out_name = Netron 中看到的输出节点名,常见为 output0

部署文件至少包括:

best.onnx
类别名称表
推理可执行程序

4.4 类别顺序不一致

以此文件为准:

configs/target_board.names

LabelImgclasses.txtyolo v5 yaml、龙芯推理代码中的类别数组都要按同一顺序。

4.5 图片和标签对不上

检查每张图片是否有同名标签:

images/train/0001.jpg
labels/train/0001.txt

如果图片没有目标,也建议保留空的 .txt 标签文件。

4.6 OpenCV DNN 输出维度不匹配

检查:

target_board.names 类别数量
target_board.yaml names 数量
推理代码 DATA_LEN 是否等于 类别数 + 5
Netron 中输出节点名是否为 output0