惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
腾讯CDC
博客园 - Franky
S
SegmentFault 最新的问题
美团技术团队
阮一峰的网络日志
阮一峰的网络日志
J
Java Code Geeks
Y
Y Combinator Blog
Engineering at Meta
Engineering at Meta
Microsoft Security Blog
Microsoft Security Blog
MongoDB | Blog
MongoDB | Blog
I
InfoQ
T
Tailwind CSS Blog
Hugging Face - Blog
Hugging Face - Blog
B
Blog RSS Feed
博客园 - 叶小钗
博客园_首页
有赞技术团队
有赞技术团队
雷峰网
雷峰网
量子位
小众软件
小众软件
月光博客
月光博客
U
Unit 42
D
DataBreaches.Net

又见苍岚

COLMAP PatchMatch Stereo 算法详解 事件驱动的状态机框架:从理论到工程实践 Git 在国内网络环境下无法 Push 的排查与修复 —— 配置 Clash 代理 分段五次多项式插值原理详解 路径插值方法深度对比研究 Claude Code 使用指南 OpenClaw 记忆管理与技能创建指南 CBS(Conflict-Based Search)算法详解 A* 算法及其变种详解 OpenClaw 配置多 Agents Windows Powershell 无法加载文件,因为在此系统上禁止运行脚本问题的解决方案 MaxClaw 安装流程 大模型 AI 名词介绍 AList 网盘聚合工具简介 Protobuf 简介与测试 Claude Code 简介以及 GLM 4.7 模型接入 Github 歌词下载工具 163MusicLyrics Python __getattr__ 懒加载 Python TypedDict 机器人仿真平台 Gazebo 安装记录 机器人仿真平台 Gazebo 简介 多机器人路径规划问题(Multi-Agent Path Finding, MAPF)简介 Python exifread 读取修改过的 jpeg 信息错误问题修复 3D 坐标系变换的理解 3D 旋转矩阵基本概念 MongoDB Compass 介绍 Python 环境管理工具 uv Flutter 开发指南 Snipaste 安装下载与黑屏问题解决方案 全局路径规划算法记录
Online Hard Example Mining(OHEM)
Yiwei Zhang · 2023-12-15 · via 又见苍岚

Online Hard Example Mining(OHEM)是一种在深度学习目标检测和分类任务中用于样本挖掘和损失加权的技术。它的主要目标是帮助模型更好地处理难以分类的样本,提高模型的性能。本文记录相关内容。

OHEM

在传统的随机采样训练中,每个训练批次都从数据集中随机选择样本,包括容易分类的样本和难以分类的样本。这可能导致模型过度关注容易分类的样本,而对难以分类的样本不够关注,从而降低了性能。Online Hard Example Mining 试图解决这个问题,其核心思想如下:

  1. 挖掘困难样本:在每个训练批次中,OHEM 首先使用当前模型对数据集中的所有样本进行前向传播,并计算每个样本的损失值。然后,它会选择那些损失值最高的一部分样本,通常是那些难以分类的样本,作为训练批次的一部分。
  2. 损失加权(可选):OHEM 不仅仅选择困难样本,还将这些样本的损失值进行加权,以确保模型更多地关注难以分类的样本。这意味着在反向传播过程中,困难样本的梯度对模型参数的更新具有更大的影响。

OHEM 的优点是可以帮助模型集中精力处理难以分类的样本,从而提高模型的性能,特别是在高度不平衡的数据集中。它在目标检测、图像分类和语义分割等任务中得到广泛应用。

为什么要 Hard Mining

  1. 减少fg和bg的ratio,而且不需要人为设计这个ratio;

  2. 加速收敛,减少显存需要这些硬件的条件依赖;

  3. hard mining已经证实了是一种booststrapping的方式, 尤其当数据集较大而且较难的时候;

  4. 通过自动选择困难示例,消除了常用的几种启发式方法和超参数,从而简化了训练。

    放宽了定义negative example的bg_lo threshold,即从[0.1, 0.5)变化到[0, 0.5)。取消了正负样本在mini-batch里的ratio(原Fast-RCNN的ratio为1:3)。

算法优点

  1. 对于数据的类别不平衡问题不需要采用设置正负样本比例的方式来解决,这种在线选择方式针对性更强;
  2. 随着数据集的增大,算法的提升更加明显(作者是通过在COCO数据集上做实验和VOC数据集做对比,因为前者的数据集更大,而且提升更明显,所以有这个结论);

参考资料

文章链接:
https://www.zywvvd.com/notes/study/deep-learning/tricks/OHEM/OHEM/