数据增强及其在机器学习中的重要性-电子发烧友网

数据的数量和变化对于大多数 ML 模型（例如深度学习神经网络模型）的性能非常重要。因此，神经网络模型的训练需要一个非常大的数据集。只有它才能达到生产就绪模型中预期的精度。

假设您有少量可用的数据集，不足以训练模型，并且您不知道如何生成具有所需数据变体的足够数据集。这正是“数据增强”有助于实现的目标。

什么是数据增强？

数据增强是一种通过向现有数据集添加某些变体并将其添加到原始数据集以生成“略微修改和乘法”数据来人为增加数据集体积的技术。您可以获取数据集中的所有可用样本，并以不同的方式对其进行多次修改，以获得更大的数据集。

数据集在模型训练中的重要性

机器学习管道的第一阶段是生成或获取用于训练机器学习模型所需的数据集。机器学习模型足够智能，可以识别训练的对象。但是，如果他们不是培训的一部分，他们就不那么聪明，无法处理不同的场景。

例如，如果训练模型时所有训练图像仅在一个特定方向上对齐，则它可能无法识别水平和/或垂直翻转图像中的对象。这样做的原因是它产生的特征与它在训练期间学习的特征不同，即使它们属于同一个对象。

在大多数情况下，高质量数据的可用性始终是一个大问题。它可能少量可用，也可能根本不可用。在这种情况下，收集足以达到所需精度的数据集将是一个挑战。如果数据集的数量不足或变化程度不高，则可能导致拟合不足或过度拟合。

为什么数据增强很重要？

在机器学习模型中，收集和标记数据是一个繁琐且成本高昂的过程。数据增强可以转换为数据集，帮助组织降低运营成本。同时，它解决了数据集大小有限和数据变化有限的问题。这提高了模型在各种方案中的整体性能。

它是如何工作的？

根据数据集的类型，可以使用不同的数据增强技术。有许多数据增强技术可用于图像/视频、音频和文本数据。我们将详细探讨图像/视频数据增强方法。

图像/视频中的数据增强技术

图像/视频将 RGB 信息存储在 2D 数组中。主要的数据增强技术可能是改变图像的方向、改变图像的分辨率/大小以及改变 RGB（像素）值。

这些选项的不同组合可以导致更多的增强方法。imgaug库提供了许多不同的图像数据增强选项，如下所示。

算术：-此类操作更改整个图像或其某些部分的像素值。加法和乘法选项将像素值相加和相乘一个随机数（在预定义范围内生成）。对于所有像素，此数字可能相同，对于相邻像素，此数字可能不同。有一些选项可以将随机像素或像素簇设置为常量值。类似的选项是为整个图像添加某些噪点。此外，还可以反转像素值

艺术的：-此类别提供了将图像样式转换为卡通图像的选项

模糊：-此类别提供了不同的选项来模糊图像内容。可能的选项是GaussianBlur，AverageBlur，MedianBlur，BilateralBlur，MotionBlur，MeanShiftBlur

颜色：-此类操作针对色彩空间、亮度、色调和饱和度。色彩空间选项的一个示例是将 RGB 转换为 HSV，然后将随机值（每个图像均匀采样）添加到 Hue 通道，并转换回 RGB。有一些选项可以对亮度、饱和度和色调执行加法和乘法运算。

反差：-此类操作专用于对比度处理。可用选项包括伽马对比度、Sigmoid 对比度、对数对比度、线性对比度

卷积：-顾名思义，此类操作与具有预定义矩阵值的卷积图像有关。它提供了更改清晰度、添加浮雕效果和检测图像边缘的选项

空翻：-这是一个广泛使用的选项，它具有水平和/或垂直翻转图像的选项

几何：-此类操作可以缩放图像（如放大和缩小），移动图像（水平和/或垂直）并向图像的另一端添加填充，以及旋转图像

Imgcorruptlike：-此类选项会向图像添加不同的噪点，例如高斯噪点、散粒噪点、脉冲噪点、散斑噪点。它还提供不同的图像模糊选项，如高斯模糊、玻璃模糊、散焦模糊、运动模糊、缩放模糊。此外，还可以应用雾、霜、雪和飞溅效果

大小：-此类别的选项执行与图像大小相关的操作。可以根据特定的高度和宽度或调整大小的百分比调整图像大小。图像的裁剪和填充可以应用于图像的特定大小

图像数据增强通过生成所需级别的数据集，无疑提高了模型的准确性。

审核编辑：郭婷

声明：本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人，不代表电子发烧友网立场。文章及其配图仅供工程师学习之用，如有内容侵权或者其他违规问题，请联系本站处理。举报投诉

神经网络

神经网络

+关注

关注
42

文章
4799

浏览量
102493
机器学习

机器学习

+关注

关注
66

文章
8482

浏览量
133938
深度学习

深度学习

+关注

关注
73

文章
5550

浏览量
122378

林超文PCB设计：PADS教程，PADS视频教程	郑振宇老师：Altium Designer教程，Altium Designer视频教程
张飞实战电子视频教程	朱有鹏老师：海思HI3518e教程，HI3518e视频教程
李增老师：信号完整性教程，高速电路仿真教程	华为鸿蒙系统教程，HarmonyOS视频教程
赛盛：EMC设计教程，EMC视频教程	杜洋老师：STM32教程，STM32视频教程
唐佐林：c语言基础教程，c语言基础视频教程	张飞：BUCK电源教程，BUCK电源视频教程
正点原子：FPGA教程，FPGA视频教程	韦东山老师：嵌入式教程，嵌入式视频教程
张先凤老师：C语言基础视频教程	许孝刚老师：Modbus通讯视频教程
王振涛老师：NB-IoT开发视频教程	Mill老师：FPGA教程，Zynq视频教程
C语言视频教程	RK3566芯片资料合集
朱有鹏老师：U-Boot源码分析视频教程	开源硬件专题

搜索历史

数据增强及其在机器学习中的重要性

评论

X-NUCLEO-53L4A2: VL53L4CX飞行时间传感器具测量扩展板

ATA-2022H高压放大器西安安泰电子双通道

按摩仪方案PCBA设计

MK17系列干簧传感器

鸿诚志远RK系列行业主板套件

合众恒跃

39

下载

大大通

90

下载

斯丹麦德电子

35

下载

斯丹麦德电子

58

下载

RA生态工作室

194

下载

48V高效降压电源方案：英诺赛科推出2kW四相交错设计

TurMass™ 时隙高并发解决方案

低功耗×低抖动×多封装：FCom富士晶振FCO-PJ系列时钟方案解析

高效能电动工具控制方案：基于STM32G473和STDRIVE101的参考设计

适配1.8V/2.5V/3.3V电压的高稳定晶振方案（含MCU推荐）

搜索历史

数据增强及其在机器学习中的重要性

评论

有几种电平转换电路，适用于不同的场景

瑞萨RA8系列教程 | 基于 RASC 生成 Keil 工程

共赴之约 | 第二十七届中国北京国际科技产业博览会圆满落幕

道生物联与巍泰技术联合发布 RTK 无线定位系统：TurMass™ 技术与厘米级高精度定位的深度融合

智能家居中的清凉“智”选，310V无刷吊扇驱动方案--其利天下

电源入口处防反接电路-汽车电子硬件电路设计

半导体芯片需要做哪些测试

解决方案 | 芯佰微赋能示波器：高速ADC、USB控制器和RS232芯片——高性能示波器的秘密武器！

硬件设计基础----运算放大器

ElfBoard技术贴|如何调整eMMC存储分区

米尔基于MYD-YG2LX系统启动时间优化应用笔记

运放技术——基本电路分析

飞凌嵌入式携手中移物联，谱写全国产化方案新生态

ATA-2022B高压放大器在螺栓松动检测中的应用

MOS管驱动电路——电机干扰与防护处理