当前位置:首页 > 智能硬件 > 人工智能AI
[导读] 为什么需要数据增强 : 一般而言,比较成功的神经网络需要大量的参数,许许多多的神经网路的参数都是数以百万计,而使得这些参数可以正确工作则需要大量的数据进行训练,而实际情况中数据并没有我们

为什么需要数据增强 :

一般而言,比较成功的神经网络需要大量的参数,许许多多的神经网路的参数都是数以百万计,而使得这些参数可以正确工作则需要大量的数据进行训练,而实际情况中数据并没有我们想象中的那么多

数据增强的作用 :

① 增加训练的数据量,提高模型的泛化能力

② 增加噪声数据,提升模型的鲁棒性

如何获得大量的数据 :

一种方法是获得新的数据,这种方法比较麻烦,需要大量的成本,而第二种方法则是对数据进行增强,即利用已有的数据比如翻转、平移或旋转,创造出更多的数据,来使得神经网络具有更好的泛化效果。

数据增强的分类 :

数据增强可以分为两类,一类是离线增强,一类是在线增强。

① 离线增强 : 直接对数据集进行处理,数据的数目会变成增强因子 x 原数据集的数目 ,这种方法常常用于数据集很小的时候

② 在线增强 : 这种增强的方法用于,获得 batch 数据之后,然后对这个 batch 的数据进行增强,如旋转、平移、翻折等相应的变化,由于有些数据集不能接受线性级别的增长,这种方法长用于大的数据集,很多机器学习框架已经支持了这种数据增强方式,并且可以使用 GPU 优化计算。

常用的数据增强技术 :

首先定义增强因子 : 指的是数据做离线增强之后增长的倍数。

① 翻转 :增强因子 2 或 3

数据翻转是一种常用的数据增强方法,这种方法不同于旋转 180 这种方法是做一种类似于镜面的翻折。

② 旋转 : 增强因子 2 到 4

旋转就是顺时针或者逆时针的旋转,注意在旋转的时候, 最好旋转 90 - 180 度否则会出现尺度的问题

③ 缩放 :增强因子任意

图像可以被放大或缩小。放大时,放大后的图像尺寸会大于原始尺寸。大多数图像处理架构会按照原始尺寸对放大后的图像 进行裁切。我们将在下一章节讨论图像缩小,因为图像缩小会减小图像尺寸,这使我们不得不对图像边界之外的东西做出假设。

下面是图像缩放的例子。

④ 裁剪 :增强因子任意

这种方法更流行的叫法是随机裁剪,我们随机从图像中选择一部分,然后降这部分图像裁剪出来,然后调整为原图像的大小

⑤ 平移 : 增强因子任意

平移是将图像沿着 x 或者 y 方向 (或者两个方向) 移动。我们在平移的时候需对背景进行假设,比如说假设为黑色等等,因为平移的时候有一部分图像是空的,由于图片中的物体可能出现在任意的位置,所以说平移增强方法十分有用。

⑥ 添加噪声 :增强因子任意 看噪声的类型

过拟合通常发生在神经网络学习高频特征的时候 (因为低频特征神经网络很容易就可以学到,而高频特征只有在最后的时候才可以学到) 而这些特征对于神经网络所做的任务可能没有帮助,而且会对低频特征产生影响,为了消除高频特征我们随机加入噪声数据来消除这些特征。

图像增强的效果 :

图像增强非常必要,我也有过亲自的实验,特别是有些论文中,如果不进行图片增强,就无法达到论文中提到的效果,下面展现一下图片增强的效果示意图 :

图中 :C10 和 C100 是没有经过图片增强的,C10+ 和 C100+ 是经过了图片增强的,意识到它的神奇的效果了吧 (图片增强应该不是玄学)。

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
换一批
延伸阅读

该实验室的创新技术能够增强人工智能边缘解决方案,提高神经网络能力

关键字: 人工智能 神经网络

机器学习将是下述内容的主要介绍对象,通过这篇文章,小编希望大家可以对机器学习的相关情况以及信息有所认识和了解,详细内容如下。

关键字: 机器学习 神经网络 支持向量机

在数字信号处理和通信系统中,编码器扮演着至关重要的角色。它负责将原始数据转换为字符序列或二进制码序列,以实现信息的有效传输和处理。而在编码器的众多组成部分中,BAT(电池)信号不仅提供了编码器运行的必要电源,还承载着多种...

关键字: 数字信号 编码器 BAT

深度学习需要大量的计算。它通常包含具有许多节点的神经网络,并且每个节点都有许多需要在学习过程中必须不断更新的连接。换句话说,神经网络的每一层都有成百上千个相同的人工神经元在执行相同的计算。

关键字: 机器学习 神经网络 TensorFlow

源测量单元(SMU)和脉冲测量单元(PMU)是泰克4200A-SCS的两个模块,其在时域中测量及提供电流和电压。SMU和PMU以恒定速率获得测量数据,使用Clarius软件内置的FFT功能将时域电流数据转换成频域中的参数...

关键字: 噪声 测试测量

人工神经网络(Artificial Neural Network,即ANN )是从信息处理角度对人脑神经元网络进行抽象,是20世纪80年代以来人工智能领域兴起的研究热点,其本质是一种运算模型,由大量的节点(或称神经元)之...

关键字: 人工智能 信号 神经网络

许多人工智能计算机系统的核心技术是人工神经网络(ANN),而这种网络的灵感来源于人类大脑中的生物结构。通过使用连接的“神经元”结构,这些网络可以通过“学习”并在没有人类参与的情况下处理和评估某些数据。神经网络提供了位于托...

关键字: 人工智能 神经网络 神经元

1956年,美国Dartmouth大学举办的一场研讨会中提出了人工智能这一概念。

关键字: 人工智能 吸尘器 神经网络

摘要:风门坳排涝站在机组更换电动机定子绕组后试运行过程中,通过检测发现机组运行噪声过大,导致无法通过验收。排查分析噪声产生的原因,通过试验发现是电动机与排风管之间采用刚性连接所致。将电动机与排风管的刚性连接方式改成柔性连...

关键字: 噪声 刚性连接 柔性连接

米尔 MYD-Y6ULX-V2 开发板,基于 NXP i.MX6UL/i.MX6ULL处理器,该开发板被米尔称之为经典王牌产品。本次测试目标是在此开发板上进行神经网络框架ncnn的移植与测试开发,测试ncnn在此开发板上...

关键字: 米尔电子 嵌入式 神经网络
关闭
关闭