掌握卷积神经网络的核心知识
发布时间
阅读量:
阅读量
此前,我对计算机神经网络及梯度下降的基本原理进行了归纳整理,具体内容可参考下方提供的链接:
一文看懂计算机神经网络与梯度下降
本部分内容将着重针对图像处理领域中具有关键地位的机器学习模型——卷积神经网络,进行个人层面的解析与探讨。
1. 为什么要使用卷积神经网络
在阐述相关原理之前,有必要先说明为何在图像与视频等领域的机器学习任务中会采用CNN结构。众所周知,借助具有隐藏层的多层感知器所构建的深度神经网络,能够有效应对分类、聚合以及回归等各类问题。然而,当输入输出数据从低维转换为高维形式,例如图像数据时,便不可避免地面临神经元数量过多、参数规模庞大的挑战。以一张尺寸为720*480的图像作为输入为例,仅单张图片所对应的参数数量就已高达345600个。如果仅仅将这些数据压缩成一维向量,并继续使用全连接神经网络进行处理,则势必会造成计算成本显著上升、模型运行效率下降的问题,显然这并不符合实际需求。同样地,在处理图像时,尽管像素点的灰度值或RGB值可以类比于一维数据中的数值表现形式,但若将其转换为一维结构,则实际上忽略了图像本身的空间特性。这种做法会导致局部特征信息被遗漏,并可能因图像中微小的平移或旋转而引发结果发生剧烈变化,这是无法接受的情况。对于图像而言,不同位置上的物体所表达的内容应当保持一致性,也就是说应关注物体之间的相对位置关系而非绝对坐标位置。
全部评论 (0)
还没有任何评论哟~
