- 3
- 0
- 约3.36万字
- 约 48页
- 2026-04-21 发布于江西
- 举报
应用与开发指南
第1章基础概念与原理
1.1深度学习与神经网络架构
神经网络是模仿人脑神经元连接结构的计算模型,由输入层、隐藏层和输出层组成,通过多层非线性变换处理数据。在本节中,我们将构建一个包含4层(2个隐藏层)全连接神经网络的Python代码框架,输入维度设定为28x28像素的灰度图像,输出维度为10个类别(如MNIST手写数字分类),并配置批量大小(BatchSize)为32以优化内存效率。在代码实现中,我们需要定义卷积层(ConvolutionLayer)和池化层(PoolingLayer)。卷积层使用3x3的卷积核(KernelSize)在28x28图像上滑动提取特征,池化层采用最大池化(MaxPooling)将3x3窗口缩减为2x2,将网络深度从3层压缩至2层,从而减少计算量并提升泛化能力。
激活函数是神经网络的“门控”,用于引入非线性,否则网络将退化为一元线性回归。本节选用ReLU(RectifiedLinearUnit)函数作为隐藏层的核心激活函数,它输出值为输入值与零的较大者,能有效去除负值并加速梯度下降,同时保持计算效率。损失函数(LossFunction)用于衡量模型预测值与真实值之间的误差,指导网络调整参数。我们将使用交叉熵损失函数(Cross-EntropyLoss)来评
原创力文档

文档评论(0)