- 2
- 0
- 约3.89千字
- 约 6页
- 2026-04-08 发布于山西
- 举报
AI编程:神经网络基础搭建与实操
神经网络基础搭建与实操
一、神经网络是什么:用一句话讲清本质
神经网络是一种受生物神经系统启发的数学建模方法,其核心是通过多层可学习的非线性变换,从原始输入数据中自动提取特征并完成预测或分类任务。它不是“黑箱魔法”,而是由权重、偏置、激活函数和损失函数共同构成的可微分计算图——这意味着我们能用梯度下降不断优化参数,让模型越学越准。
二、四大核心组件解析(零基础也能懂)
?1.神经元(Neuron)——最小计算单元
一个神经元=一次加权求和+一次非线性映射。
公式表达为:z=w?x?+w?x?+…+w?x?+b,再经激活函数输出:a=f(z)。
其中,w是权重(决定输入重要性),b是偏置(调节激活阈值),f是激活函数(引入非线性)。没有激活函数,再多层叠加也等价于单层线性变换——非线性是神经网络拟合复杂模式的根本前提。
?2.激活函数——赋予模型“思考能力”的开关
常用函数及选用逻辑:
-ReLU(RectifiedLinearUnit):f(x)=max(0,x)→计算快、缓解梯度消失,默认首选,适用于隐藏层;
-Sigmoid:f(x)=1/(1+e??)→输出压缩至(0,1),适合二分类输出层(可解释为概率);
-Softmax:将向量转换为概率分布→多分类输出层必备,确保所有类别输出和为1;
-Tanh:f(x)=(e??e??)/(e?+e
原创力文档

文档评论(0)