4.6 深度学习在计算机视觉中的应用.pptxVIP

  • 1
  • 0
  • 约3.64千字
  • 约 20页
  • 2026-09-29 发布于山东
  • 举报

人工智能通识课·第四章深度学习机器如何看懂图像?从分类到生成的视觉智能演进4.6节深度学习在计算机视觉中的应用4.6

学习目标学完本节,你能回答哪些问题?01能说出CNN从边缘、纹理到物体形状的特征提取层次02能区分图像分类、目标检测、图像分割三类任务的输出差异03能比较FasterRCNN与YOLO在精度与速度上的取舍04能解释GAN中生成器与判别器如何通过对抗以假乱真05能指出每类视觉任务在极端天气、标注成本等方面的真实局限

学习路线视觉任务的难度,为什么是逐级递增的?图像分类输入:一张图输出:一个类别标签目标检测输入:一张图输出:位置框+类别图像分割输入:一张图输出:逐像素类别图像生成输入:噪声或文字提示输出:一张全新的、逼真的图像路线判断:从贴一个标签到框出物体,再到逐像素理解,最后到凭空创造,任务粒度越来越细,对模型能力的要求也越来越高。

本节驱动问题为什么深度学习能自动看懂图像,而传统方法要手工设计特征?困惑锚点你可能以为机器识别猫是靠人写的一条条规则,但它其实从未被告诉猫有尖耳朵——它是从百万张像素中自己总结出规律的。这个自动提取特征的能力,正是深度学习颠覆传统视觉的关键。

图像分类·核心机制CNN是如何从像素中逐级读懂图像的?原始像素纯数字矩阵,机器原始输入低层:边缘纹理卷积提取边缘、纹理中层:物体部件组合边缘形成眼睛、轮子高层:

文档评论(0)

1亿VIP精品文档

相关文档