汽车行业深度报告:AI系列深度26期,云端基座模型如何在毫秒级车端跑起来.docx

汽车行业深度报告:AI系列深度26期,云端基座模型如何在毫秒级车端跑起来.docx

TOC\o1-1\h\z\u缩放定律与车端约束:训练最优不等于部署最优 4

云端效率优化:稀疏化、注意力优化与Token剪枝 6

车端部署优化:蒸馏上车与快慢双系统 8

结论:云端探上限,车端保实时 10

风险提示 10

图1:主流车端AI算力平台峰值算力对比 5

图2:智驾大模型车端推理帧率对比 5

图3:云端MoE基座模型总参数与激活参数对比,含车端蒸馏规模 6

表1:云端/车端时延压缩代表性方法一览 8

表2:代表性厂商的“云端基座—车端部署”路径 9

缩放定律与车端约束:训练最优不等于部署最优

经典缩放定律以给定训练算力下

文档评论(0)

1亿VIP精品文档

相关文档