端侧大模型推理芯片架构对比:存内计算、存算一体与近存计算的路线之争.docxVIP

  • 0
  • 0
  • 约1.71万字
  • 约 22页
  • 2026-09-14 发布于北京
  • 举报

端侧大模型推理芯片架构对比:存内计算、存算一体与近存计算的路线之争.docx

PAGE2

端侧大模型推理芯片架构对比:存内计算、存算一体与近存计算的路线之争

摘要

本报告聚焦于半导体与底层硬件领域,深入分析面向端侧大模型推理的芯片架构之争,核心研究范围为存内计算、存算一体与近存计算三大技术路线及其在NPUIP设计中的实现。

随着大模型向智能手机、物联网终端、自动驾驶等边缘设备渗透,传统冯·诺依曼架构的“存储墙”与“功耗墙”瓶颈日益凸显。本报告发现,当前端侧推理芯片已形成三大路线:以数据搬运优化为核心的近存计算、以模拟/数字混合计算为核心的存内计算,以及追求完全融合的存算一体架构。国内外主要NPUIP厂商,如ARM、Imagination、寒武纪、地平线、九天睿芯等,在架构选择上出现显著分化。

核心结论如下:能效比方面,模拟存内计算具备数量级优势,但精度与量产可靠性仍是挑战;近存计算在编程易用性与生态成熟度上领先,是当前商业化主力;存算一体则处于理想与现实间的探索期。未来三年,近存计算仍将主导中高端手机与座舱SoC,而存内计算将在超低功耗传感器与可穿戴设备中率先规模化。市场格局尚未固化,架构之争本质是生态与落地速度的竞赛。报告最终建议芯片设计企业依据应用场景的功耗与实时性需求,采取多路线并行策略,并重点投资于软件工具链以降低编程门槛。

第一章行业概况与研究框架

1.1行业定义与分类

本报告所研究的行业为“端侧大模型推理芯片架构”,其核心定义是:在

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档