- 1、本文档共37页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
张君
昇腾生态技术专家
硕士毕业于厦门大学通信与信息系统专业,毕业后一直就职于华为公司。曾
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
在MR,Neurocomputing有数篇论文发表。作为核心开发者参与AI框架
(昇思)的开发,并负责动态图的自动微分以及动静结合模块。目前主要参与
大模型推理加速在昇腾硬件上的相关开发和优化工作,致力于通过优化推理
框架、模型算法和算子加速库等层面,进一步提升大模型推理的性能。
演讲主题:
大模型推理加速的优化实践
大模型推理加速的优化实践
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
昇腾生态技术专家张君
大模型推理的技术挑战
大模型推理加速技术发展现状
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
昇腾大模型推理框架MindIE-LLM加速实践
昇腾Transformer领域加速库ATB
总结与展望
PART1
2024全球机器学习技术大会(北京站)主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题,力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。
大模型推理的技术挑战
挑战一:计算和内存需求高
2020-20212022202320242025
20-06GPT322-11ChatGPT23-03GPT-423-11GPT-4Turbo24H1GPT-5(预计)
OpenAI175B稠密175B稠密2万亿稀疏长序列+多模态10万亿稀疏+多模态
您可能关注的文档
- AIGC模型的量化和稀疏优化-2024全球机器学习技术大会.pdf
- CUTLASS跨平台编译与优化-2024全球机器学习技术大会.pdf
- GPT社区探索GraphRAG未来架构-2024全球机器学习技术大会.pdf
- Infinity Instruct 合成指令技术的探索-2024全球机器学习技术大会.pdf
- Ktransformers:单卡完成千亿参数大模型推理任务-2024全球机器学习技术大会.pdf
- LLM在eBay风控RCA中的应用实践-2024全球机器学习技术大会.pdf
- OpenAI o1技术原理解析-2024全球机器学习技术大会.pdf
- RAG 2.0:记忆驱动的下一代检索增强系统-2024全球机器学习技术大会.pdf
- RAG关键技术及未来趋势发展-2024全球机器学习技术大会.pdf
- SORA高效低成本视频生成模型-2024全球机器学习技术大会.pdf
文档评论(0)