- 0
- 0
- 约23.61万字
- 约 58页
- 2026-09-17 发布于北京
- 举报
于ICLR
2023会议集
什么学习算法实现了上下文学习?基于线性模型的研究
¨
E金·阿基乌雷克,,戴尔·舒曼斯雅各布·安德鲁斯腾宇马,,丹尼·周
谷歌
麻省理工学院CSAIL
斯坦福大学
联合指导
神经序列模型,尤其是Transformer,展现出了惊人的上下文学习能力。它们
可以从输入中的标记示例序列(,())构建新的预测器,而无需进
3一步更新参数。我们探讨了Transformer基的上下文学习者通过在其激活中编
2
0码较小的模型,并在新示例出现在上下文中时更新这些隐式模型来实现学
2
您可能关注的文档
最近下载
- T-B0101-201-2017 工程监理资料管理标准化指南(房屋建筑工程)(北京).docx VIP
- 园艺学论文(南宁市花-朱瑾).doc VIP
- 综合实践欣赏密铺作品(课件)2026秋北师大版五年级数学上册.pptx
- 船用人孔盖.pdf VIP
- 国务院国资委安全生产“十条硬措施”解读.pptx VIP
- EN 50549-10_2022 中文版(光伏并网逆变器 电网支撑功能要求与测试 欧盟并网新规).docx VIP
- 华西口腔考研真题及答案.doc VIP
- ISO 14001_2026新版标准深度解析.pptx VIP
- (高清版)B-T 20138-2023 电器设备外壳对外界机械碰撞的防护等级(IK代码).pdf VIP
- 中国消化内镜活检与病理学检查规范专家共识草案-胃肠病学.pdf VIP
原创力文档

文档评论(0)