基于大语言模型的常识推理中的思维链与自我一致性增强方法研究综述.docVIP

  • 1
  • 0
  • 约5.77千字
  • 约 7页
  • 2026-10-01 发布于江苏
  • 举报

基于大语言模型的常识推理中的思维链与自我一致性增强方法研究综述.doc

基于大语言模型的常识推理中的思维链与自我一致性增强方法研究综述

常识推理是人工智能领域长期追求的核心能力之一,要求模型在缺乏明确背景信息的前提下,利用人类普遍知晓的日常知识完成逻辑推导。近年来,大语言模型(LargeLanguageModel,LLM)凭借万亿级参数的知识存储能力与上下文学习能力,在常识问答、因果推断、社会常识判断等任务上实现了性能突破,但依然存在hallucination(幻觉)、逻辑链条断裂、多步推理一致性不足等问题。思维链(ChainofThought,CoT)与自我一致性(Self-Consistency,SC)作为两类代表性的推理增强技术,为解决上述痛点提供了可行路径,相关研究在近两年呈现爆发式增长,已经成为LLM常识推理方向的核心研究热点。

一、常识推理的任务特性与LLM的原生缺陷

常识推理与传统特定领域推理的核心差异在于其知识的开放性、逻辑的隐式性与场景的多样性。从任务类型划分,现有常识推理基准可分为四类:一是通用常识问答,如CommonsenseQA、ARC挑战集,要求模型回答包含日常物理、社会文化知识的问题;二是因果推理任务,如COPA、WinogradSchemaChallenge,需要识别事件之间的因果关联或指代关系;三是社会常识推理,如SocialIQA、MoralChoice,考察模型对人类社会规范、情绪动机的理解;四

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档