医疗大模型在患者服务中的多轮对话共情能力与导诊准确性.docx

医疗大模型在患者服务中的多轮对话共情能力与导诊准确性.docx

PAGE2

医疗大模型在患者服务中的多轮对话共情能力与导诊准确性竞争分析报告

摘要

本报告聚焦医疗大模型在预问诊与分诊场景下的核心能力竞争,选取GPT-4、Claude3、Med-PaLM2、华佗GPT、扁鹊大模型五款代表性基座模型,围绕语气拟人化程度、关键症状追问能力及科室推荐准确率三大维度展开深度对比。

核心发现表明,Med-PaLM2在科室推荐准确率上以89.7%领先,但语气拟人化评分仅7.2/10,存在“专业但冰冷”的体验短板。华佗GPT在中文医疗场景中追问逻辑最为缜密,症状覆盖率达93.5%,但罕见病识别能力不足。GPT-4凭借强大的通用推理能力,在共情维度以8.8/10

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档