军事护理

北大核心,JST,CSCD,WJCI,

国内刊号:31-2186/R

国际刊号:2097-1826

军事护理杂志2026年第2期:中文大语言模型在乳腺癌相关淋巴水肿护理问答中的性能比较

发布日期:

作者:沈傲梅,李温荣,武佩佩,文翠菊,刘飞,张紫娟,弓政,汪秦羽,杨盼,胡倩,强万敏,路潜

单位:天津医科大学肿瘤医院 护理部,天津 300000,首都医科大学附属北京世纪坛医院 淋巴外科,北京 100038,天津医科大学肿瘤医院 护理部,天津 300000,北京大学肿瘤医院暨北京市肿瘤防治研究所 乳腺癌预防治疗中心,北京 100142,北京大学第一医院 护理部,北京 100034,北京大学 护理学院,北京 100191,北京大学 护理学院,北京 100191,北京大学 护理学院,北京 100191,北京大学 护理学院,北京 100191,北京大学 护理学院,北京 100191,天津医科大学肿瘤医院 护理部,天津 300000,北京大学 护理学院,北京 100191

关键词:大语言模型;乳腺癌;淋巴水肿;整体质量;全面性;准确性

基金:国家自然科学基金面上项目(72174011);天津市医学重点学科(专科)建设项目(TJYXZDXK 011A)

目的 评价国内5种中文大语言模型(large language models,LLMs)在乳腺癌相关淋巴水肿常见问题问答中的综合表现,为其应用及优化提供依据。方法 基于LLMs、小组讨论和专家意见确定100个乳腺癌相关淋巴水肿的常见问题,分别由3名护理硕士生将问题输入5种LLMs模拟咨询,邀请5位专家从整体质量、准确性、全面性方面评估模型表现,以字符数评价应答的简洁性,分析模型的性能表现。采用组内相关系数(intraclass correlation coefficient,ICC)评价专家间一致性。结果 5位专家评价者间一致性中等( ICC =0.594)。5种LLMs综合表现均较好,“豆包”的整体质量和准确性评分均高于其他模型,差异有统计学意义(均 P <0.05);“豆包”与“通义千问”的全面性评分差异无统计学意义( P >0.05);二者评分均高于其他模型,差异有统计学意义(均 P <0.05);“DeepSeek”和“文心一言”的字符数低于其他模型,差异均有统计学意义(均 P <0.05)。结论 以“豆包”为代表的LLMs在乳腺癌患者淋巴水肿相关护理问答的模拟咨询场景中显示出应用潜力,可进一步评价其在乳腺癌相关淋巴水肿预防管理中的应用效果。

来源:2026年第2期

《军事护理》期刊编辑部

查看军事护理杂志2026年第2期

联系我们

  • 电话:021-81871496
  • E-mail:jfjhlzzbjb@vip.163.com

咨询工作人员