本文已被:浏览 572次 下载 71次
中文摘要: 目的:比较分析六种大语言模型在医院感染知识问答中的表现,为进一步研究和应用提供参考。方法:构建涵盖基本概念、清洁与消毒、隔离、职业暴露、医院感染诊断和开放式问题的非现实问答数据集,选取豆包、讯飞星火、Kimi、DeepSeekR1、文心一言3.5和通义千问2.5六种大语言模型,采用盲法和李克特量表评估大语言模型的准确性和完整性。结果:大语言模型在医院感染知识问答中表现出色,准确率94.20%,完整率92.03%。不同大语言模型之间准确率(χ2=11.64,P < 0.05)和完整率(χ2=15.43,P < 0.05)均存在差异。DeepSeekR1和Kimi相对表现较好,讯飞星火稍显不足。在“开放式题目”问答中表现较好,不仅回答准确,且能够提供额外的超出预期的内容。而在“清洁与消毒”“职业暴露”准确性,“医院感染诊断”“清洁与消毒”完整性方面相对欠缺。结论:大语言模型在医院感染知识问答中具备应用潜力。未来应进一步研究和应用大语言模型赋能医院感染防控。
Abstract:
keywords:
文章编号: 中图分类号: 文献标志码:
基金项目:江苏省普通高校自然科学研究计划项目(23KJD 520012) 江苏省普通高校自然科学研究计划项目(23KJD 520012)
引用文本:
朱铁林,李金海,张鹏翔*.运用大语言模型进行医院感染知识问答的研究△[J].江苏卫生事业管理,2026,37(1):70-74.
.[J].Jiangsu Health System Management,2026,37(1):70-74.
朱铁林,李金海,张鹏翔*.运用大语言模型进行医院感染知识问答的研究△[J].江苏卫生事业管理,2026,37(1):70-74.
.[J].Jiangsu Health System Management,2026,37(1):70-74.


