国产大语言模型对护理药理学知识理解与应用能力的测试评价
Evaluation of Domestic Large Language Models on the Comprehension and Application Ability of Nursing Pharmacology Knowledge
摘要目的 横向评估国产大语言模型对护理药理学知识的理解能力,探讨其教学应用潜力与风险.方法 从我院护理药理学课程题库中分层随机抽取500道试题(单项选择400道、多项选择100道),对DeepSeek、文心一言、豆包和Kimi进行3轮测试,评估其答题稳定性、一致性及准确率,并与高职护生群体进行对比.结果 4款模型3轮测试的答题准确率稳定(P>0.05),且显著高于护生(P<0.001).启用深度思考功能对总准确率无显著性影响(P>0.05),但扩大了模型间的差异.4款模型单项选择题答题准确率显著高于多项选择题答题准确率(P<0.001),在记忆类题目中的表现最佳,理解类与分析类次之,应用类最差.结论 国产大语言模型对护理药理学知识的理解较为准确,具备教学辅助应用潜力,未来需通过构建专属知识库、加强临床情景模拟,规避模型幻觉等风险,并提升师生批判性应用能力.
更多相关知识
- 浏览1
- 被引0
- 下载1

相似文献
- 中文期刊
- 外文期刊
- 学位论文
- 会议论文


换一批



