生成式人工智能模型在回答慢性肾脏病相关问题中的性能评价
Performance evaluation of generative artificial intelligence model in responding to chronic kidney disease-related queries
摘要目的 评估中文生成式人工智能(GAI)模型(DeepSeek-R1)回答慢性肾脏病相关问题的准确性与可靠性,为优化患者教育策略提供依据.方法 回顾来自社交媒体平台、互联网以及门诊患者自述的与慢性肾脏病相关的常见问题.采用DeepSeek-R1模型回答问题,由3名资深肾内科医生按五级评分体系(1~5分)评估答案,并测试模型回答的可重复性.结果 对101个关于慢性肾脏病的常见问题进行检查,最终纳入70个问题.其中60个问题回答完全准确得1分,答案为完全不准确的发生率为0;5个问题回答准确但不全面得2分;4个问题得3分;1个问题得4分.重复问题的答案相似率在86%~100%之间.结论 中文GAI模型对慢性肾脏病相关的问诊提供了较为准确的应答,且具有较高的可重复性.
更多相关知识
- 浏览0
- 被引0
- 下载0

相似文献
- 中文期刊
- 外文期刊
- 学位论文
- 会议论文


换一批



