零样本多模态大语言模型vs.监督式深度学习:一项基于CT的颅内出血分型对比分析
Zero-shot multi-modal large language models v.s.supervised deep learning:A comparative analysis on CT-based intracranial hemorrhage subtyping
摘要目的:在无对比剂CT(non-contrast CT,NCCT)上准确识别颅内出血(intracranial hemorrhage,ICH)亚型对于预后评估和治疗决策至关重要,但由于图像对比度低、边界模糊,这一任务仍具挑战性.本研究旨在评估多模态大语言模型(multi-modal large lan-guage models,MLLMs)与传统深度学习方法在ICH检测及分型中的零样本性能.方法:我们使用了来自RSNA数据集的192例NCCT影像数据,将GPT-4o、Gemini 2.0 Flash、Claude 3.5 Sonnet V2等MLLMs与ResNet50、Vision Transformer等传统深度学习模型进行比较.通过提示词引导MLLMs完成是否存在ICH、出血亚型判断、病灶定位以及体积估算等任务.结果:在ICH检测和分型两方面,传统深度学习模型的表现均优于MLLMs.特别是在分型任务中,MLLMs准确率较低,其中表现最佳的Gemini 2.0 Flash仅达到0.41的宏平均精确率(macro-averaged precision)和0.31的F1分数.结论:尽管MLLMs可通过自然语言交互提升可解释性,但在ICH亚型识别的准确性方面仍逊于深度学习网络.未来需进一步优化,以增强其在三维医学影像分析中的实用价值.
更多相关知识
- 浏览0
- 被引0
- 下载0

相似文献
- 中文期刊
- 外文期刊
- 学位论文
- 会议论文


换一批



