中文

ChatGPT 模型提供的糖尿病自我管理建议:挑战与建议

人工智能 2025-01-15 v1

摘要

鉴于其先进推理能力、广泛的上下文理解和稳健的问答能力,大语言模型已成为医疗管理研究的热门对象。尽管这些模型在处理广泛范围的医疗咨询方面表现出色,但在为慢性疾病如糖尿病提供准确且实用的建议时仍面临重大挑战。我们评估了 ChatGPT 3.5 和 4 版本对糖尿病患者查询的响应,评估其医学知识深度及其传递个性化、情境特定糖尿病自我管理建议的能力。我们的发现揭示了准确性和嵌入偏见之间的差异,凸显了除非通过复杂的提示技术,否则这些模型在提供量身定制建议方面的局限性。此外,我们观察到这两个模型经常在寻求必要澄清的情况下提供建议,这种做法可能导致危险的建议。这凸显了在临床环境中缺乏人工监督,这些模型的实际有效性有限。为解决这些问题,我们提出了一个用于提示评估的常识评估层,并通过采用先进的检索增强生成技术将疾病特定的外部记忆纳入其中。该方法旨在提高信息质量并减少误导风险,为医疗环境中的更可靠 AI 应用做出贡献。我们的发现旨在影响 AI 在医疗保健领域的未来方向,既提高其整合范围,又提升其质量。

关键词

引用

@article{arxiv.2501.07931,
  title  = {Advice for Diabetes Self-Management by ChatGPT Models: Challenges and Recommendations},
  author = {Waqar Hussain and John Grundy},
  journal= {arXiv preprint arXiv:2501.07931},
  year   = {2025}
}