K-文化的一切——从回归到 K-美妆,发送到您的邮箱订阅邮件

METAL MEDIA

Large Language Models in Mental Health: A Systematic Review of Applications, Innovations, and Ethical Challenges

arXiv:2608.180802026-08-20

对92项研究的系统梳理发现,大语言模型在识别抑郁和自杀风险上进步明显,但真正的临床验证仍然不足

这是一篇系统综述,梳理了大语言模型(LLM)在心理健康领域的应用,涵盖社交媒体分析、治疗聊天机器人和临床决策辅助工具。作者按照PRISMA标准流程,从304篇候选论文中层层筛选,最终确定92篇高质量研究作为分析基础。结果显示,基于LLM的抑郁症和自杀倾向检测技术发展迅速,但临床验证、多模态数据整合和伦理保障仍然滞后。

METAL MEDIA 解读图

对92项研究的系统梳理发现,大语言模型在识别抑郁和自杀风险上进步明显,但真正的临床验证仍然不足

  1. 01梳理了LLM如何利用Twitter/Reddit帖子、电子病历(EMR)、咨询记录等数据,实现抑郁症早期发现、自杀风险评估、个性化治疗支持和心理健康科普内容生成
  2. 02在IEEE Xplore、ACM Digital Library、PubMed、Scopus、ScienceDirect、SpringerLink、Google Scholar七个学术数据库中检索到304篇论文,按纳入排除标准筛至115篇,再依据方法透明度和可复现性最终确定92篇
  3. 03比较了五种给心理健康数据打标签的方法,从专家人工标注、用户自我披露标注,到由LLM通过零样本或少样本提示直接完成标注
  4. 04记录了GPT-3.5、LLaMA2、MentaLLaMA等模型如何从单纯的抑郁症检测,扩展到治疗对话总结、治疗方案制定辅助以及与患者的直接对话互动
  5. 05指出可解释性(展示模型得出结论的依据)和提示工程(设计指令引导模型行为的技巧)是实际临床落地面临的核心难题
这是 METAL MEDIA 制作的解读图,并非论文作者提供的原图。

他们做了什么

  1. 梳理了LLM如何利用Twitter/Reddit帖子、电子病历(EMR)、咨询记录等数据,实现抑郁症早期发现、自杀风险评估、个性化治疗支持和心理健康科普内容生成
  2. 在IEEE Xplore、ACM Digital Library、PubMed、Scopus、ScienceDirect、SpringerLink、Google Scholar七个学术数据库中检索到304篇论文,按纳入排除标准筛至115篇,再依据方法透明度和可复现性最终确定92篇
  3. 比较了五种给心理健康数据打标签的方法,从专家人工标注、用户自我披露标注,到由LLM通过零样本或少样本提示直接完成标注
  4. 记录了GPT-3.5、LLaMA2、MentaLLaMA等模型如何从单纯的抑郁症检测,扩展到治疗对话总结、治疗方案制定辅助以及与患者的直接对话互动
  5. 指出可解释性(展示模型得出结论的依据)和提示工程(设计指令引导模型行为的技巧)是实际临床落地面临的核心难题

为什么重要

在心理健康专业人员短缺、就医门槛高的背景下,这篇综述清晰区分了哪些LLM应用已经过验证、哪些仍处于实验阶段,帮助开发者和临床医生判断技术的可信边界。它还揭示了隐私、偏见、责任归属等尚未解决的伦理问题,是任何想要部署这类工具的人都需要提前正视的。

本文术语

  • PRISMA · 一套用于保证系统性文献综述透明、可复现的国际标准流程
  • 零样本/少样本学习 · 模型在没有(零样本)或仅有极少(少样本)任务专属示例的情况下处理新任务的能力
  • 电子病历(EMR) · 记录患者诊断、治疗和病情进展的数字化医院档案
  • 可解释性 · AI系统展示其得出结论所依据的可理解推理过程的能力
  • PHQ-9 · 广泛使用的九项问卷,用于评估抑郁症严重程度

论文原文摘要(英文)

We present a review on the applications of large language models (LLMs) in health, e.g., social media analysis, clinical conversational agents, therapy support tools, prompt engineering, multimodal learning, and ethical considerations. We integrate findings from interdisciplinary studies utilizing diverse data sources such as social media posts, electronic medical records, and multimodal inputs to enable early detection of depression, suicide risk assessment, personalized therapy support, and psychoeducational content generation. Our review highlights advancements in LLM models and annotation strategies that enhance interpretability and clinical relevance, while we also emphasize the critical role of prompt engineering for domain adaptation. We also discuss emerging multimodal fusion techniques integrating text, speech, and sensor data for improved mental health diagnosis and monitoring. Finally, we address ongoing ethical, sociotechnical, and regulatory challenges, and advocate frameworks to ensure safe, equitable, and accountable deployment of LLMs in real-world mental health care.

作者 · Yisong Chen, Yifan Gao, Sijing Yu, Chuqing Zhao, Yang Lu

在 arXiv 阅读

最新论文

全部论文 →

METAL MEDIA 最新报道