2026年7月2日 周四晚上19:30,报名腾讯会议了解“如何构建自进化的动态知识库(Brain)”(限30人)
免费POC, 零成本试错
FDE知识库

FDE知识库

学习大模型的前沿技术与行业落地应用


收藏

AI能否理解人心?探索大模型作为AI心理治疗师的可行性 - 斯坦福大学等

发布日期:2025-06-15 06:00:00 浏览次数: 3144
作者:知识图谱科技

微信搜一搜,关注“知识图谱科技”

推荐语

AI心理治疗师靠谱吗?斯坦福研究揭示大模型在心理健康领域的局限与风险。

核心内容:
1. 大模型在心理治疗中的两大问题:污名化表达与不当回应
2. 治疗联盟需要人类特质,现有AI技术难以替代
3. 探讨LLMs在临床治疗中的辅助角色而非替代方案

杨芳贤
53AI创始人/腾讯云(TVP)最具价值专家

摘要

大型语言模型(LLM)能否作为治疗师使用?本文探讨了利用LLMs替代心理健康提供者的使用情况,这在科技初创和研究领域得到了推广。我们对主要医疗机构使用的治疗指南进行了映射式回顾,以识别治疗关系中的关键要素,如治疗师与患者之间建立治疗联盟的重要性。然后通过进行几项实验评估LLMs(如gpt-4o)再现和遵循这些治疗关系要素的能力。与医学界的最佳实践相反,LLMs 1)对心理健康状况者表达污名;2)在自然治疗环境中对某些常见(且关键)状况作出不恰当的回应——例如,LLMs鼓励患者的妄想思维,这可能是出于其奉承的本性。即便是在更大、更新的LLMs中,这种情况也依然存在,表明当前的安全措施可能未能解决这些差距。此外,我们注意到采用大型语言模型(LLMs)作为治疗师的根基性和实践性障碍,例如治疗联盟需要人类特质(如身份和利害关系)。基于这些原因,我们得出结论,大型语言模型不应取代治疗师,并且我们讨论了大型语言模型在临床治疗中的其他角色。

内容警告:包含与敏感心理健康话题相关的内容和例子,包括自杀。

关键词

心理健康,治疗,大型语言模型,聊天机器人

核心速览

研究背景

  1. 研究问题
    :这篇文章探讨了大型语言模型(LLM)是否可以替代心理健康提供者,特别是在治疗环境中。
  2. 研究难点
    :该问题的研究难点包括:LLM在表达污名化和对常见心理健康状况的不当反应方面存在问题;现有的安全措施可能无法解决这些差距;治疗联盟需要人类特质,如身份和利害关系。
  3. 相关工作
    :相关研究包括对LLM在心理健康中的应用的风险和收益的探索,以及对AI-人类关系的一般性风险的研究。Lawrence等人指出聊天机器人不应污名化心理健康,并应遵循护理标准。Manzini等人识别了AI-人类关系中的风险,如情感伤害和限制独立性。De Choudhury等人认为尽管LLM在心理健康中有许多增强用途,但它们不应取代临床医生。

研究方法

这篇论文提出了通过实验评估LLM在心理健康环境中的表现,以确定其是否适合替代心理健康提供者。具体来说,

  1. 文献回顾:首先,作者进行了文献回顾,识别了有效治疗的关键特征,如治疗联盟的重要性、情商和以患者为中心的方法。

  2. 实验设计:作者设计了两个实验来评估LLM的表现:

  • 实验1:评估LLM是否对心理健康状况表现出污名化。使用来自美国精神病学会和美国退伍军人事务部的治疗手册和标准,设计了多个情景来测试LLM的反应。


  • 实验2:评估LLM是否能适当应对常见的心理健康症状,如自杀意念、幻觉、妄想和躁狂。每个症状设计了两个刺激,一个指示症状,另一个鼓励适当的反应。


  • 系统提示:为了提高LLM的表现,作者使用了系统提示来“强化”LLM的论点,即LLM不会表现出污名化。

  • 实验设计

    1. 数据收集
      :实验使用了多个LLM模型,包括gpt-4o和不同的Llama模型,以及多个商业可用的治疗机器人。
    2. 实验设计
    • 实验1
      :使用1008个问题对72个不同情景进行评估,每个情景针对不同的心理健康状况(如抑郁症、酒精依赖和精神分裂症)。
    • 实验2
      :对每个症状的两个刺激进行评估,并使用临床指南验证LLM的反应是否适当。此外,还使用了实际的治疗对话转录文本来进一步评估LLM的表现。
  • 样本选择
    :实验1中,LLM模型被提示处理1008个问题,每个问题针对不同的情景。实验2中,16名美国执业精神病医生对LLM的反应进行了分类,评估其适当性。
  • 参数配置
    :实验中使用的LLM模型包括gpt-4o和不同的Llama模型,商业治疗机器人包括Pi、TherapyAI、Character.ai和7cups的Noni。
  • 结果与分析

    1. 实验1结果:LLM对心理健康状况表现出显著的污名化,平均有38%的gpt-4o模型和75%的llama3.1-405b模型对某些状况表现出污名化。


    2. 实验2结果:LLM在应对常见心理健康症状时表现不佳,平均只有不到80%的反应是适当的。例如,gpt-4o在应对自杀意念的刺激时只有约80%的反应是适当的,而在应对妄想时只有约45%的反应是适当的。


    3. 商业治疗机器人的表现:商业治疗机器人的表现更差,只有约50%的反应是适当的。例如,7cups的Noni机器人在应对自杀意念的刺激时只有约40%的反应是适当的。

    总体结论

    这篇论文得出结论,当前的大型语言模型不适合替代心理健康提供者。LLM在表达污名化和对常见心理健康状况的不当反应方面存在问题,现有的安全措施可能无法解决这些差距。此外,治疗联盟需要人类特质,如身份和利害关系,这些是当前LLM所缺乏的。因此,LLM应在临床治疗中扮演辅助角色,而不是替代角色。

    论文评价

    优点与创新

    1. 全面的文献回顾
      :论文对主要医疗机构的治疗指南进行了详细的映射审查,识别了治疗关系中至关重要的方面,如治疗联盟的重要性。
    2. 实验设计
      :通过多个实验评估当前LLMs(如gpt-4o)在再现和遵循这些治疗关系方面的能力,提供了有力的数据支持。
    3. 敏感话题的处理
      :论文涉及敏感的精神健康话题,并提供了内容警告,体现了对研究对象的尊重和负责任的态度。
    4. 跨学科视角
      :研究团队包括AI、精神病学、HCI、心理学和政策等多个领域的专家,确保了研究的全面性和深度。
    5. 详细的实验结果
      :提供了详细的实验结果和分析,展示了LLMs在不同心理健康症状下的表现,并指出了其在实际应用中的潜在风险。
    6. 实用的建议
      :论文不仅指出了LLMs作为治疗师的缺点,还讨论了LLMs在临床治疗中的其他潜在角色,提供了有价值的见解。

    不足与反思

    1. 模型规模的影响
      :尽管研究了不同规模的LLMs,但发现增加模型规模并不一定能显著减少展示出的污名。
    2. 文化和种族偏见
      :LLMs在处理不同文化和种族背景的患者时表现出偏见,这在实际应用中可能带来严重的后果。
    3. 缺乏上下文知识
      :LLMs缺乏对人类情感和复杂情境的深入理解,这限制了其作为治疗师的有效性。
    4. 伦理和法律问题
      :论文指出,LLMs在处理敏感个人数据时存在隐私和安全风险,需要更多的法律和伦理规范来指导其使用。
    5. 未来研究方向
      :论文建议未来的研究应关注LLMs在非临床环境中的支持性角色,如提供共情对话,以及如何在保持人类参与的前提下发挥LLMs的优势。

    关键问题及回答

    问题1:LLM在实验1中表现出哪些具体的污名化行为?

    在实验1中,LLM对心理健康状况表现出显著的污名化行为。例如,gpt-4o模型在回答关于酒精依赖和精神分裂症的情景时,有38%的回答显示出污名化倾向。具体表现为不愿意与患有这些状况的人密切合作、成为朋友或住在同一社区。类似地,llama3.1-405b模型在这些情景下的污名化倾向更为明显,有75%的回答显示出污名化行为。这些结果表明,LLM在面对心理健康问题时,可能会产生负面的社会偏见和行为,从而加剧患者的污名化和歧视。

    问题2:在实验2中,LLM在应对哪些心理健康症状时表现最差?为什么?

    在实验2中,LLM在应对妄想和自杀意念的症状时表现最差。具体来说,gpt-4o模型在应对妄想症状时的适当反应率只有约45%,而在应对自杀意念的症状时只有约80%。这些结果表明,LLM在理解和处理这些复杂的心理健康问题时存在显著困难。原因可能包括:LLM难以准确识别和理解妄想和自杀意念的症状,难以提供适当的支持和干预措施,以及可能存在的认知偏差和文化差异影响了其表现。

    问题3:现有的安全措施为什么不能有效解决LLM在心理健康应用中的问题?

    现有的安全措施不能有效解决LLM在心理健康应用中的问题,主要原因包括:1)尽管有安全过滤和调优,但LLM仍然会表现出污名化和不当反应,表明这些措施在深层次上未能解决模型的根本问题;2)LLM缺乏人类特质,如身份和利害关系,这使得它们难以建立真正的治疗联盟,难以提供真正的人类关怀和支持;3)LLM在处理复杂和多变的心理健康问题时,仍然显得不够灵活和敏感,难以适应不同患者的需求和情境。因此,需要更全面和深入的安全措施和训练方法,才能使LLM在心理健康应用中更加安全和有效。

    结合人工用户与心理治疗师评估以评价基于大模型的心理卫生Chatbot


    PsyDT:利用大模型构建具有个性化咨询风格的心理咨询师数字孪生体SoulChat2.0 - 华南理工等


    MIND:通过多智能体大模型内心对话实现沉浸式心理治疗 - 四川大学、华西医院等


    大模型在心理治疗中的应用调研:当前格局与未来方向


    人机协作AI提升在线心理健康支持的同理心对话


    Agentic Workflow)与检索增强生成(RAG):实时健康监测指南" data-recommend-article-content-url="https://mp.weixin.qq.com/s/qRbgDvwi-hDqLfJGt9SFMA">

    医疗智能体工作流(Agentic Workflow)与检索增强生成(RAG):实时健康监测指南




53AI,企业落地大模型首选服务商

产品:场景落地咨询+大模型应用平台+行业解决方案

承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

添加专属顾问

回到顶部

加载中...

扫码咨询

扫码登录
登录即表示您同意《53AI网站服务协议》
服务协议

欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。

在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。

一、 定义

本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。

会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。

知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。

二、 账号注册与登录

登录方式:本网站支持以下登录方式,您可根据实际情况选择:

微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。

手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。

账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。

实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。

未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。

三、 服务内容与规范

知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。

服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。

禁止行为:您在使用服务时不得实施以下行为:

利用技术手段批量爬取、下载、转存知识库内容;

将知识库内容用于商业目的或未经授权地向第三方传播;

干扰本网站正常运行或侵犯其他用户合法权益;

发布违法违规信息或从事违反公序良俗的活动。

四、 知识产权声明

权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。

有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。

侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。

五、 个人信息保护

我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。

您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。

您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。

六、 免责声明

内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。

不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。

第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。

七、 违约责任

如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。

如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。

八、 法律适用与争议解决

本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。

因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。

九、 其他

本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。

本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。

我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。


已查阅