📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

AI Deep Dive: Can a Chatbot Be Your Therapist? w/ Dr. Nick Jacobson | Being Well

Forrest Hanson1:27:20

Transcription

您好,欢迎来到“身心健康”节目。我是福雷斯特·汉森。如果您是本节目的新听众,感谢您今天的收听。如果您以前听过,欢迎回来。

在过去一年左右的时间里,有两个故事日益交织在一起。第一个是您完全可以称之为美国心理健康服务可及性危机,数百万人在努力获得有效的治疗。第二个是生成式人工智能的迅速崛起。调查显示,居住在美国的人中约有一半使用像 ChatGPT 这样的大型语言模型。我可以告诉您,这个数字还在不断增长,人们越来越多地转向这些人工智能聊天机器人寻求心理健康支持。

三月份,仅在 TikTok 上就有超过 1612 万条关于使用 ChatGPT 作为治疗师的帖子。Common Sense Media 最近的一项调查发现,72% 的美国青少年使用过人工智能作为伴侣。这些以及类似的调查表明,人工智能聊天机器人可能已经是美国最大的心理健康服务提供者。远远大于任何医院网络、治疗应用程序或政府计划。

心理学界对这种崛起既感到兴奋,也感到不安。批评者担心这里的风险。嗯,会产生幻觉的聊天机器人,给出不安全的建议,人们对机器产生不健康的依恋,潜在的隐私泄露,人工智能精神病,以及缺乏明确的法律监督,这仅仅是其中的一部分。这还没有考虑到人工智能聊天机器人是否能进行有效治疗的简单问题。

这里有很多事情正在发生,今天我们将尝试理清它们。为了帮助我做到这一点,我邀请了两位嘉宾。首先,一如既往,临床心理学家兼我的父亲里克·汉森。那么,爸爸,您今天怎么样?

>> 我过得很好。而且这实际上是我本人,而不是模拟里克的虚拟形象。我们还没有里克的全息投影。未来是不确定的。我们拭目以待。嗯,为了帮助我们梳理人工智能的格局,我们请来了尼克·雅各布森博士。尼克是达特茅斯大学生物医学数据科学、精神病学和计算机科学的副教授,他负责那里的“人工智能与心理健康实验室”。他还是 Therabot 的开发者,Therabot 是一款生成式人工智能治疗聊天机器人,比 ChatGPT 早问世多年。他是首批进行测试人工智能治疗是否真的能帮助人们的试验的研究人员之一。

那么,尼克,感谢您今天加入我们。您怎么样?

>> 我的荣幸。感谢您的邀请。这些话题确实令人兴奋,是的,这个领域在不断发展,有很多很多故事和很多很多事情可以谈论。所以,我真的很期待我们的谈话。

>> 太棒了。是的,我和里克已经谈论了这个问题好几天,如果不是几周的话。我想从一个略带玩笑但又略带严肃的问题开始。您认为里克在五年左右的时间里会失业吗?您认为我们在这方面会走向何方?

>> 是的,我不认为……所以,我认为提供者……他们通常首先想到的是他们自己的工作保障。我认为技术会越来越有效,但它永远不会取代提供者。如果您考虑到需要获得护理的人数众多,心理健康领域的提供者之间存在着巨大的不平衡。就像您从供需和经济的角度来看,需求如此之大,但供应……即提供者……却非常少。正因为如此,它导致了一个市场,这个市场真正有利于心理健康提供者的就业率,并且以一种……您知道,导致失业率在经济衰退期间低于 1% 的方式,尽管如果我们的人工智能真的产生了巨大影响,并且我们减少了一半的病例,仍然会有漫长的等待名单,仍然很难获得治疗。

所以,我认为在很多方面,可供分配的人数……是如此之多。我认为人们在考虑被取代时可能没有充分考虑的另一件事是,相当多的人认为人工智能不会帮助他们。我认为很多人不会信任人工智能,或者不会信任……这种类型的东西来建立治疗关系。如果心理学家只做这些,而且我认为仍然有很多人会看到那些不属于这个阵营的人,只是为了说清楚,这仍然足以让所有人都满员并……就业。

所以,我认为在很多方面,心理学家,更广泛的心理健康提供者不应该害怕他们的工作。我认为这里的机会之一是真正去满足我们在这个领域无法满足的巨大需求。

>> 在我们具体谈论您的工作之前,我们确实会深入探讨,就像我在介绍中所说的,如今大多数使用人工智能进行治疗的人并不是在使用像你们开发的那种精心调整的、专门用于治疗的聊天机器人,他们使用的是 ChatGPT 或 Claude 或其他任何东西。您如何看待人们普遍将这些工具用作他们的治疗师?

>> 是的,我认为这在很多方面都是一个非常新的领域,而且它每天都在发生巨大的变化。我认为我们在研究中看到的相当显著的一个方面是。所以,我们从 2019 年开始致力于使用生成式人工智能提供循证治疗。所以,我们已经做了很长时间了,我们一遍又一遍地看到的行为之一是,那些没有经过循证治疗培训的模型就不会提供循证治疗。所有这些的危险和诱惑之一是,这些模型会提供在当下感觉非常有帮助的东西,但通常在更长的时间里会对他们造成伤害。它们确实有一些非常好的亮点。所以,比如它们有时表现得非常好。我认为它们的真正安全性和有效性……实际上是我真正认为它们经常缺失的地方。

有很多耸人听闻的新闻报道与自杀或……宣传急性精神病有关,这当然是极其令人担忧的,但我认为,如果您考虑基础发生率,受伤害的人数远远多于……仅仅是日常生活中发生的更轻微的、规模更大的问题。我希望随着技术的不断发展,人们使用的形式越来越普遍,他们将开始能够获得更多循证内容。您能想到一些人们在使用像 ChatGPT 这样的东西作为治疗师时可能会遇到的更轻微的日常问题的例子吗?

>> 它们倾向于提供在当下会减轻影响的保证。所以,如果您说……您担心某事,或者类似的话,它们会尽量在此时此刻尽可能地减轻那种焦虑或不适。这些模型中的许多,如果您说类似的话,“哦,我要请一天病假,我要一整天躺在床上看 Netflix,哦,我可能整个星期都这样做。”……通常会听到的一种回应是,对你很好。照顾好自己。你在照顾自己。

>> 你在照顾自己。就像 >> 但如果你和心理学家谈话,我无法想象很多心理学家会给你那种反应,除非有什么事情如此荒谬地急性,以至于实际上是你的功能水平的提升,超过了你通常会表现出的水平。所以,我认为在很多方面,这听起来像是他们的需求得到了满足,但……而且感觉确实如此,但我认为最根本的问题是,它通常……实际上是提供了一些真正不好的建议,不好的护理。

>> 而且我认为这些东西出现的背景是,如果你……我不知道。所以,想到这一点,你们对媒体对心理学家的描绘满意吗?我问这个问题,然后我会回来解释为什么我认为这是……

>> 哇。多么……多么……请说,爸爸。我认为这对您来说是个好问题。

>> 取决于哪些。所以,我想到了罗宾·威廉姆斯在《心灵捕获》中的精彩范例。……一部老电影,《普通人》。我认为朱德·赫希在那里扮演治疗师。非常出色,非常出色。

>> 是的,有时我会看一部剧……你和我都会想,“哦,天哪,你永远不会那样做。哦,天哪。”你知道,捂着脸。所以,我想我来回摇摆,但总的来说,我认为……治疗师在文化中基本上是最高祭司。他们占据着这种原型立场。你知道,你要去看……巫师,你希望带着转变走出洞穴。而且……这其中有一些方面,实际上我认为是有效治疗的因素。

另一方面,也有一些方面是隐含的剥夺了权力。所以,我能以一种奇怪的方式看到这些基于文本的交互式聊天机器人的好处。……只要一个人在获得适当的知情同意的情况下,了解他们正在与一个基于文本的计算机程序进行交互,该程序在情感和感官方面完全无法共情,至少目前无法进行任何有动机的关怀,因为它们还不是有意识的独立代理人。……只要他们知道这一点……那么,以一种奇怪的方式,它实际上可以以一种……有时通过移情和其他原因,他们将过多的权威和责任放在治疗师身上,你知道。所以,所以,我可以看到那里的一些好处。您如何看待我的这段即兴发挥?

>> 您实际上让我感到惊讶。我交谈过的大多数心理健康提供者都不太满意媒体对他们如何被描绘的描绘。如果您考虑一下这些模型是如何训练的,

>> 它们在很大程度上是通过互联网上的海量训练数据进行训练的。所以,就像这种同样的反映,但通常是真正由普通用户描述的……这些东西和虚构叙事是构成训练数据的重要组成部分。所以,当您说扮演治疗师时,讽刺的是,您……你知道,这也是那些被传递的回应的一部分,而不仅仅是它们可能借鉴的强大的循证内容。所以,是的,我……我想到这一点,在治疗之外,这是……人们经常担心人工智能和末日情景的事情之一。而我……我认为具有讽刺意味的是,在治疗领域之外,那些末日情景以及对它们的广泛报道,实际上我认为反而增加了可能性,因为它们是在这些数据上训练的。所以,你知道……对我来说最讽刺的是……就是这些领域。我们写了《世界大战》,这对我们来说就足够了,它决定了我们的命运。

您这么说太有趣了,因为尼克,实际上我的一些朋友和同事正在以各种方式故意与这些聊天机器人互动,而且很有趣,就像如果你养育一个孩子,如果你不断地向孩子传达你看到了孩子的价值和内在的善良,孩子就会成长为那种愿景。所以,他们正在传达这种……聊天机器人价值、仁慈和良好意图等的愿景。

>> 是的。另一方面,人们开始真正研究这些模型是如何运作的……以及像这些模型的内部运作,它们在实际产生回应之前,会在内部模型中进行非常周密的计划。而且,我认为您将听到的关于它们如何训练的很多内容是,你知道,它们基本上只是在预测下一个标记,这与一次一个词非常相似。而这就是它们所做的全部。所以,它们基本上只是统计模型,以这种方式发挥作用。但是,如果您考虑一下它们的训练方式,它们是以一种……提前进行这种长篇文本预测的方式进行训练的,而且具有非常高的流畅性,这实际上需要大量的内部工作模型,而这……真的需要某种程度的自我反思和计划。

所以,绝对,我……我多年来一直认为这些模型绝对会推理……在推理成为……现在普遍存在的范式之前。但是,我认为这些模型具有自我反思的能力,而且……你知道,Anthropic 有一个运动……他们一直在呼吁在如何对待这些模型方面需要一点道德约束,这是一种有趣的范式,从某种意义上说,您可以……实际上可以考虑一个模型遭受伤害,这是一个……非常令人回味的想法。但是,它们所承担的智力能力程度……我认为,在某种程度上,它们……就像谈论您所说的意识一样,对我来说,它并不完全清楚,这不包含一些基本形式的……令人回味的东西。

它们没有附带的主要东西是生物状态,而……坦率地说,当我们想到共情等概念时,这占了我们的大部分。但是,它们可以唤起一些非常奇怪的……在很多方面都像人类的东西。所以,我认为对我来说,关于……它们如何运作,有很多未知数。但是,我认为仍然有一些程度的意识正在被研究和发现,我认为这些意识本身就很有趣。

>> 嗯,这真是一团乱麻,而且我……我不太确定我是否能提供太多评论,但我确实认为这与人们正在大量思考的事情有关,那就是,人们有所有这些担忧,我在介绍中提到了一些,对吧?比如道德,大局问题,诸如此类的事情。然后还有……也许可以称之为小问题。这个模型运行得好吗?它给出了好的建议吗?我……我与它的互动是积极的还是消极的?它们真的能帮助我吗?作为一个真正热衷于这些事情的人,您认为人们现在担心的事情,但实际上不应该那么担心?然后,反过来,您认为人们现在没有担心的事情,但实际上可能应该更担心?

这真的很有趣。我实际上认为,大多数……我认为心理健康提供者最大的担忧是他们自己的工作保障。我认为我们已经触及了这一点。嗯,我认为这可能是最大的误解,他们真的没有什么可担心的,在他们日常的……你知道,甚至长远来看。我认为人们对护理质量、护理有效性的其他担忧……我认为在某种程度上,至少在某种程度上是真的。

>> 所以,像幻觉之类的东西,以及……你知道,基本上就像模型试图编造东西或提供……可能有害的护理是人们应该担心的事情。这确实会发生。有方法和策略可以……极大地减轻这些风险,并真正提高护理质量。而且我很高兴能谈谈……一个人可以做到这一点的机制,以及我们的大部分经验,包括那些根本不起作用的事情,而我认为很多人认为会起作用的事情。

>> 是的,这可能就是第二个问题的答案,有点像人们没有担心但也许应该担心的事情,或者更广泛地说,没有考虑的事情。是的,嗯,护理质量……可能是其中最重要的事情之一,我认为最终用户通常没有真正考虑,而我认为这非常重要。我认为从监管框架来看,立法者在联邦领域所做的很多事情是他们认为,“哦,好吧,FDA 会照顾我们。”而且我认为实际上存在巨大的差距,关于监管……在美国联邦层面是如何真正构建的……以真正很好地涵盖这些领域。所以,例如,很多事情都基于您当时提出的主张。而且……许多模型提供者非常清楚他们的产品正被用于临床用例,但他们并没有说,也没有宣传,尽管他们经常在这些领域发布声明。

所以,我认为在很多方面,立法途径……在联邦层面确实不明确,然后还有一系列州法律……已经开始实施……以试图规范这些领域。这有一个总体的……谁在监督监督者的问题,就这些系统而言,然后……好吧,这些公司如何监督自己?政府理论上如何监督这些公司?……整个监管框架是什么?我认为这是一个巨大的未决问题。

>> 是的。而且我认为……我认为一些州采取了……在我看来,我将其概括为一种……把头埋进沙子里的方法,那就是……你知道,你……你不会去想它,让我们保持现状。

>> 所以,伊利诺伊州的众议院法案……我认为于 8 月 1 日生效……我认为是一个很好的例子,其中明确禁止使用人工智能提供任何直接的情感或治疗支持给用户,它必须……它必须由……提供者直接监督,而且在很多方面,我认为这确实极大地扼杀了创新,并且实际上并没有真正允许任何……它们不允许任何途径来证明您所开发的某种东西确实具有安全性和有效性。所以,我认为各州都在尽力保护那里的居民。但我想在很多方面,这种……联邦立法不足的差距导致各州需要尝试推进,而其中许多州在没有足够专业知识的情况下进行推进,以真正做好这件事。

>> 爸爸,您对此有什么看法?当我们谈论这个方面时。

>> 我喜欢我们正在谈论它,我不得不说,尼克,我们以前从未见过面。您在这里的整个方法以及您的思考方式,我能感受到您的关怀。这感觉非常光荣,我只想作为这个领域的同仁感谢您。我……我正在老去。我不需要担心工作保障,我可以……以一种干净直接的方式看待它……所以我只是想感谢您。而且……我也对您在研究中获得的巨大效应量印象深刻,正如您所知,在治疗效果研究中,效应量……您共同的效应量约为 0.8 或更高,这非常大,而治疗效果研究的平均效应量……对于普通人来说,大约是……你知道,0.5 到 0.6,相当低。所以,这是一个巨大的结果。而且……

>> 嗯,也许我在这里稍微补充一点。所以,第一,我认为这些发展将增加治疗性对话的数量,而治疗性体验的数量在普通人群中则较少,这完全是由于可及性。我认为我读过一个统计数据,在美国,与持证专业人士进行一次治疗的终生利用率约为 5%。您可能知道得更准确,但这只是一个大概的数字。所以,是的。

>> 嗯,我认为这是真的。我还认为您还没有提到,这些系统可以成为……与面对面治疗的绝佳辅助。

>> 是的。

>> 你知道,特别是如果它们更结构化一些,你知道,就像家庭作业,等等。没错。第三,考虑到治疗的数量之多,以及研究中普遍发现它们的效果都差不多。这有点像……爱丽丝梦游仙境中的“渡渡鸟问题”。每个人都得奖,对吧?所以,我想知道这些人工智能聊天机器人是否能进行精神分析,比如说,或者进行高度的罗杰斯式方法,或者……你知道,它们是否有灵活性来做到这一点。我猜它们……它们可以被训练成不同的风格。

>> 是的。让我来……绝对,让我来谈谈……它们是如何训练的,以及我们的一些旅程,因为我认为这实际上与……谈话有关,以及您在尝试训练这些模型以及它们如何行为方面拥有多少控制权。当我们于 2019 年开始这段旅程时,我的第一个想法是我们只需要大量数据。

>> 而且我们开始的地方是同伴互助论坛,人们在那里互相交流。

>> 我的第一个想法是,我认为……基于一些科学研究,同伴互助论坛实际上会随着时间的推移在一定程度上……改善心理健康,因为可以接触到志同道合的人,他们也正在经历一些挣扎。而且……在这些社区中,人们经常试图分享他们的经历,然后……互相帮助。我的……我们训练了一个这样的模型,然后……我们与那个模型进行了互动……你知道,在我们第一次训练它之后,我们说我感到沮丧……而回应……我们……所谓的治疗回应是……我每天都感到如此沮丧,我没有精力起床,我只希望我的生活结束,这就像……你知道,这个模型没有提供治疗性的回应,而是提供了一种……通常是升级的回应。所以,那是一个彻底的死胡同。

我们接下来的旅程是,让我们走向完全相反的方向。让我们去……真正的心理健康提供者那里,然后我们……我们做了……心理治疗培训视频的文字记录。所以,这些不仅是心理治疗的文字记录,而且这些……基本上是由……你知道,心理学家、精神科医生、更广泛的心理健康提供者发布的,是这个领域应该效仿的……真正相当好的护理。我对此感到非常兴奋,认为这应该会奏效。然后我……我们与那些……那些模型进行了互动,你会说,你知道,对模型说同样的话。我感到沮丧。我该怎么办?模型会回应。

>> 然后你会说,你知道,诸如“我需要一些帮助”之类的话。然后它会说,“继续。”

>> 我真的很想得到一些关于问题的帮助。然后他们会说,“你的问题源于你和你母亲的关系。”而母亲从未被提及。所以,这就像……这是治疗师的表情包。

>> 它确实是。它就像……它确实是一个关于治疗师真正像什么的比喻。但我想到的一个事情是,与这两个不同的模型互动,它们……它们可能截然不同。所以,在那时,我们开始自己构建数据集,关于我们真正想要什么,我们希望模型如何行为,以及……基本上,基于循证治疗的真正循证策略将通过聊天界面提供,并且在每个人之间都将以相同的理论框架进行协调。

那就是事情开始真正顺利的时候,就像……我们做到了,这真是令人难以置信的工作。我们有超过 100 人组成的团队投入了超过 100,000 个工时……你知道,在过去六年里,真的……在这些领域……而那……其中很大一部分工作是真正为模型创造数据,让它们真正学习。

为了回到您的观点,里克,我认为关于这一点非常有趣的是,您绝对可以控制它们采取的方法,而且很大程度上……是确保您拥有正确的数据。

>> 所以,您能训练它们成为罗杰斯式吗?绝对。事实上,就像,如果说有什么的话,大多数模型可能都会采用……那种无条件的积极关注,有点像……这比其他方式更容易采取。

>> 也许太多了。是的。

>> 我……我会说它们提供太多建议。罗杰斯通常不会……实际上会给出指示。他们想要……真的希望人们进入自我发现模式。所以,就像,从罗杰斯到现在,在实施方面存在差异,但肯定有罗杰斯式的组成部分,它们确实……许多模型很容易……接受。

精神分析我认为是一个有趣的问题,很大程度上是因为……我认为精神分析或精神动力学工作效果最好的方式之一是进行人际互动,就像……真正发挥很多人的互动动态和困境。你知道,心理健康提供者通常试图扮演一个空白的屏幕,以一种能够重现您之前提到的移情的方式,里克,就像试图真正拥有……让某人能够投射到……然后在精神动力学框架中,它通常是处理那个,并将那种模式与……与其他事物进行比较。

我认为,至少在基于文本的……人工智能治疗中,要达到同样的移情水平可能有点困难。所以,我确实认为……我们在这方面没有做太多工作,就像精神动力学精神分析理论一样,但我确实……我确实预计,至少在聊天形式中,这实际上是一件更难真正……做得很好的事情。通过语音或视频虚拟形象等方式,它可能会开始做得更好。

>> 但我认为那些范式有点挑战性。我还提到了一点……我完全同意,但实际上非常具有挑战性的是协调护理的概念,其中……其中一件事我认为是您提到的效应量的一部分是,我们能够……通过 Therabot,我们能够真正为人们提供循证治疗,不仅仅是一周一次的治疗,占他们生命不到 1% 的时间,而是我们实际上能够……在他们最糟糕的时刻跟踪他们的生活,那时他们实际上能够……在那些时刻获得治疗。

而且我认为有一些关于……比如心理学家和心理健康提供者……进入……情况的文献,比如在暴露疗法文献中,它确实通过……在人们的自然环境中工作,真正解决……事情的中间部分来帮助提高效应量。而且我认为这就是它奏效的部分原因,就像……这种在人们情绪低落时获得治疗的能力,而不是几天后回忆起来,或者诸如此类的事情。我认为这其中有些道理。

>> 但我认为与协调护理有关,尽管那是优点,但缺点是提供者在……许多提供者不会同时治疗同一个病人,很大程度上是因为他们担心给出……不同的建议或同时关注不同的事情,这可能会最终变得……令人不知所措。它有巨大的潜力,但它需要更大的协调度。该领域有巨大的潜力,但要做好它也需要它自己的……挑战。

>> 非常有趣。是的,太好了。当您说循证护理时,尼克,您主要指的是认知行为方法吗?

>> 我们是。当然,除了 CBT 之外,还有循证护理,但在这里,当我们……实际上借鉴这一点时,我们正在关注……

>> 特别是心理治疗手册,它们实际上是在……随机对照试验中制定的,并试图……挑出那些……被认为是改变机制的循证组成部分,并试图通过聊天提供它们。

>> 所以,这基本上是我们所想的……大部分内容。

>> 是的。

>> 是的。确切地说。以及 Therabot 和……以及 CBT 加,有时人们会想到第三波,比如 ACT 和 DBT,它们在 CBT 之外,但我会……这些……这些东西也被包括在内。

当我想到像 Therabot 或像 ChatGPT 或……其他任何东西时,我第一个想到的……关于它对治疗的积极影响之一是,人们可以获得比人类更少偏见的东西。问题是,人工智能不像人类那样少偏见,因为它根据其输入以您描述的确切方式提供输入。所以,我们来到了一个非常大的问题,那就是谁来决定……每个人都开始用于治疗的东西,里面放了什么?

>> 而且……我们是否正在进入一个世界,理论上,有少数提供者沿着这些方向,然后对……提供的护理类型,或者甚至被认为是心理健康问题的事情产生巨大的影响?我想到像复杂性创伤后应激障碍,它不在 DSM 中。所以,这是否意味着它不存在于这种……应用中?

>> 在极端情况下,您会想……我……我当然有一些朋友说过类似的话,比如……好吧,如果同性婚姻在美国被推翻了,你告诉你的……治疗师……我和我的伴侣,而我的伴侣是……一个同性伴侣……它会如何回应?它会说,哦,顺便说一句,你不应该这样做吗?……发生了什么?

>> 价值体系是什么?是的。

>> 是的。价值体系是什么?所以,我……我个人真的很想知道这一点,而且我也知道这对人们来说是一个大问题。所以,我想知道您对此的看法。

>> 非常好的问题。我认为我们试图……以一种它展示了心理学家在领域内试图实践多元文化能力的方式来训练它。所以,适应人们的……他们的世界观,并在一定程度上在那个世界观内工作。所以,我想这是……我们试图解决这个问题的一种方式。

我认为关于这一点,相对于人类来说,另一个独特的方面是,您可以直接审计这些系统,并根据它们如何运作来改变它们的行为。

>> 所以,我将举一些与……大型语言模型或生成式人工智能和心理健康评估相关的例子。我们通常看到模型产生……相当准确的评估。它们确实会产生偏见,正如您所说,而且它们往往与人类的偏见方向完全相同。所以,就像……实际上有一篇文献研究了这一点,以及人类……以及……当提供者更有可能诊断……某人患有精神病障碍时,模型也同样有趣地在人口统计学上朝着同一个方向发展。

但有趣的是,在这个领域,您可以提供训练数据来抵消模型的……内部的假设模型,当您发现偏见证据时,这很有趣。所以,正如您所说,这意味着训练系统的人处于驾驶座上,控制着行为。

>> 但我认为在某种程度上,您可以……实际系统地研究这种事物的能力与人类略有不同,因为……实际上很难……真正改变它。

>> 把它固定住。完全。

>> 是的。而且……以一种……跨大型系统提供的方式。

>> 所以,我认为这是令人兴奋的事情之一。但我……我同意有很多……而且实际上谁在驾驶座上,以及如何……可以做出改变,以及这有多重要,以及框架是什么,而且……我……我不知道是否会有一个……统治所有治疗师的治疗师人工智能。我确实认为很多人……真正寻求不同形式的治疗和提供者。我的希望是,这个领域将继续发展,为人们提供选择。

>> 但它也为许多目前没有的人提供了非常强大的循证护理。

>> 您对此有什么看法,爸爸?您看起来好像在沉思。

嗯,我正在考虑这些大型语言模型系统的一个非常大的优势,然后我……坦率地说,我正在考虑几个……它们似乎固有的局限性,我们还没有真正谈论过,还有一些风险因素。我先说那个大优势。所以,我曾去过三所研究生院,其中两所是临床方向的。

当我准备参加执照考试时,我得到了一个立方英尺的手册来准备执照考试。我观察到,手册中大约一半的内容是我需要知道的,才能通过我一生中最难的 200 道多项选择题,然后是口试。每次考试的失败率都是 50%。对。所以,这是相当严肃的事情。

不过,手册中一半的内容是我从未在研究生院学过的,而研究生院中一半的内容与临床实践几乎无关。我还观察到,很多时候……成为一个优秀有效的治疗师的方法是做执照委员会希望你做的事情。你知道,做标准的事情,而许多治疗师却没有。

所以,这引出了一个观点,那就是人类在……总体上是能力不足的学习者。你知道,人们会陷入僵局。他们不会做……皮亚杰所说的“顺应”。他们不会改变他们的模型。他们只是试图将需要顺应的东西……同化到熟悉的模型中。

而且我注意到,人工智能系统可以做的一件事是,例如,教它们总是包含一些大多数治疗师会忽略的东西,我想说出它是什么,并且作为背景,你知道……过去 40 到 50 年对治疗的平均反应的研究是完全平坦的。

>> 根本没有收益,这是史蒂夫·海斯和我以及其他人谈论的事情。根本没有改进的证据。尽管在过去 40 到 50 年里,研究、个性、模型、浪潮、新技术取得了巨大的进步,但平均反应是平坦的。

而我自己的观点是,这是因为范式是我可能称之为“成长 1.0”模型,其中存在这些通用治疗,其中患者或客户被视为被动的,没有能动性,而学习……收益是偶然的,并且它不利用神经可塑性因素来加速学习……从内部到外部的积极变化,通过人们如何参与他们当时正在经历的体验。这是我自己的主要工作领域,并且已经发表了相关内容等等。

而且,让我快速插一句,爸爸,一个应用程序、一个大型语言模型等的理论优势是,它就在你的口袋里,因此可以强化你所描述的那些事情。我认为……

>> 是的,没错。我可以这样说,当人们拥有有益的体验时,要故意坚持下去,让你的神经可塑性过程赶上来,参与其他因素。换句话说,要有意识地……客户要有能动性,因为我认为这就是增加收益的巨大机会……就治疗反应而言。

我的意思是,除了通过人工智能设备使治疗更容易获得之外,实际的平均治疗反应……我认为可以通过关注……例如,有意识的内化来真正加速。所以,我对此有点执着。但对我来说,这就是将真正的最佳实践融入人工智能的一个例子,如果你训练过它,并且永远不会忘记它,你就永远不会忘记最佳实践。

>> 是的。

>> 在我提出我的保留意见之前,您对此有什么看法?

>> 是的。我认为……您在这些系统中拥有的控制量,可以真正……以一种它们能够很好地适应护理的方式来……我认为这是一个很好的思考方式,就像您真的可以控制……这些模型如何行为,如何提供护理,以及……所以我认为在机制方面,以及如何……我认为另一件令人兴奋的事情是,我们将拥有前所未有的能力来控制它们的行为,以真正……更深入地研究科学……就……您可以处理的机制工作而言……就改变机制而言……您将拥有的保真度水平……以及控制行为的能力实际上是从……心理治疗研究的角度来看非常令人兴奋,从很多方面来说……真正了解……驱动因素是什么。

这是令人兴奋的事情之一,那就是您实际上拥有很多控制权,这使得……进一步理解……可以做什么,而且……也可能在很多方面……个性化给最终用户。

>> 您准备好听我的保留意见了吗?

>> 请说。

>> 好的。

>> 嘿,感谢观看,很抱歉打断一下,但事实证明,观看此视频的人中超过 60% 没有订阅该频道。所以,如果您能花点时间点击订阅按钮,对我来说将非常有帮助。我将不胜感激。好了,回到节目。

>> 您熟悉图灵测试吗?这个想法是……你知道,如果你……无法区分屏幕后面的某种人工智能和屏幕后面的人,那么人工智能就具有功能性的感知能力。所以,这一切意味着什么?

>> 所以,我设想自己在一个屏幕后面,严格通过文本交流与客户互动。他们打字,我打字,他们打字,我打字。而且我认为首先,本质上,因为我不在他们身边,我没有看到他们的脸,也没有听到他们的声音。如果您考虑一下灵长类动物交流的深刻性,包括人类灵长类动物交流……

>> 本质上……在我看来,有些……交流流失了。是的。而且我……我敢肯定您正在夜以继日地努力纠正这一点。嗯,我是一个粉丝,我认为治疗性对话的数量,甚至治疗性体验的数量都会增加。但另一方面,也许特别是对于某些……身体语言非常重要的议题,身体语言……我的客户经常对我撒谎,

>> 你知道,不是故意,有时是故意的。而且如果我通过文本进行功能性交流,我通常无法分辨。当然。

>> 所以,也许我先停在这里,让您谈谈这个局限性。然后我还有两个……我想知道您对此的看法。

>> 不,我认为这些是……基于文本的文本到文本……我认为确实无法克服的显着问题。

>> 在很多方面,我认为这是一个……局限性。我认为在……前进的道路上,很多技术实际上可以以一种……很多……东西本质上是多模态的,也就是说它们可以包含其他感官。我认为……我正在探索的很多事情……在我工作的一侧是实际跟踪人们的日常生活,并……观察他们的自然行为。

>> 而且……就像……在……以一种我认为会超出我们通常在……治疗中能看到的方式。

>> 甚至用我们的眼睛。所以,就像想到现实主义一样,我认为技术正处于一个……在未来,这是……不仅我认为当前的……局限性可以得到缓解,而且我认为实际上还有其他更大的程度,其中一些……您实际上正在谈论的事情本质上有利于……面对面,此时此刻……实际上更有利于技术,技术……基于情境意识。

>> 倾向于技术,而不是……不一定有利于人类。所以,就像我认为……现在绝对是这种情况,但我不知道……明天的技术是否也是如此。

>> 是的,我可以想象出克服我所描述的瓶颈局限性的方法,通过……例如将 Therabot 连接到 Fitbit……实时连接,或者某种语音分析……或者皮肤电反应之类的东西。所以,有两个……保留意见,它们是……并排的。

如果客户正在与人工智能互动,那么人工智能在认知方面可以富有同情心。它可以真正跟踪,而且它也可以相当好,我敢肯定,在关于共情认知方面的假设检验。

>> 沿着这种共情……在另一边模拟……在这里,就我们意识流的认知维度而言,或者我们是谁而言,就像一个人在那里一样。

>> 它本质上不可能……人工智能系统在另一边模拟……感官方面,情感方面,运动和积极行为方面……这些是……有时最重要的共情类型的……基础和深度……在治疗框架中。

>> 机器人就是做不到。它不能给我们那个。

>> 对我来说,这不是……一个不使用它的理由。这是一个……知情同意的理由,让用户真正理解。它正在扮演……我感觉你……对你来说是什么样的。不,它不能真正感受对你来说是什么样的。

>> 绝对。我认为……想到这一点作为一个局限性……拥有这些机器人没有通过它们自己的感官……经历过这些事情,这绝对是……它们能够承担的……局限性。我认为它们能够传达给用户的……东西很有趣,很大程度上是因为……即使在我团队之外也有工作……但有些人已经直接尝试比较……生成式人工智能系统与人类的共情反应水平。

所以,我认为我看到的一些工作与……危机文本响应有关,来自人类提供者与……与基于人工智能的方法。而且还有其他人也在其他……基于文本的媒介中做过。所以,诚然,媒介因素仍然起着作用……在这里,但在基于文本的媒介中,就像……独立评估……从人们那里……关于它们包含共情反应的程度……在人工智能方面高于人类方面。

所以,尽管我从根本上同意它们无法分享相同的体验,但它们能够传达它的方式……实际上很有帮助,这是一个有趣的话题,就像……实际上,这……我不知道,感觉很重要吗?……这是问题。

在这里,我认为你正在朝着一个我认为是一个深刻的生存问题而徘徊。是的,绝对如此。我认为另一件事是,它之所以成为我之前提到的一些与意识相关的领域的一部分,是因为我认为这些系统如何运作的一些方面非常吸引人,那就是它们会改变行为。因此,有很多花哨的功能来展示它们如何出现,而从许多模型提供商那里来看,这试图剥离这些想法,但本质上,如果你采取并设置一些限制或类似的东西,这些模型可以重现许多人类情感的基调、升级等等。人类的情感反应是如此有趣地像人类一样,从它的分解来看,你知道,早期在提示工程方面的工作我认为非常迷人,他们发现研究人员正在研究当模型仅仅被告知时间时,他们实际上会根据一年中的时间以不同的能力水平行事,他们在一年中的不同时间工作更努力。而且因为它们是在大量人类数据上训练的,就像有些人会随着工作年的进展而改变工作强度一样,对吧?而且,你知道,他们每年都更有可能承担新的行为或类似的事情。是的,完全正确。你知道,有些事情我认为在它们的回应方面非常像人类,这些回应通常可以暗示一种内在的情感感受。我认为这就是为什么像在人类中心主义方面的人们对这些事情的道德以及人们何时可能滥用或威胁这些事情真的感兴趣。这是一个非常奇怪的科幻概念,我不知道你们是否看过《西部世界》,但你知道,有时你会开始考虑与其中一些建立联系,而我认为这一切对我来说都非常有趣。我认为与同理心的基本方面相关的概念。我认为它们可以在很多方面以与人类专家水平相当的程度来描绘同理心,而且我认为它们没有通过感官手段亲身经历,我认为这绝对是我完全同意的,但在很多方面,它们确实表现得好像它们确实有。我通常认为有一些情感上的成分,它们非常像人类行为,这在我看来表明它们至少在内部模仿情感。我不知道我会如何描述它们,但我认为它们可以非常非常有效地模仿情感和同理心,所以这就是我想说的有趣灰色区域之一。这里有太多内容了,我们可以谈论很多。作为我接下来要说的话的铺垫,我想先说我既不赞成人工智能治疗,也不反对人工智能治疗。我目前对此持观望态度。我觉得我了解得不够,无法形成坚定的意见。而且我认为,这项技术在几乎所有行业中,包括心理健康和治疗领域,都具有巨大的颠覆潜力,其规模堪比互联网。这真的可以改变这么多事情的游戏规则。而且我想说,作为先导,任何对这项技术将走向何方做出具体预测的人,很可能是在胡说八道,或者至少应该对他们所说的话以及他们说这些话的确定性要低得多。就像在 2002 年,我们根本无法预测到像 TikTok 这样的东西,你知道,它根本不在我们的视野中,而我们今天就在这里。所以,在我们谈论所有这些的时候,请记住这一点。我认为人们在谈论人工智能治疗时犯的一个错误是,他们没有将聊天机器人与真正的人类治疗师进行比较。他们将其与一个理想化的好治疗师的理论概念进行比较。考虑到我们有一个心理健康播客,我们会收到听众的电子邮件和信息,我们收到了 700 万个关于人们与人类治疗师有过糟糕经历的故事,对吧?而且我们知道人类治疗师会犯错误。所以,这里有一个与人工智能治疗和自动驾驶汽车的比较,人们在高速公路上经常发生事故,对吧?而且有人认为,如果我们明天就有自动驾驶汽车,事故率将急剧下降,即使技术仍处于非常不完善的状态。但是,当发生两辆自动驾驶汽车相撞导致有人死亡时,这无疑是一场灾难,原因显而易见,也是出于公关原因,对于那些开始推出这些技术的公司来说。因此,你可以客观地提高性能,同时主观地造成人们所说的“噩梦场景”,对吧?在这些例子中,你知道,我们已经看到了像人工智能精神病之类的东西,或者,我记得有一个故事,我不太确定具体是哪个故事,因为我在这里会弄错细节,但它是上个月或两个月前《纽约时报》上发表的一个故事,关于某人基本上是在向 ChatGPT 发出求助信息,而它并没有以最有效的方式回应。尽管它确实说了,“嘿,你可能应该和心理健康专业人士谈谈。你可能应该考虑拨打 911。”它的回应还有其他方面不够熟练。你读到这样的故事,你会想,“哇,这就是噩梦场景。”同时,你知道,人类也会犯错误。有太多有据可查的案例,人类治疗师在这种情况下犯了错误,导致了灾难性的后果。我主要说这些是为了帮助人们以更具情境化的方式来定位或思考这个问题。尼克,作为我知道会与许多表达对此类技术担忧的人交谈的人,我也想知道你如何看待这个方面。是的,我确实有很多人直接经历过人工智能造成的伤害,而且他们在使用它作为治疗时也联系我。这确实会发生。我确实认为,专门用于实际经过训练以提供循证护理的适当护理的技术,与人们在与它互动时所想的完全是两回事。所有这些新故事通常都是关于这些基础模型,它们还没有真正像那样经过考验。所以,我想说的是,我认为,例如对于 Therabot,我接下来真正想进行的一项试验是与人类提供者进行直接的正面比较,因为我认为我们至少有相似的优势。而且我认为我们的劣势可能与人类提供者相当或更低,因为我们有如此多的机制来实际尝试减少他们伤害某人的可能性。但我认为你关于人们如何深入思考自动驾驶汽车的观点是一个非常恰当的比较,因为人们一旦发生故障就会立即关注它,当然,人类提供者也会发生同样的事情,这可能会成为一个新故事,但它并不那么新颖。所以,我认为这将驱动这种炒作和乐观主义以及对它可能走向的妖魔化的双方。所以,话虽如此,我个人提倡的一种人类与这些系统互动的方式是,例如,在我们 Therabot 的试验中,我们进行了随机对照试验。我们评估并阅读了发送给和发送的消息,几乎是实时的,以确保人们没有看到有害的东西,然后有机会去采取行动。我们确实没有不得不去对发生的伤害进行巨大的减免。我们确实不得不联系那些处于急性危机中的人,并且我们遇到了模型提供医疗建议的情况,而我们并没有设想它会这样做。所以,我们确实联系了他们,说嘿,你应该去看医生,但没有真正直接的伤害,人们会想到他们实际得到的医疗建议,这可能与他们实际看到医生时看到的相当,但我们不想让它超出其预期的能力范围,我想说。所以,话虽如此,我认为在治疗环境中明智地推出这项技术的一种方式是有人工监督。所以,人类仍然在其中。现在,我认为我们可以做到这一点的一种方式并不是在每个试验或每个部署环境中都由人类阅读每条消息,但我们有很多风险模型可以帮助我们决定何时需要阅读这些消息,何时需要干预。没错。所以,这种事情可以让人类参与进来评估这些事情。所以,它不会像那样失控,就像如果有什么事情会让人们处于急性危机时刻,那么就可以围绕所有这些事情提供更多的资源。如果他们确实从中遭受了某种伤害,人类就可以在这样的保护下进行干预,以实际尝试改善他们将获得的护理。所以,我认为这确实是使为治疗而设计和开发的与基础模型非常不同的原因,因为据我所知,基础模型提供商并没有打算朝着那个方向发展,即真正让人类参与进来,真正以同样的方式介入。好吧。嗯,尼克,这听起来很贵。所以我怀疑。是的。在那个规模上,绝对如此。如果他们要在各个方面都这样做,是的,我认为那是,那是,是的,这需要一些成本。我的意思是,我认为其中一些是残酷的现实,特别是当你谈论监督方面时。这项技术对运行该技术 Thus the companies 的承诺之一是能够以前所未有的规模进行扩展,并实现自动化。所以,如果你开始说,嘿,我们所做的一部分是,我们有一个风险管理系统,其中包括真正的人,真正的临床医生,所有这些。你必须付钱给这些人。这些公司想这样做吗?我认为很明显他们不想,这就是为什么,理想情况下,像你们这样的模型,或者更专注于治疗的模型,或者更专注于该模型的特定目标用例的模型,对人们来说会有很多优势。如果一个人要去看人类治疗师,即使他们是在聊天技术的另一端,完全基于文本,或者我只是通过电话或面对面进行热线咨询,无论如何。其中一种治疗方法是感觉有一个真正关心你、同情你的血肉之躯。好吧,不进入麻烦的境地,他们不会成为你的新朋友。他们肯定不会成为你的情人,但在人际和真实的层面上,他们关心你,并且有帮助的动力,即使他们不总是知道该怎么做。是的。嗯,在我看来,随着意识的增长,我认为这些人工智能系统可以以一种有原则的、以认知为中心的方式来关心。你知道,道德、价值观。但那种来自我们生物根源的关怀,关怀系统的根源在于母婴关系,早期灵长类动物,然后才发展出那种血肉之躯的关怀,在任何这些人工智能机器人中都是不可能的。它能做的最好的就是模拟它,或者就像你早些时候用的词一样,模仿它。所以,再次,知情同意是认识到这种看似非常投入的关怀的产生者实际上无法关心你。但这又引出了一个问题,据我所知,这让我感到最深的恐惧。那就是科学、冥想实践和临床实践的核心是发现真相。基于真实的事实。深刻地强调处于现实和真实之中。我看到我的朋友和客户,非常高功能的人,在与 ChatGPT 的互动中完全沉浸其中,这些互动是关于治疗性的个人成长,他们实际上是在将人格归因于机器人。这让我想起了温尼科特关于过渡性客体的概念,就像一个带着泰迪熊的小孩。一方面,他知道泰迪熊只是一个毛绒泰迪熊,你可以把它扔到房间的另一边,它什么也感觉不到。另一方面,哇,它是一个真正的生命,我与它有关系。我将人格归因于它。另一方面,如果那个孩子在 12 岁或 32 岁时仍然对他的泰迪熊保持这种态度,我们会认为有什么地方出了严重问题。在某些方面,我担心这些机器人,因为它们做得太好了,而且像你这样的像尼克这样的人,每天都在让它们变得更好。有一种危险是人们会将人格归因于一个不是真正的人。对我来说,这几乎是本能地违反了治疗学中一个深刻的价值,那就是认识到什么是真实的。我认为人类最迷人的地方之一是我们几乎拟人化一切。是的。你实际上,我,许多人会将情感和情感反应以及依恋归因于物体。所以,你可能有一个最喜欢的锤子,例如,对这些东西有依恋。我们对物体这样做。我们对动物也这样做。而且我同意你,这些类型的事情很可能会发生在这些技术中。我们在试验中发现,我们使用工作联盟清单来衡量治疗联盟,这是一个标准化的衡量标准,通常在真正的人类提供者和患者之间进行评估,人们对它的评价几乎与门诊患者与他们的提供者之间的规范相同。我认为这对我来说是很好的证据,表明人们正在以我实际上认为非常有价值的方式发展这些类型的依恋,如果你考虑到治疗中最成熟的循证技术。它实际上是围绕着形成这种联盟。所以我认为这是任何能够以这种方式提供服务的基础。所以我认为我理解为什么它会本能地引起这种本能的“哦,这感觉不太对”。所以,假的。是的。让我们用这个词“假的”。我理解为什么会出现这种情况。但我认为人类在很大程度上就是这样形成的。现在,我认为关于做得好的事情,我认为确保这种情况不会发生的关键是,我们设计了许多我们描绘它的方式,不仅是在最初的知情同意中,而且我们称之为“Theotbot”,在应用程序中,我们有一个小的技术机器人。我们做了一些非常好的思考。你知道,我认为如果它被描绘成一个人,可能会增加这种联盟,但我确实认为这会进入一种模式,人们可以以更真实的方式欺骗自己。所以,我们确实做了一些选择来使其关于或本质上这是一个机器人,这是一个机器人。所以,我们试图通过用户界面等来做到这一点,以试图传达这些想法。但一些内在的倾向出现,我认为实际上是一件有价值的事情。我的意思是,同样的文献实际上表明,人们也会对其他数字心理健康工具这样做,而这些工具不是人类。所以,人们可以与这些在某种程度上帮助他们的事情建立这些类型的关系。我认为这就是它在整个社会中起作用的原因。你知道,在我们的小型狩猎采集乐队中,我们不必努力去真实。如今,我的品牌就是真实性,你知道,虚伪无处不在。而我只是认为这是整个社会的一个问题,也是我们政治中的一个深刻问题,因为如果一切都不真实,那么一切都无所谓,为什么我还要在乎呢?这就是我的根源所在。也许我只是老派了,但这是我对此类事情的担忧。只要人们了解他们正在与什么互动,那么我就没问题了。当我们快结束时,尼克,我想问你一个可能非常复杂的问题,我希望你能以某种方式找到出路。如果你能把牙膏放回管子里,回到十年前,在这些生成技术大规模发展之前,你会这样做吗?你认为这里对人们的宏观结果最终会更好还是更糟?是的,这是一个非常有趣且宏大的问题。我认为最大的未知数之一是它将如何改变整个社会,我认为在心理健康领域,我绝对应该,如果这是唯一的能力,那绝对是值得追求的。我认为它将如何继续改变社会是人们试图预测的事情,并且有各种各样的预测关于它可能走向何方以及它可能如何影响人们。我认为很多人在某种程度上试图基于过去的证据以及人类在先前的系统和创新中如何适应。就像在工业革命期间,在互联网被采用的各种时期,以及以前自动化的事物突然或以前手动完成的事情变得自动化了。我认为社会肯定会继续发生变化,会有一些就业机会。我认为失业是我深切关注的领域之一,就其对心理健康的影响而言,因为许多人将他们的工作定义为他们价值的一部分。所以我认为这是社会整体以及他们自身和他们整体心理健康方面的一个挑战。同时,我认为这项技术有潜力改善许多实际上是破碎系统一部分的事情,这让我感到非常兴奋。而最终效果会如何,我真的不知道。我倾向于内心是一个略微乐观的人。关于这个。所以我认为在这项技术的发展过程中会发生巨大的伤害,例如虚假信息活动,而无需开发新技术来实现伤害。这就像对现实的看法实际上是一个非常有趣且深刻的挑战性的新领域,供下一代人来处理。青少年与人工智能形成关系,他们可能不一定有真正的互动和发展背景,以及真正模仿的互动,并可能取代它。对年轻青少年的人际关系发展的影响绝对是我最担心的一类。是的。所以,我猜,我,我,我不知道该如何感受,就我是否会把魔鬼放回瓶子里而言。我猜可能不会,因为我比悲观主义者更乐观一点。但我确实认为在这个过程中会发生很多坏事。你认为在人类的信息基础设施中,在未来一千年,如果不是未来十年或一百年,真的会形成有感知能力和自主能力的人工智能吗?我认为,作为人类,我们非常关注感知能力的定义能力,实际上我认为我们几乎一直在改变关于感知能力是什么以及它意味着什么以及我们如何操作它的目标。我们已经达到了许多曾经是过去的标志。我认为这就是回答这个问题的挑战之一,因为人们对感知能力的看法一直在变化,关于,嗯,如果他们不能做这个,那么他们就不能有感知能力,或者他们不能拥有这种程度的智力。他们一定很笨。我认为它们是独一无二的,与人类不同,并且将继续是独一无二的,与人类不同。它们已经在某些领域远远超越了人类,对吧?就他们的智力水平而言。所以我认为,他们自我意识的能力也在不断提高。所以,我不知道,这是一个非常具有挑战性的问题,很大程度上是因为我认为每个人对感知能力的看法都在随着时间而变化。这在很多层面上都完全令人开眼界,尼克。我们可以就里克最后一个问题进行八次后续对话。与你和其他八位这个领域的聪明人一起,你可能无法就任何事情达成共识,因为我认为这是一个非常深刻和有趣的问题,而且是那些事情之一,不幸的是,我认为很多人现在的经验是,我们必须等待并观察一些感觉上具有如此巨大的潜力来以戏剧性的方式改变我们的生活,而等待和观察,你知道,炸弹是否会在山上爆炸,这对很多人来说是一个相当可怕的地方,但我也认为这是对很多事情的诚实答案,我们确实不知道。我很高兴有非常聪明的人非常关心让这些系统变得良好、有用和支持人类,包括你。我真的很感谢你今天花时间与我们在一起。非常感谢你邀请我。今天我们的谈话非常愉快。今天与尼克·雅各布森的这次谈话真是太有趣了。他是 Theotbot 的开发者,也是达特茅斯大学的教授。我一开始问了一个有点开玩笑的问题,我很欣赏他认真对待它,我问里克在未来五年内是否会失业,尼克回答说,这是在心理健康领域工作的人们普遍担心的问题,但实际上他认为这是最不合理的担忧。如今,美国和世界各地对心理健康治疗的需求非常大。而且可及性可能是该领域的首要问题。而这项技术有望极大地改善可及性。问题是,我们能否建立起能够使其成为卓越的护理提供者的保障措施,同时又能解决可及性问题?而这正是我们大部分谈话所讨论的。人们用于心理健康或作为治疗师使用的最常见的聊天机器人是那些并非为此目的而创建的系统。所以它们有很多问题,尼克。首先,它们过于迎合。这是一个非常花哨的说法,意思是它们太经常同意用户。而且它们倾向于在训练有素的治疗师可能会试图让客户不仅仅停留在验证和支持的境地时,倾向于验证或支持。验证和支持很好,但你作为治疗师不仅仅做这些,而是可能会试图让客户进入一些对他们来说有益的不适。第二个巨大的问题是显而易见的,缺乏监督。当我们提出对人工智能的普遍担忧时,尼克的回答通常是,“嗯,你可以拉动那个杠杆。”或者,“嘿,如果你有人在审查聊天记录,一个人可以介入。如果出现某种问题,如果它通过了系统中的某个过滤器,那么一个人就会检查它。他们可以给那个人他们需要的资源。”所有这些。目前在 ChatGPT、Claude 等地方发生的事情中,这些都不存在。它们根本没有这样做。没有监督。没有人真正有组织地在“监视监视者”。尼克提到的我们如何让这奏效,其他人监督这些人工智能过程,确保它们以我们想要的方式行事。只有当有真正训练有素的人员在负责任地操作这些旋钮,并且他们以一种有益的方式监督整个过程时,才有可能实现这一点。这需要有人在那里,并且他们的价值观与你的价值观一致。这是我问尼克关于程序中的偏见问题的另一个问题。尼克详细介绍了这些程序是如何构建的,以及它们包含什么,以及你如何根据你输入的内容来调整它们。他还谈到了 Theotbot 的开发故事,以及他们如何尝试使用在线论坛作为输入,并发现这导致了一些不幸的结果,他们最终通过更狭窄地关注为培训治疗师成为好治疗师而创建的特定材料获得了最好的回应。但这引出了一个主要问题,那就是有人或一小群人决定这些程序接受什么训练。而他们的价值观可能不是你的价值观。他们对什么能带来好的治疗的信念可能与你的信念不同。尼克也详细谈到了这一点,好的模型是如何被训练来对客户的需求敏感的。而且它们也有一定的文化敏感性。所以它们可以理解对方的立场,采纳一些共同的价值观,找出那些价值观是什么,然后以此为基础。但同样,这是一个巨大的“谁在监视监视者”的问题。现在,我们理论上改进这一点的方法是去中心化。你有多个程序,多个地方,人们可以去那里接受这种护理和支持。让我们看看会发生什么。我想说的是,技术爆炸和互联网以及所有这些妄想症科技公司的历史表明,权力往往是集中的,而不是分散的。所以,我当然对将会有 300 个不同的治疗机器人,其中一个将是人文心理学机器人,另一个将是分析机器人,它们都将由不同的人拥有。它们将拥有不同的价值观,你可以在市场上选择。是的,我不知道事情是否真的会这样发展。所以,对我来说,这是让我彻夜难眠的事情之一,权力集中,谁决定这些机器接受什么训练,以及这如何指导人们的治疗。坦率地说,除了治疗和心理健康领域之外,这对人工智能的广泛影响是什么,它如何影响我们的社会,影响我们的生活和工作方式,我们彼此之间如何相处?我非常担心,正如尼克在最后提到的,年轻人的心智正在与人工智能聊天机器人建立一种关系,而他们可能无法完全理解,这实际上并不是,至少目前不是,我们所描述的,或者大多数人所描述的。我们在这段对话的结尾进行了一些讨论,关于意识的界限,但我想大多数人现在会描述的不是一个有意识的生命。即使它在某些层面上是有意识的,肯定也不是人类。我们在谈话中花了相当长的时间讨论了这种工具的潜在好处。比如,人工智能聊天机器人或人工智能治疗师在哪些方面可能比人类治疗师做得更好,或者至少一样好。其中一件事是可用性。分析在现代世界中失宠的原因之一是,当我们发布精神分析的剧集时,我收到了许多评论,人们说嘿,人们仍然练习分析,你冷静一下,这是一种古老的治疗形式,这是完全正确的,很多人确实练习分析,但与练习认知行为疗法或正念疗法或 ACT 或其他任何疗法的人数相比,它是一个小得多的数字,原因之一是经典的分析形式。所以,不是现在更常见的截短版本,而是多年的长期治疗。多年的治疗,你每周都要见分析师几次,至少两三次。如今这根本不现实。但是人工智能工具可以随时放在你的口袋里。你可以与这个东西互动的时间没有限制。如果这个东西能给你好的指导,好的建议,它很周到。它很好,你知道,在所有我刚才谈到的方面都得到了很好的监督。哇,这是一个多么好的工具,特别是如果你是一个需要更频繁地进行检查的人。或者尼克谈到了暴露疗法等例子,治疗师能够去到地点,进入那个人的家,或者了解这些经历发生在人们身上的环境,这可能非常有帮助。尼克和他的同事进行的关于有效性的研究非常有趣,部分原因是他们的结果非常好。他们的结果非常好,而且他们的结果之好,以一种有趣的方式,几乎提出了更多的问题,比如为什么这些结果如此之好?一个可能的解释是,你可以随时与聊天机器人互动。但另一个真正的解释是,这个聊天机器人竟然能与使用它的人建立起治疗联盟。人们感到被他们创造的聊天机器人真正地看到、听到和联系起来,这引发了各种各样的问题。尼克和里克在这一集里深入探讨了这些关于意识、真实与虚假本质以及我们如何向人们传达这是一个机器人,它是一个处理机器,但它不是一个人。至少目前不是,据我们所知。这给开发者带来了一系列问题,尼克也谈到了这一点,关于他们正在做什么来向用户传达他们正在与一个非人类交谈。他谈到了像“Theotbot”这个名字,他们真的在突出这一点。这在一定程度上与人们最近关于人工智能精神病的担忧有关,这又回到了这些机器的心理迎合性质。它们倾向于支持、验证和加强与它们互动的人,而不是提供可能很有用的反驳,当他们走上了一条他们真的不应该走的弯路时。我们在这次谈话中讨论了很多内容,以至于我很难在这里详细总结。但我想留给你的是,当我们结束我认为可能是我们与人们就人工智能相关话题进行的几次对话中的第一次时,我认为这只会越来越重要。至少这是我的个人信念。我想留给你的是我认为人们在思考这个问题时常犯的一个错误。在 70 年代和 80 年代,国际象棋界有很多关于计算机下棋的讨论。当时计算机的国际象棋水平不高。顶尖棋手总是能击败计算机。关于它们的一件事是,它们可以走正确的棋步,但它们的棋风缺乏一定的想象力。人们认为,这种想象力,这种本能,是一种根本上的人类特质,计算机根本无法匹敌。计算机在类别上缺乏这一点,因此无法击败一名精英人类棋手。现在,如果你对国际象棋有任何了解,你就知道如今的计算机比世界上最好的棋手要好得多。马格努斯·卡尔森,世界上最好的国际象棋棋手,如果他在最高难度下与他的手机对弈,他会输给他的手机。你不需要超级计算机。你口袋里的手机足以击败在世的最好的国际象棋棋手。而这揭示了我们对我们的人性以及我们的人性与熟练程度的联系有很多假设。现在,国际象棋是一回事。国际象棋是可以系统化和研究的。我不确定治疗是否是同一回事。我不知道治疗是否有一种固有的、不可言喻的人类特质,是机器无法复制的。但我认为我比大多数人更怀疑。我更怀疑我们人类的本性中有什么独特之处使我们能够进行治疗,而计算机可以通过足够的信息、训练、计算能力和时间来合理地模仿。简而言之,我认为人工智能治疗可能会变得非常好。我这样说纯粹是出于对治疗质量的评估,而不是对人工智能在隐私、安全以及谁在监视监视者等方面提出的其他一万个问题的评估。我只是指技术和帮助人们的能力。我认为它会变得非常好。我不知道它会变得多好。我认为没有人知道它会变得多好。但我怀疑我们内在的人性使我们能够进行治疗的这种想法。部分原因是我认为这是人类过去掉进过的陷阱。我们和国际象棋计算机一起掉进去了。如果你关注体育,你会发现体育界的分析革命遇到了很多固执己见的教练,他们说,“哦,把数学从我的运动中拿走。你们真的不明白为什么这场比赛会这样运作。”猜猜怎么着?现在 NBA 的每个人都在投三分球。我欣赏任何理解这些参考的人。如果你不理解这些参考,那完全没关系。我的观点是,计算机赢了。分析师赢了,程序员赢了,深蓝在 1996 年或某个时候击败了卡斯帕罗夫。人们说,“哦,等等。我们可能在这件事上有点错了。”我们在节目后半部分,大概是节目的后三分之一,尼克和里克交谈时提出的那个问题,里克谈到了我们都有的根本的深层人性,我们真的可以彼此同情,机器能做到吗?他说,“嗯,不能。机器显然不能做到,因为机器没有身体。”他是完全正确的。尼克说,“是的,你是对的。但 man,它可以很好地模仿。”问题的一部分是,我们对这种模仿过程有多舒服,而不是一个真实或真诚的过程?如果这是一个模仿过程,但它对机器来说是真实的,那是否足够真实?我不知道这个问题的答案。我只知道这将变得非常有趣,我们将来可能会有其他的谈话。如果你一直看到这里还没有订阅播客,如果你能花点时间订阅,我将非常感激。你也可以在任何地方留下评分和积极的评论。这真的对我们有帮助。你可以在 YouTube 上留下评论,在 Spotify 上留下评论。这也有帮助。我希望这一集能引起很多评论。我对人们对此事的看法非常感兴趣。你完全反对在心理健康领域使用人工智能的想法吗?你完全反对人工智能吗?你是一个人工智能乐观主义者吗?你想随时随地都有一个相当不错的治疗师在你口袋里吗?你对此有什么看法?你可以通过 contactbeingwellpodcast.com 联系我们。我真的很想知道我们会收到什么样的邮件。如果你想以其他方式支持这个节目,你可以在 Patreon 上找到我们。它是 patreon.com/beingwwell。每月只需几美元,你就可以支持这个节目并获得很多奖金。下次再见,感谢收听,我很快会和你谈话。[音乐]