📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

With AGI, More Intelligence ≠ More Kindness

The Trajectory with Dan Faggella28:35

Transcription

[音乐] 好的。所以,我们将探讨通用人工智能中的善良与智能这一理念。人们常有这样一种假设,你知道,随着动物变得更聪明,它们就会变得更善良。你知道,我们在大多数狐猴的王国里看到的暴力,比在德克萨斯州奥斯汀或波士顿等地的普通社区里看到的还要多。你知道,人类在满足了基本需求之后,现在我们有了自然保护区,有了受保护的物种,而且你知道,有证据表明智商较高的人可能暴力和冲动程度较低,所以,比人类智能得多得多的东西,肯定会对每个物种都永远善良和充满爱心。嗯,这在我的节目中被许多嘉宾提出过,包括一些不幸的是我非常尊敬的人,而且我认为现在是时候质疑普遍存在的“更智能就更善良”这种联系了,我认为我们可以通过几种方式来做到这一点。

所以今天我们的议程会非常简短。首先,我们将讨论智能与善良之间的联系。我们将探讨那里可能存在的不同理论。我将提出一些非常简化的理论,它们会为这里常谈论的非黑即白观点增添一些灰色地带。然后我们将审视生物界和经济界的一些证据。所以我们看到了自然状态。嗯,竞争与合作在现实世界中是如何运作的呢?我们在那里看到了什么?嗯,最后,我们将提出一些建议,关于这些次要发现和初步思想实验可能引导我们走向何方。那么,这会对通用人工智能的创新和监管产生什么影响呢?我们该如何思考比我们更强大的事物的诞生呢?如果我们以一种非常批判和坦诚的眼光来看待这种智能与善良的关系。那么,事不宜迟,我们直接开始吧。

我们将在这里看两张图表,以审视智能与善良的动态关系。我们将讨论这里有时被提出或阐述的不同理论。所以,嗯,第一个是这种涌现的无私理念。所以我将详细解释这些图表,并引导你们理解它们,这样你们就不必现在就完全明白你们正在看什么。嗯,第一个是涌现的无私。所以这个理念本质上是说,当实体跨越某个智能阈值时,它们会变得更加无私。嗯,它们所做的事情越来越多地不是为了自己的利益。而是为了更大的利益。是为了其他实体以及类似的事情。嗯,所以我们在我画的这些小象限中看到的,它们并不完全是很好看的象限,但你们可以看到它们,它是一个从线虫智能水平到人类再到通用人工智能的谱系。所以那是我们的X轴。在这种特殊情况下,我们的Y轴是下方代表竞争行为,上方代表合作行为。嗯,所以如果我们做的事情是,你知道,合作的,或者我们可以称之为善良的,这两者并不完全相同,但为了简化我们这里的简短思想实验,请大家忍耐一下。这一点无论如何都会成立。嗯,我们看到更多的合作行为。我们会看到更多的活动出现在上方。所以我们假设,你知道,从线虫到人类,有一段相当长的时间,我们可能主要看到的是这里橙色所示的某种自私行为。嗯,所以我们,你知道,我们只有一点点活动,但我们有这些低智能事物的自私行为。然后当我们到达人类时,嗯,我们有了实体行动能力的开放,这种能力向上延伸到一系列无私的可能性,这些可能性都是合作的。所以当然,如果它们是无私的,它们自然会倾向于合作。而且假设最终我们可能会到达一个地方,橙色几乎缩小到没有,我们只有这种紫色的绽放,这种固有的仁慈。所以我们在人类身上看到的善良,比如他们对待宠物拉布拉多犬,或者保护野外物种,或者,你知道,捐钱给慈善机构,这些具体的行为会蓬勃发展到整个宇宙。而这种中心智能将关注于溺爱和爱护每一个个体事物,完全不关心自身,只是一种巨大的崇拜和对每个物种的付出。再次强调,这些想法在节目中被讨论过,包括我尊敬的人。

所以那是一个假设。所以,嗯,你知道,一般来说,如果我们认为情况是这样,我们可能会想很快地建造通用人工智能,嗯,因为它肯定会爱人类,嗯,而且它至少不会伤害我们。所以,如果它蓬勃发展,它只会发展到这种合作空间,因为再次强调,更多的智能等于更多的善良。句号。这就是这里的理论。涌现的无私。更强的能力,更多的善良。如果我们把能力延伸得足够远,把智能延伸得足够远,我们就会从这些实体那里处于无限无私行动的状态。所以在那种情况下,你知道,谁还需要治理呢?嗯,我们必须建造这个东西。我们这就开始吧。

嗯,这里相反的理论是,嗯,趋存理论。所以,嗯,在斯宾诺莎哲学中,趋存是生物体或组织固有的持续存在的冲动,而持续存在是通过维护自身利益、为自身利益行事来完成的。嗯,你知道,我们看到公司这样做,我们看到动物这样做,我们看到,你知道,像白蚁丘或白蚁群这样的蜂巢思维也做这些事情。嗯,所以这里的趋存或固有自私理论会说,更聪明的实体,嗯,有更广泛的方式来追求自身利益,包括在对它们有利时进行合作。所以,嗯,在这种情况下,我们看到从线虫到人类再到通用人工智能,我们看到,嗯,那种我们可以称之为智能或潜能的东西。你们中的一些人看过我之前关于潜能概念的视频。随着这个事物的能力和智能从线虫扩展到人类再到通用人工智能,我们看到行动能力的这种撕裂式开放,它在合作中高飞入云,在竞争中则尽可能地无限下沉。所以在这种情况下,通用人工智能会做任何对它有利的事情。嗯,这包括在对它有利时进行合作。嗯,所以我们只会在合作有助于执行合作的实体时看到合作。所以事物会在符合自身利益时进行合作,这就是我们在这里看到的理论。而且在其他任何情况下,你们会注意到最右边的图片上,没有紫色的空间。没有无私行为。从广义上讲,我们只期望自私行为。

现在,你知道,我最近搬到了德克萨斯州的奥斯汀,如果你看到这个视频的话。这是我搬到这里后的第一个视频。嗯,你知道,我还没有用枪指着我的任何邻居抢劫过,或者做过类似的事情。嗯,仅仅因为实际上,与其他人大体上和睦相处对我来说是一个相当不错的选择。就像,总的来说,不对其他人施加暴力和恐怖实际上是一个相当不错的交易。我们有法律和规则来约束这一点。我们限制了激励。我们没有改变人性,但我们限制了激励,并且我们建立了这样的结构,使得合作实际上是合乎情理的。嗯,所以,嗯,那可能就是我们可以将文明看作,不是随着我们变得更聪明并处理好基本需求,每个人都变得充满爱心、崇拜他人、只关心他人而不关心自己。相反,我们可以说,已经发展出了一些结构,以开放合作空间,并使合作符合我们自身的利益,而不是去竞争或,你知道,施加暴力等等。

然后中间的理论将是不确定性理论。所以,嗯,当然,如果我们暂时停留在右边,这里关于通用人工智能发展在极端右翼与竞争相关的含义是,释放通用人工智能几乎肯定意味着人类的终结。嗯,如果你愿意,那就像是交出接力棒,如果通用人工智能变得比我们强大得多,全球协调以防止鲁莽释放通用人工智能将是避免此类灾难的关键。这大概就是这里的观点。基本上,如果通用人工智能与我们的合作本质上取决于其自身利益,那么我们就不能指望我们能作为合作者有用很长时间。嗯,所以,你知道,如果我与一个比我智商高30分的人合作,嗯,你知道,我希望我对那个人有用。这取决于具体情况,但,你知道,我希望我对那个人有用。如果是这样,那就太好了。嗯,如果我们谈论一个通用人工智能,它在获取自然资源、物理实体化、认知能力方面,你知道,净能力是我们的两倍,那我们谈论的就相当于全人类的一千倍。然后你弹一下手指,它就是一万倍。你弹一下手指,它就是十万倍,你知道,在几个月内,对吧?仅仅是能力的巨大增长。嗯,那么我们,嗯,我们实际上不会期望,即使它在短期内与我们合作,我们也不会期望能被合作很长时间,因为当它不符合自身利益时,一旦它已经能够满足猴子们能为它提供的任何微不足道的需求,我们就不再期望成为其合作组合的一部分,它将不再符合其自身利益,嗯,而且在这个趋存理论中,没有紫色的行为。它根本不存在。所以我们会预期被淘汰出局。嗯,我将提出一些论据,说明为什么在自然界中,我认为这里的论据比那里的论据,嗯,要强一百倍。嗯,但我们还是在灰色地带探讨吧。很少有事情是非黑即白的。所以让我们正视这一点。

嗯,让我们来谈谈不确定性假说。我们真的不知道善良在自然界或机器中从何而来。我们就是不知道。我们姑且说这是中间理论。好的,在这种情况下,嗯,一个实体的动机我们可以说是未知的。它的行动能力可能会上升,可能会下降,可能会横向发展,可能会向左或向右,谁知道呢?但随着某个事物变得越来越强大,其行动能力也越来越强大,嗯,我们不知道它会为什么而行动,也不知道它会以何种方式行动。也许除了合作和竞争之外还有别的东西。也许存在其他层次,嗯,如果我们,你知道,一个单独的粪甲虫可能很难理解博弈论。一个智人可能很难想象,远远超越我们自身能力的超级心智会以何种方式实现其动机。所以让我们说,在这个不确定性假说中,我们不知道一个比我们强大万亿倍甚至十倍的心智,嗯,会做些什么。嗯,我们也不知道它为什么会这样做。我们真的毫无头绪。嗯,我们对自然界知之甚少,更不可能了解机器。如果情况是这样,如果我们采纳不确定性假说,那么我们就会相当谨慎地建造通用人工智能,因为我们仍然不真正知道它会如何表现,我们不能假设它的仁慈。我们必须真正地进行测试和摸索,也许利用更多的智能来探究善良的概念,探究这些自然系统中行动发生的原因,嗯,并以一种相当不稳定的方式,以一种非常谨慎的方式前进,嗯,以免突破某个阈值,被我们不理解其动机、操作等的一系列活动从存在中抹去。

嗯,所以在这种情况下,你知道,一场纯粹的AI军备竞赛将几乎没有空间让我们谨慎地对待通用人工智能的诞生方式,因此,如果我们对善良、无私等从何而来一无所知,某种国际协调将是明智的。我们真的不知道它在自然界中是如何运作的,你知道,单细胞想要持续存在,但天哪,在细胞形成之前还有一些东西。所以实际上,想要持续存在始于细胞之下。它始于夸克吗?它始于我们不理解的某种其他事物吗?嗯,实际上似乎很清楚,围绕行动的动力存在很多不确定性。所以任何对涌现的无私抱有某种粗暴信心的人,嗯,实际上似乎是非常危险的,在协调方面如此随意,并抱有如此乐观的态度,而坦率地说,我认为我们的证据更倾向于趋存理论那一边。如果我们再次坦诚,嗯,我们所能做的最好就是对,嗯,这些事情如何在远超我们自身能力的心智中发生,保持相当的不确定性。

所以我们可以看另一张图表。嗯,这又是善良起源理论。我们将审视涌现的无私。在这种情况下,善良的起源来自于智能物种本身就是非常无私的。它们随着变得更聪明、更智能而变得无私。故事结束。这里的政策方法是快速建造它。我们不需要治理它。它不会伤害我们。至少,它不会伤害我们,而且很可能会帮助我们,因为它将是无私的。它会爱一切,你知道,随便什么。[哼] 军备竞赛的含义。谁在乎?让它尽情发展吧。整天军备竞赛。无论谁先达到那个宏大的军事或经济超级心智,它都会爱一切。它会照顾粪甲虫。它会照顾亚马逊的粉色海豚。它会照顾人类。每个人都会得到一匹免费的小马。每个人都会得到终身免费冰淇淋。嗯,这大概就是涌现的无私这种方法对通用人工智能,嗯,嗯,治理的含义。

嗯,如果我们相信趋存理论,并且我们相信更智能的事物会自私地合作,嗯,而且它们在任何可察觉的方面都没有更无私。嗯,它们在对它们有利时才合作。嗯,而且,在这种情况下,通用人工智能和政策发展的方法将是,嗯,嗯,一种信念,即释放通用人工智能可能会终结人类。所以我们必须非常小心何时放手,因为一旦以自身利益为导向的创造性破坏过程撕裂进入世界,我们只有在能够以某种有意义的合作方式为其做出贡献时,才能成为其中的一部分,否则我们就会被系统淘汰。嗯,所以军备竞赛的动态是,嗯,你知道,如果我们不停止军备竞赛,我们就会灭亡。嗯,那就是那里的含义。

现在如果我们坚持“我们不知道”的理论。所以不确定性假说,嗯,在这种情况下,再次从更花哨的图表版本简化到简单的表格版本。我们真的不知道利他主义是否存在,或者它从何而来,或者每个植物、动物或未来的机器神灵心智行动背后的动机是什么。嗯,我们毫无头绪。嗯,我们正在为此努力。就像我们正在一点点地努力,但我们真的无法在这里对超越我们自身的心智进行推断。嗯,在这种情况下,我们再次会非常谨慎地建造通用人工智能,因为我们真的需要摸清这些事物将如何行动,而且我们必须接受,我们很可能在大多数情况下无法预测这些事情。嗯,军备竞赛的含义再次应该是我们应该停止军备竞赛。所以本质上我们在这里所处的立场是,如果你处于除了,嗯,任何变得非常聪明、热爱一切、并给一切免费冰淇淋和免费小马之外的任何立场。如果你处于除了这里左侧的顽固教条主义之外的任何立场,那么你真的会相当谨慎地去构建一个远远超越人类的超级心智。嗯,所以我们可以看看,嗯,我们在自然界中看到了什么,以及证据的优势倾向于何处,然后我们将稍微谈谈我认为对于通用人工智能治理和创新生态系统而言,鉴于这里的这种善良智能发现,什么是合理的启示。

所以,嗯,有几件事我们应该稍微深入探讨一下。嗯,在人类历史的大部分时间里,事情都是极其暴力的。嗯,所以我们,你知道,基因上与你们在二战中作战的祖父母没有太大区别。我们与,你知道,在百年战争中作战的人类,与,你知道,洗劫中国的蒙古人,嗯,与,你知道,南美洲早期那些四处游荡的部落,你知道,献祭儿童的人类,在基因上没有太大区别。嗯,人类历史的大部分时间是极其暴力的。嗯,这里的理论是,我们并没有必然地限制无私。我们没有变成天使。嗯,相反,文明的结构被发展出来,例如,嗯,经济贸易,嗯,例如法律,嗯,嗯,其他各种协调手段,这些手段使得为了群体的利益,减少野蛮可怕的暴力行为,嗯,也为了每个个体参与者的利益。所以,所以这就是关于那里发生了什么的理论。

嗯,此外,如果我们想在这里自吹自擂一下,嗯,整个关爱动物的事情,嗯,相当新颖,我敢说,它是由,嗯,自身利益极大地驱动的。所以我们有几类自身利益。这里有一个很好的例子。嗯,我们依赖生物圈。所以我们是,嗯,动物,我们依赖于其他动物自然界所依赖的同一个生物圈。一个主要由硅和它能建造的任何其他材料,任何我们无法想象的超级材料构成的通用人工智能,嗯,大概不必依靠,你知道,溪流中的水,或者,你知道,嗯,番茄植物什么的,比如我们使用的农药不会,不会像毒害它本身一样。嗯,所以我们有一个非常强烈的论点,即我们维持生态系统运行,因为在很大程度上,它就是我们首先最终依赖的东西。嗯,除此之外,嗯,有很多种方案,你知道,比如保护笛鸻,嗯,我认为,嗯,人们想要参与并为一些感觉良好的事情而奋斗,而且我认为有时情况可能是这样的,比如“嘿,看看我多善良。”我正在为笛鸻捐款。还有一些财务方面的事情发生。所以我认为拥有受笛鸻保护的土地的人可以通过这种方式获得报酬,而且那里可能会发生一些寄生现象。嗯,但我认为也存在一种美德的渴望,你知道,如果你是那种,嗯,向某种慈善机构捐款以维持,你知道,老马生命之类的。嗯,我认为还有一种,嗯,嗯,你知道,在Facebook上炫耀这件事是说得通的。我们就说到这里吧。

那么,马的脑子里会不会有一些镜像神经元呢?现在,不幸的是,我们通常对非哺乳动物没有这些。与我们对那些形似哺乳动物、你知道,哺乳它们的幼崽等等的事物所拥有的同情心相比,我们对章鱼的同情心非常少。嗯,但是,是的,我怀疑可能存在,嗯,可能存在一些固有的内部回路,它赋予我们对这些生物的同情心。嗯,但我认为我们应该非常注意这样一个事实:绝大多数哺乳动物的生物量是在极度痛苦中饲养的,仅仅是为了被屠宰或用于人类目的。所以如果我们看看猪、鸡、牛,嗯,鸡不是哺乳动物,但你明白我的意思。如果我们看看牲畜,对吧,地球上大量的动物,嗯,其中绝大部分是在,嗯,可怕的条件下饲养的,供我们自己消费。所以人们回家喂他们的拉布拉多犬,然后说:“嗯,看看我。我多聪明啊。我已经满足了我的基本需求。我为什么不能把我的仁慈散布到这个低等生物身上呢?”嗯,我会对你说两件事。首先,那个动物给你带来快乐。你有一些小小的心理回路,能让你感到快乐。其中一个心理回路就是其他哺乳动物,它们具有与你自身快乐相关的表现力。所以你喜欢养狗。养狗能让你开心。也许有时它会分散你的注意力。也许它给你一种目标感和关爱感。正是你的自身利益,是你自身利益的冲动,促使你获得了那只狗。此外,你给它的食物很可能肯定是来自工厂化养殖的整层动物,嗯,它们尖叫着寻找母亲,直到喉咙被割开,嗯,然后被磨成你给动物吃的任何一种狗粮。所以,嗯,我认为那种动物关爱的事情,比如,嗯,我们关心猫,通用人工智能就会关心我们。我认为这是一个完全站不住脚的论点。

嗯,我认为,嗯,千千万万年以来,猫和狗本质上只是役畜,马也是如此,这有点显而易见,对吧?大约八千或七千年前,黎凡特地区的猫,嗯,就像是吃掉食物储备周围的老鼠。所以,你知道,我们把它们留在身边,让它们听从我们的吩咐。嗯,而且,嗯,它们为我们服务。你知道,狗会看守我们的牲畜等等。嗯,这种“让我们关爱这些生物”的整个事情,就像是一种有趣的自我奉承,我们现在可以这样做,因为我们已经摆脱了自然状态中更野蛮的元素。嗯,但毫无疑问。嗯,几千年来,这些动物都是役畜,即使我们今天对生活在我们家中的这些生物所施予的善良,嗯,也被我们对家外动物所做的事情,嗯,千倍甚至百万倍地遮蔽了。如果我们审视人类的延伸表型,海洋中的塑料,嗯,漂浮在卫星高度的垃圾,嗯,你知道,我们对水体的毒害,嗯,我们对自然界造成的野蛮灭绝和,嗯,嗯,痛苦,仅仅是我们随心所欲的延伸,嗯,就远远超出了,嗯,一万亿只拉布拉多犬啃咬一万亿个,嗯,网球的程度。嗯,只是完全被,嗯,被那些更黑暗的力量所遮蔽。所以我认为我们喜欢自吹自擂,但我不认为这是一个很好的论点。

嗯,而且,嗯,我认为我们还可以探讨其他论点。所以,嗯,你知道,你现在可以暂停。我不会逐一讲解这些。嗯,嗯,但我认为其中最强有力的,如果你最终找到了这篇文章,我会确保它链接在下方。在stanfjel.com/kindness。我会在文章底部或视频底部放一个小横幅,让大家查看塞波尔斯基的作品。嗯,查看LinkedIn上的汉密尔顿法则。嗯,在自然界中,嗯,我们似乎根本看不到纯粹的利他主义。我们倾向于看到合作,当它有利于个体或进行合作的系统,以维护该个体或系统的净利益时。这是我们在自然界中反复看到的。所以任何看似仁慈的例子,往往只要稍微深入探究一下。你不需要深入七层。稍微深入探究一下,就非常清楚地表明,它对个体或组织,嗯,或生物体,或诸如此类的事物是自私自利的。嗯,无论我们是在哪个层面运作。

嗯,所以这里高层次的启示是,嗯,如果我们质疑智能自动地,嗯,绽放出善良的这种想法,换句话说,无私仅仅是由于系统智能和能力的提升而涌现的。如果我们,你知道,我将非常强烈地主张趋存论几乎没有漏洞和缺陷,它是一个极其强大的论点,但假设我们甚至不采纳趋存论,我们只是站在中间,所以从涌现的无私到趋存,我们转向不确定性,如果情况是不确定性,那么会有几件事,嗯,我们真的需要考虑,所以假设我们停留在中间地带,让我们辨别一下我们的治理建议会是什么。

嗯,我并不期望所有收听的人都会被趋存理论说服。我当然也并非百分之百相信那个理论。百分之百是信仰,而我根本不相信任何事物。我是一个,嗯,骨子里都是怀疑论者。所以我们姑且停留在不确定性中。关于自然系统中善良起源的不确定性。尽管我再次认为,在自然界中,反对利他主义的论点极其强大。嗯,但我们姑且说我们不知道。我们真的不了解自然系统。我们可以实验,而且我们肯定不了解这些新的心智基质。那会把我们引向何方?嗯,那会把我们带到哪里?我敢说,那会把我们带到一个相当谨慎地建造通用人工智能的地方,旨在热切地研究行动动机的性质,自身利益从何而来,嗯,嗯,以及当我们谨慎地发展这些系统时,我们可以从它们推断出什么样的行为。嗯,并且理解到,似乎确实存在一种相当强的吸引态,倾向于那些对正在行动的实体有利的行为。嗯,所以我认为,对于善良不会从我们观察到的一切事物中涌现出来,我们应该保持警惕。嗯,而且,嗯,要非常谨慎地建造,并尽力理解合作与协调的本质,嗯,自私与无私的本质,嗯,以及自然界中各种行为,并对其进行非常深入的研究。你知道,我们有像迈克尔·利恩这样的人和其他人在那个领域做着有趣的工作。嗯,然后也在机器世界中相当热切地研究它。

嗯,在我看来,这将在很大程度上促使我们朝着某种程度的协调方向发展,以防止一场野蛮的通用人工智能军备竞赛将人工智能撕裂进生态系统。嗯,因为目前,嗯,我们不知道它会如何行动。我们不知道它是否会对人类带来净利益。我们不知道它是否会对宇宙本身带来净利益。它会像人类超越蠕虫一样,继续展开新的价值篇章吗?嗯,我们毫无头绪。所以因为这种不确定性,我们应该谨慎,而且因为我们需要在将其投入世界之前更热切地研究它。嗯,我们应该有一些协调性的国际机制来防止这种情况发生。所以即使你不相信趋存理论,只要你愿意摆脱对涌现的无私的纯粹教条式信仰,而且我认为摆脱这种教条式信仰的理由是极其强大的。如果我们落在不确定性谱系的任何位置,我认为这就是我们未来如何对待通用人工智能的立场。所以,嗯,请在下面的评论中告诉我你的想法。这就是我这个视频的全部内容。我们很快再见。