Transcription
[掌声] 非常感谢。在这个背景下发表演讲,既有点鼓舞人心,又有点令人恐惧,但我很高兴来到这里。非常感谢您的邀请和各位听众。所以,我想立刻说明,以免让您失望而离开,我不会回答那个问题。那是因为我不是一个未来学家,我是一名科学家,我实际上不相信做出关于未来的预测。我相信的是让未来发生,而这正是我试图通过我的工作来做的。所以,我将告诉您人工智能如何帮助我们更好地理解社交互动,人工智能如何创造能够唤起人们在日益技术化的世界中进行自然社交互动的系统,以及人工智能如何以一种方式构建,使其能够成为基石,人工智能如何以一种方式构建,以确保——不是确保,因为我们不知道——而是为人类互动奠定基石,当我们走向未来时。但在我展望未来或就此而言展望现在之前,我想稍微谈谈过去。我的一位朋友给我发了这张照片,它提醒我们对新技术的感受历程。它总是以希望开始,关于技术将为我们做的一切美妙的事情。所以,电视机将提高学校成绩,改善家庭生活,你们都知道后来发生了什么。它将摧毁成绩,摧毁家庭生活。人工智能也是如此。就在几年前,我们都对人工智能将带来的所有事物感到兴奋。而现在,我们都对人工智能将带来的所有事物感到恐惧。当我开始思考这个问题时,我意识到这种讨论确实非常普遍,我们不应该忘记它。我开始翻阅报纸,这是第一份,一封给编辑的信:“我的孩子脑子里想着谋杀,我知道是因为那些可怕的事情。”第二份是一本由美国政府出版的小册子,关于如何与您的孩子相处。有几件事需要练习:不要害怕它。这些东西很可能将一直存在。不要害怕您的孩子。他不是来这里永远停留的,他是一个珍贵的访客。不要惹恼您的孩子,然后让他自己去玩,没有指导。不要启动它,然后让它看着您的孩子。机器是糟糕的唯一伴侣,它需要帮助。您可以帮助它。爱您的孩子。现在,您可能已经通过修辞手法猜到了,第一个引述是关于广播节目,第二个引述是关于电视。所以,我们对新技术的恐惧,艾伦·凯(Alan Kay)曾说过,新技术是指在我们十几岁之后开发的任何技术。所以,我们对新技术的恐惧并非新鲜事。事实上,我还有另一句引述,我不会与您分享,是一位牧师关于印刷术对宗教的危险的看法。所以,这真的不是什么新鲜事。但我认为这是我最喜欢的关于特别是年轻人恐惧的文章。我的工作不仅仅集中在年轻人和社交方面,我也关注成年人。但我选择今天集中在我处理儿童方面的工作,以便进行讨论。所以,这是一篇关于一位父亲的文章,他因为发现女儿在网上认识了一个男人而变得非常激动,实际上带着枪去了这个年轻女子的约会地点,打算杀死那个年轻人和他的女儿。所以,这是一个女孩的父亲在布鲁克林经营报摊,他得到了这个东西来帮助他处理电子订单。但对他来说,这是新技术。他请女儿帮忙,当然,她开始用它来认识人。长话短说,这篇报道发表于 1886 年,哦,是关于电报的,它并没有完全达到预期的效果。文章的标题实际上是“有线之爱”。所以,这真的应该提醒我们,当我们想到对技术的恐惧时,可能不是对技术的恐惧,而是对年轻人的恐惧。我写过,在我看来,这种恐惧的基础是对年轻人能动性的道德恐慌,特别是年轻女性的性能动性,但各种能动性,即世界可以在您不知情的情况下进入您家的门,这是不行的。我认为这才是这种恐惧的真正基础。当我们看成年人时,我看到的大部分关于人工智能的东西,在我看来,更多的是关于我们变成了什么人的道德恐慌,而不是技术变成了什么。我们是否变成了能够犯下巨大罪恶的人,以至于我们可能利用技术来伤害世界而不是造福世界?所以,在这一切之中,我自己的研究项目是我从语言学和心理学研究生时期就开始执行的一个项目,那就是更好地理解我们如何工作、玩耍和学习,两者兼顾。如果您想知道,我必须远离麦克风,因为我自己的非语言行为有点过分。我曾因用叉子刺伤旁边桌子的人而被餐馆赶出去。我当时正试图解释尼亚加拉大瀑布,叉子翻了过来,我的盘子飞过房间,落在了他的衬衫上,我被餐馆赶出去了。我当时 16 岁,显然,前进的道路是研究这种事情。总之,我自己的研究最初是关于人与口头和非口头行为之间的关系的研究,以及它告诉我们关于心智、心理表征和认知的信息。我越来越对口头和非口头行为之间关系的社交方面感兴趣,也就是有时被称为赫伯·克拉克(Herb Clark)等人所说的联合行动,我们的互动不仅仅是各部分的总和,而且存在只能用二元组或多方互动来描述的现象。我们如何理解它?它有什么用?所以,我们如何更好地理解它?它能做什么?就我个人而言,我作为一名优秀社会科学家,对理解这些行为感兴趣,并利用我拥有的这个新工具来构建能够让世界变得更好的干预措施,并能特别支持我们在世界上工作、玩耍和学习。我还有两个我耿耿于怀的问题要解决。一个目标是人工智能的长期目标是自主性,因为人工智能始于 1950 年代的梅西讲座,旨在制造像人类一样思考和行动的机器。这让我们进入了一个时代,一个像人类一样的自主性是我们的目标。但我们不是自主的,我们是深度相互依赖的。所以,如果我做得好,有一天我们将不再说我们的目标是机器的自主性,而是相互依赖性,我们不再用机器取代人类,而是制造能够与人类紧密合作的机器。最后,这真的让我很生气。我之前说过,我说过今晚要找个更客气的说法,但我没找到。所以,当计算机科学家、工程师和其他人谈论人类行为时,将其视为软技能或容易的事情,或者像我以前在麻省理工学院的学生在我教了一段时间之前所说的那样,是常识时,这真的让我很生气。这根本不是常识。如果我们考虑理论上的优雅,对我来说,我工作中跨越界限的理论上的优雅,是用优雅的理论来解释人类互动中的数据,这些理论将常识呈现为并非易事的事情。我认为这是任何从事工程和社会科学工作的人的一个重要目标。那么,我所说的,正如我一开始所说,利用人工智能来理解人类行为,如果我们不知道它是否意味着社交互动的终结,那么用它来更好地理解社交互动又意味着什么呢?我将从一个例子开始,只是为了抓住您的注意力,然后我们将非常非常简短地讨论这个例子。我不会详细讨论这项研究,尽管我很乐意回答有关它的问题,然后我们将更深入地研究一些研究。[音乐] 也许我们应该把它放低一点,这样它就没有那么多翻滚的空间了。这显然是一个害怕技术的孩子。这不是这项技术在他十几岁之后发明的。在我研究儿童与此类技术互动的大约 25 年里,我被反复告知,我正在摧毁童年。事实上,我第一次展示一个虚拟孩子时,有人站起来说:“你是邪恶的。”一位非常著名的计算机图形学教授。我的第一个想法是,至少他没说平庸。我当时还没有获得终身教职,我认为平庸比好或坏更糟糕,所以我感觉还好。但这在我所做的工作中被反复提及。事实上,有一次一个电影摄制组来,他们说:“你是在教孩子们变成机器人吗?他们以后还会知道什么是真正的社交互动吗?他们会想花时间与完美的虚拟孩子在一起吗?”所以,我们做了一个简短的研究,让孩子们找出他们是否知道这些是机器而不是真正的孩子。我们从每一个孩子那里得到了完全相同的答案。所以,这些孩子是真正的孩子吗?他们还活着吗?不。这似乎是一个非常有说服力的答案。从那时起,那已经是 20 年前了。从那时起,我们反复得到相同的答案。所以,父母们仍然像 25 年前一样担心,孩子们将不知道区别。而孩子们普遍认为这是他们父母又一个愚蠢的特征。这项关于这个孩子如此舒适地使用这项技术的研究,是为了研究方言对儿童学习的影响。我们本来会用真正的孩子来做这件事,但 IRB 不允许我们在真正的孩子大脑中植入电极,以控制他们所说的话。所以,我们开玩笑说:“天哪,你们不收国王的。”所以,我们不得不使用人工智能来研究这一点。我们真的找不到一个自然的情况,我们可以控制孩子们对方言的使用。在这里,我们有两个条件。一个条件是虚拟孩子在整个互动过程中都说主流美式英语。第二个条件是虚拟孩子用非裔美国人白话英语与真正的孩子进行头脑风暴,然后说:“我的老师喜欢我用我的学校英语,让我们为老师练习我们的演示文稿。”实际上,两个条件都说了这句话,但一个条件是主流的,另一个是白话的。我们发现,在与双语代理的合作中,孩子们在实验结束时科学话语的使用有所增加。但有趣的是,这个结果是由孩子与该代理的感受到的融洽程度所调节的。我们使用了一种名为“薄片分析”(thin slice analysis)的技术,由社会心理学家纳利尼·安博迪(Nalini Ambady)开发,她最近不幸英年早逝。我们让一些不知情的参与者对这些视频进行融洽度注释,分成 30 秒的片段并随机化。所以,那些显示出融洽度的人,也就是代理是双语的那些人,导致了更多的科学话语。所以,这是你可以做的事情,而无需安装。我再给你一个提示,所以你可以做到这一点,而无需在孩子的大脑中安装电极。融洽度,为什么是融洽度?融洽度对我来说特别有趣,部分原因在于这种二元性。它是内在的二元性,你无法研究一个人的融洽度。我感兴趣的是那些比个人单位更大的现象,它们也很重要,它们是社交互动,但它们已被证明对任务表现极其重要。而且,为任务表现获得资助比为社交互动获得资助容易得多。它们已被证明强大的任务表现类型,如教育、调查访谈,调查访谈特别有趣,因为它有一个好的切入点,即如果有融洽度,人们更愿意完成访谈。但如果融洽度过高,受访者可能会回答他们认为访谈者想让他们回答的问题。所以,必须有融洽度,但不能有太多的融洽度,这很有趣。与患者建立融洽关系的医生会招募更多的患者参与试验。当然,销售,我们都知道人们总是在试图与我们建立融洽关系。前几天,我真的很讨厌人们说“我们”,当不是“我们”的时候。实际上,贝蒂,是的,你不得不忍受这个。我真的受不了。我不得不向餐馆的服务员指出,他们不是和我一起吃饭。所以,“我们正在享用甜点吗?”不是描述情况的方式。两天前,一位女服务员这样做了,我说:“你知道,你人真好,我们建立了融洽关系,所以我可以告诉你,我真的讨厌人们这样做,因为这不是‘我们’,而是排他性的方式,那不是‘我们’,而是‘我’。”那个女人说:“但他们告诉我们这样做,这是他们告诉我们我们会得到更好的小费的方式。”哦,当然。所以,这种建立融洽关系是我们自然而为之的,也是我们被教导如何做的。我和我的学生花了六个月的时间跟着一位房地产经纪人转悠,因为他们卖给你一生中最昂贵的东西,而且他们非常擅长建立融洽关系。我知道这个特别的经纪人是因为她卖给了我一套我买不起的房子。所以,跟着她转悠,我们能够非常精确地预测融洽度在哪里建立。它建立在古芬(Guffin)等人称之为“威胁面子”的时刻,也就是说,在问你“你赚多少钱”这样的问题之前,房地产经纪人会做一个看似是话语上的死胡同,比如“你什么时候期待孩子出生?”但然后会干净利落地回到“孩子将于三月出生,你需要在那之前搬进房子。”她现在知道她已经把他们逼到了绝境,她可以卖给他们任何房子,无论价格多少,因为他们只有两个月的时间搬家。所以,这些建立融洽关系、建立信任的时刻实际上是受规则约束的,即使它们看起来像常识。这是我唯一一次会说“常识”这个词,但它真的很重要。所以,这很棒,而且有很多社会科学研究。但我们为什么要让电脑建立融洽关系呢?在自然语言处理的历史上,有很多关于人们协作完成任务的工作。例如,芭芭拉·格罗斯(Barbara Grossee)早期对人们组装飞轮的研究发现,相当多的数据被丢弃了,因为它无关紧要,只是社交闲聊。这对我的学生和我来说是一个挑战,我们设法获得了一份来自卡内基梅隆大学一位毕业生的数据集,她也在分析同伴辅导以获得她的博士学位之前丢弃了大量的闲聊。我们想知道,如果我们包含那些被丢弃的东西,我们是否能更好地预测孩子们在代数方面的表现。事实上,我们可以。结果是,通过分析无关的社交闲聊,我们可以更好地预测哪些二元组会学习。所以,我们自然而然地与彼此进行这种交流。如果我们将来要与计算机协作,而我们越来越多地这样做,那么它们也应该能够做这种能提高我们任务表现的事情。同样,我们现在生活在一个手机里,花在手机上的时间比花在任何其他实体上的时间都多。我们一生中都会花时间与它在一起,也许不是同一个,如果我们幸运并且有足够的钱,我们每六个月就会买一部 iPhone,或者至少苹果公司是这样想的。而像 Alexa 这样的公司正在——如果您不知道这一点,您应该知道——正在大力努力将 Alexa 推广到所有平台,这意味着从您的手机到您的笔记本电脑,到您的冰箱前面,到您家的墙壁,这样您就会一直有一个代理陪伴着您,这个代理当然没有其他目标,就是让您感觉良好。但如果您相信这一点,我也有座桥要卖给您。所以,如果计算机要有效,并且要有效地实现我们的目标以及它们自己的目标,那么它们就需要知道如何进行不仅仅是命题行为,即传递信息,不仅仅是互动行为,即管理对话和互动,而且还要进行社交行为,即管理我们始终拥有的这个目标,无论我们的其他目标是什么,那就是与我们身边的人建立关系。如果您不相信这一点,那就站在公交车站等一段时间,问问自己,为什么您周围的人都在谈论天气,而他们本可以闭嘴看报纸。我们的构造方式就是,八卦和社交互动是我们的一部分。但由于我在社会科学方面的背景,我构建的系统能够进行社交互动的方式与许多计算机科学家不同。也就是说,而不是——我不是在贬低计算机科学家——而是坐在我的扶手椅上反思什么是社交互动,我实际上是在详细地研究社交互动。所以,我首先想到的是人类行为中被低估的领域,特别是如今被低估的社交互动,以及为什么这些行为的模型缺失,因为我们没有工具来研究它们,或者没有足够的数据来研究它们,等等。所以,正如我刚才所说,最近我一直在研究融洽度。我和我的学生们研究了数百小时人们在尽可能生态有效的环境中互动的场景,并且仍然能够收集数据。然后,而不是直接转向技术——许多计算机科学家就是这样做的,他们收集几个人的数据,然后将其转化为计算机系统——我们通过一个模型,并且越来越多地通过一个解释这种行为的理论。这个理论是预测性的,而不是描述性的。也就是说,当我们完成这个模型时,我们知道,给定 X 行为,Y 行为更有可能发生。正是这个模型产生了我们实现到系统中的算法。如果这一切看起来非常抽象,我将展示例子。我一遍又一遍地重复,因为这是学习的最佳方式,至少虚拟同伴是这么说的。然后我们进行评估。在这种特定情况下,评估非常困难,因为这些是端到端系统。我以最直观的方式了解这一点。昨晚我在酒店房间里,我打电话给一个视频,我让我的一个学生发给我。当我的学生为我制作这个视频时,视频中有一个东西坏了。所以,虚拟代理就像这样站着说:“哇,我也喜欢那个。”我们无法不解释,我们就是这样构造的,我们解释每一个行为。所以,我们将其解释为对那个人所说的话或代理所说的话的评论。所以,这些评估需要有运行良好的技术贯穿其整个流程,才能看到发生了什么。而总是发生的事情是,我们发现我们忽略了人类行为的某个基本部分,我们需要回去。这很好,因为这样我就有很长的工作要做。所以,我多年来观察了许多许多情况。我看着孩子们和其他孩子一起玩。我比较了孩子们和父母一起玩。我看了研究生讨论他们的研究。有很多关于地图和指路的工作,关于话题转换的工作,我们能够表明,巨大的话题转移——不是巨大的转移,而是躯干的较大转移——伴随着话题的转移。所以,我和我的学生们喜欢在事情顺利时,能够发表一些关于社会行为的论文,这些行为以前是未知的,比如臀部转移伴随话题转移,然后利用这些来构建一个系统,该系统对人机互动产生积极影响。并不总是这样,但这是我们的目标。中间是我和一对不幸的年轻夫妇,他们期待一个女孩,等等。所以,很多很多不同的情况。我将举两个例子。这是我们去年收集的关于线性代数同伴辅导的数据。线性代数很好,因为它包含了学习的各种不同方面。我们可以进行预测试和后测试,我们可以查看特定的问题,我们可以查看尝试了多少问题,解决了多少问题。它有很多细节,允许我们进行严谨的工作。我们设置的方式不是为了误导,而是告诉这些孩子,你们将通过 Skype 工作,我们需要设置一些东西,你们先随便聊聊,我们来设置。我们想看看他们是如何互动的,然后我们给了他们问题集,他们一起解决了。然后我们说:“好的,等等,我们马上回来。”所以,他们又互动了一会儿。然后孩子 B 辅导孩子 A,他们交换了角色。然后最后,当我们在进行收尾工作时,他们又互动了一会儿。我将在这里展示两个例子。这是第一个。我们学校作为我们数学项目的一部分,我们在高中之前做 Keystone 考试。我必须处理它,然后,是的,现在好了,说出来吧。多项式因式分解是我之后唯一失去的东西。总的来说,它对我来说没有太多意义。我的意思是,它对我来说有意义,但它似乎不像几何和代数那样常见,但多项式因式分解,那都是一些不那么具体的东西,它们就像那些可触及的动词一样。所以,你会说他们有很高的融洽度吗?你最后说的话。那是什么意思?不,他们没有。你只需要听完这段对话的结尾。我们没有对话话题了。然后另一个孩子说:“好吧,看看那个。”我发现看这个很痛苦,我不知道你怎么样。那个孩子非常努力地想让这件事奏效,但他们根本没有表现出融洽度。所以,如果你认为不存在我们称之为融洽度的现象,如果你认为只有彼此了解的人才有融洽度或没有融洽度,这是一个非常具体的陌生人之间融洽度或缺乏融洽度的例子。所以,让我展示一下下一个是什么样的。一分钟,就像最简单的事情一样,就像那些图表,然后就像一些小的乘除的东西,是的。然后突然之间,就像字母,字母,变量,你知道,是的。我真的不明白大部分。我的意思是,我明白我现在纸上的这些东西。我的意思是,我明白了,但是哦,就像这样,就像这样,就像这样,从代数到代数一的过渡,真是太荒谬了。是的,你知道,有时对我来说压力很大。你知道,嗯哼,不喜欢那样,不喜欢数学。是的,我的意思是,唯一喜欢数学的孩子,我的经典名字是雅各布,他基本上痴迷于几乎所有科目,所以我真的不应该谈论他。好吧,我将在这里停止。与第一个视频有区别吗?是的。同样,陌生人,他们以前从未见过面。你看到的那种事情,我试图在你看的东西和你解释的东西之间做一个非常具体的区分。导致你将其解释为融洽度的东西包括身体运动的增加,更多的微笑,更多的眼神交流,更多的自我披露,也就是说,谈论关于他们自己的事情,更多的所谓的“同步”,说话方式越来越接近,语速也越来越接近。所以,我们可以解释我们对面的人或我们看到的两个人表现出的行为,是显示融洽度还是不显示融洽度。继续。我们分析这些东西。我们实际上以非常小的粒度进行分析,每秒 1/30 秒。我们观察每一次眉毛抬起,每一次眨眼,每一次点头,每一次移开目光,每一次手部动作,每一次自我披露和赞扬。顺便说一句,这个年龄段的团队之间没有赞扬。我认为我们有大约 300 个视频,300 小时的视频,我相信只有两个赞扬的例子。所以,我们以非常精细的粒度进行观察。而且,由于我做了很长时间,我们越来越多地使用机器学习来完成这项工作。所以,我们进行数据挖掘,这是序列挖掘,以便能够通过输入事件,如融洽度或眼神交流或任何其他事件,来预测学习收益等结果事件。我们使用一种叫做时间关联规则的技术,使用一种名为 T-taro 的算法,这是我的博士生之一 Ran Jiao 将其变成了一个实时系统,这样我们就可以在代理中使用它。但这让我们能够发现非常酷的东西。我的意思是,成百上千条这样的规则被吐出来。我选择了一个可以理解的,但如果导师,无论导师是谁,然后微笑,然后被辅导者戏弄导师,然后两个导师微笑,然后被辅导者我认为是自我披露,披露了一些东西,那么融洽度就会上升。所以,这些是规则允许你看到的。它使我们能够以一种肉眼难以理解的方式来理解社交行为,因为它可以查看那 300 小时的视频,并从中提取成百上千条规则,然后对它们进行分组,然后将这些规则分组作为理论的输入,也作为算法的一部分。现在,理论的输入看起来是这样的。这来自于 Ran Jiao,我的博士生,对社会心理学、认知心理学、教育学、社会学、民族方法学等领域文献的大量梳理。它使我们能够看到行为和融洽度之间的中间步骤,并将其转化为一个过程模型,比任何东西都更接近于产生一个代理。我说过,我们首先建立一个模型,然后我们实现它。这些是我和我的学生多年来的一些实现。你可以看出这已经很长时间了,因为在左上角是第一个房地产经纪人,它运行在四五台联网的计算机上,其中一台是 Silicon Graphics Reality Engine。现在它运行在一台笔记本电脑上。在左下角是房地产经纪人的一个较新版本,更漂亮。所以,实现架构是这样的,它包含一些我们不得不自己开发的模块。而这正是我们感兴趣的,我们采用人类行为,并开发计算机科学家在自然语言架构中通常不会开发的模块。在这里,真正有趣的是对话策略分类器,它接收传入的语言,并能够以高精度、高准确度自动判断它是自我披露、赞扬、引发自我披露的问题、违反社会规范还是遵循社会规范等等。这是输入到一个名为“融洽度估计器”的模块中,该模块每 30 秒评估一次融洽度,不是在个人身上,而是在个人与代理之间,使用来自个人和代理的数据,就像我们有两个人在场时一样。来自该模块的数据,一个介于 1 到 7 之间的数字,表示融洽度上升或下降,进入一个名为“社会推理器”的模块。与您通常在自然语言系统中找到的推理器不同,它能够推理接下来说什么社交话语才能提高融洽度,保持融洽度,研究融洽度,我们可以打破它,但我们倾向于不这样做。所以,我将展示一个实现示例。我将展示两部分,因为我展示了两个社交部分。这是孩子和代理的部分。这个代理是基于你看到的关于两个孩子的数据构建的。这个代理首先和孩子闲聊,然后我将展示一个任务部分。嗨,我是凯登。小心你的膝盖。很高兴认识你。所以,酷的是,这些是可以的。我去上网络学校。[音乐] 你几年级?我四年级。你做什么来玩?我喜欢玩机器人足球。我们在实验室里玩得很开心。所以,在 C... 哎呀,你可以看到这个女孩在蜂箱里进行相互的自我披露。她在问问题来引发自我披露。我不知道那是什么。嗯,有趣。啊,好了。她在做和高融洽度的孩子之间做的事情一样。这是辅导课程的一部分。不,贝卡,不太对。别担心。我认为这些很难。哦。[音乐] 是的,我认为是对的。那么,你认为接下来应该做什么?我将划分时间。真是个好老师。好吧,我们开始吧。所以,你对正在发生的事情有了一个概念。而且,你再次看到了孩子们的反应,他们被这种自我披露所吸引。负面的自我披露,这对于青少年来说效果非常好。我们有一个孩子说:“我以前很喜欢,我以前养宠物,但后来我把它们弄死了,我妈妈不让我再养了。”我们从来没有真正弄清楚。这种负面的自我披露,“我也很糟糕”对于这个年龄的孩子来说真的很有启发性。所以,你对这个辅导为什么如此有效有了一个概念。然后我们进行评估。我告诉过你评估很难。所以,我们使用许多许多种评估指标,薄片融洽度评分等等。我只想快速举一两个实验的例子,从头到尾。一个实验——它不是一个真正的实验,因为它始于民族志,然后是一个研究,然后是一个实验,然后是一个实现,然后是另一个实验。但我们目前正在进行一个关于好奇心的研究项目。每个人都在谈论下一代技能,孩子们应该在学校学习,包括好奇心。但说到底,你在每所学校都找不到好奇心,尤其是在资源匮乏的学校,那里的学校资金取决于考试成绩。存在一种“为了考试而教”的环境,这意味着好奇心实际上正在被系统地扼杀,尤其是在那些学校,但在许多学校也是如此。我们做的第一件事是在三种环境中进行民族志研究:学校环境、课后项目和我们的实验室。令我的博士后感到震惊的是,我说:“我们不会在学校或课后项目里寻找任何关于好奇心的东西。”老师让孩子们拿起一块石头,然后说:“闻闻石头。好的,写下你闻到的东西。”孩子们看起来就像“请让大地裂开把我吞下去”。这根本不是有意义的好奇心。这很有趣,因为有很多关于儿童好奇心的研究,来自乔治·洛温斯坦(George Lowenstein)等一些非常出色的研究人员,但没有人研究过好奇心的社交性质或好奇心的社交诱因。这是一个真正的研究空白。所以,如果我们要在学校里寻找那些老师没有激发、保护或启发好奇心的孩子,那么同伴可以做到吗?这就是我们要去研究的。所以,我们让孩子们建造一个鲁布·戈德堡机械装置,他们很喜欢这样做。我们给他们铁丝和纸杯之类的东西,让他们建造一个可以让弹珠滚下去的机器。我们有八个摄像头对准他们。我们有一个整体的摄像头,有一个顶部的摄像头,这样我们就能看到手。我们有一个每个躯干的摄像头,实际上不止八个,还有一个每个脸的摄像头。我们观察了一系列行为。我们进行了一次非常完整的注释,其中一些注释是自动完成的。然后我们进行了连续时间结构方程分析,看看我们分解的好奇心部分是否真的站得住脚,以及哪些行为识别了好奇心。以下是一些识别好奇心的行为:对任务的积极情绪,头部姿势的移动,负面评价,惊讶等等。所以,这些是让我们能够识别好奇心的行为。这很重要,因为如果我们想构建一个能够自动识别和保护好奇心的系统,我们就需要能够识别它。所以,这是第一步。第二步是哪些行为会诱发好奇心。在这里,我们发现了一个非常惊人的事情,那就是其他孩子的行为比孩子自己的先前行为更能预测目标孩子的好奇心。也就是说,孩子在时间一、时间二、时间三、时间四、时间五、时间六的行为,在时间七的好奇心预测性不如孩子二到四在群体其他成员中的行为。这些是我们发现的一些事情。孩子们说:“不,那是个糟糕的主意,那行不通。”这是好奇心的良好预测因素。孩子们会生气,所以他们会寻找能奏效的东西。我们发现,当孩子们一起想出一个解决方案,然后批评这个解决方案并试图改变它时,群体就会变得好奇。我们发现,被口头表达为想法然后被争论的建议会引起好奇心。被口头表达然后被别人为该想法辩护的想法也会引起好奇心。所以,这里有很多孩子们为其他孩子做的很酷的事情来激发真正的好奇心,而这些都没有得到跟进。所以,我们既进行了相关性分析,也进行了因果性分析。这些是一些因果影响。这里有一些好奇心的因果诱因。而,哎呀,我将举一个例子。所以,如果第一个孩子说:“我的意思是,它会足够强,但球怎么会再次滚上去呢?”而孩子们说:“哦,不,这些不够强。”而孩子三有一个想法:“我有一个想法,我们可以用两个,如果我们有一个足够深的凹槽,球就会滚下去。”所以,P3 的好奇心从 P1 的想法口头表达和辩护,然后是 P2 的负面评价中增加。这是其中一个例子,显而易见,这是常识,但这是我们尚未解释,也未以任何方式使用过的常识,无论是理论上还是干预上。所以,这是我们正在构建到虚拟同伴中的东西。它包含了最令人惊叹的人工智能挑战。而那位才华横溢的硕士生 Bhargavi Paranjothi 一直在构建诸如好奇心识别器、一个解释机器,它只使用孩子们使用的短语来解释事物,进行命名实体识别,然后利用这些实体进行解释,这真是非凡。你可以看到她称之为“以儿童为中心的建模”的数据,这使得她能够构建一个生成像这些孩子一样的话语的机器。我们仍在努力解决我们能够自动识别孩子所说的话的部分。随着孩子年龄的增长,这越来越难,因为语音识别对于尖细的声音或从一个话语到另一个话语变化的声音效果不佳。所以,这个实现的输入,我们已经开始了这项工作。Jen By,这个项目的博士后,来自实体界面背景,对增强现实感兴趣。她一直在研究一种让孩子们玩一个游戏的方法,其中虚拟孩子是玩家之一。在这里,我们正在与 Jessica Hammer 合作,她是一位 HCI 领域的教员和游戏设计师,她开发了一个能够激发假设形成和证据推导的游戏。这就是我们用来让虚拟同伴与孩子一起玩的方法。接下来,我们将研究群体好奇心,它比二元组的总和或个体孩子的总和更重要。我们如何看待好奇心的整体?我们能做什么?我将非常非常简短地谈一下,因为这对于我最初的论点至关重要,即人工智能可以形成一个使用社交互动的方式。这是我很久以前做的工作,大约九年前,研究了像这样的 AI 系统——再次是虚拟孩子。我并非整个职业生涯都在构建虚拟孩子,尽管它们更容易喂养,而且当你告诉它们时它们总是会睡觉。我也构建了各种各样的系统,但在这个特定的例子中,因为大约十年以来,父母们在讲座后会来找我说:“请给我这个软件,我有一个自闭症或阿斯伯格综合征的孩子,我知道他或她会非常喜欢它,并可能从中学习到一些东西。”我过去总是说:“我真的很抱歉,我没有这方面的专业知识,我不想做,除非我知道我在做什么。”然后我有一个对此感兴趣的研究生,她知道她在做什么,我和 Andrea Tartaro 一起做了这个。她为她的博士学位做了这个,这是一项非常令人兴奋的工作。所以,首先,我们只是观察了被诊断为阿斯伯格综合征或高功能自闭症的孩子,我们看着他们与真正的同伴或虚拟同伴玩耍。我们发现,在与虚拟同伴互动的环境中,使用了更多的社交技能和更高级的社交技能,例如对其他孩子所说的话做出相关回应。这很酷,而且确实很引人注目。父母和老师们看到这个孩子说:“哦,你做了饼干,我也要做饼干。”他们并没有期望出现这种有意义的相关行为。但我们不希望患有阿斯伯格综合征和高功能自闭症的孩子余生都在与虚拟孩子互动。这不是目标。所以,我们的问题是,就像构建这些系统让我们了解社交互动一样,它能否让患有自闭症和阿斯伯格综合征的孩子了解社交互动?特别是,我们开发了一个名为“作者虚拟同伴”(Author Above Virtual Peer)的系统,我们给了孩子们一个虚拟同伴的控制面板,并让他们为另一个房间的孩子控制虚拟同伴。一个患有阿斯伯格综合征的孩子对我们说:“我们有点赶时间,我们会在同一个房间里和孩子一起做。”她说:“不,当我构建一个虚拟事物时,我喜欢在不同的房间里。”这让我们有点惊讶,因为我们不知道她有构建虚拟事物的历史。但显然她有。所以,我们让孩子们“作者”行为,实际上首先是控制虚拟同伴,然后是开发新行为并将其添加到控制面板中。他们所做的是,首先他们将按钮拖放到控制面板上并使用它。然后他们看着与另一个房间的孩子互动,并被问到他们是否对此满意。如果不满意,他们可以回去更改。然后他们可以录制片段,添加行为等等。我们确实发现了一些变化,但更重要的是,我们发现我们可以更好地理解发生了什么,例如,可能影响互惠性的行为,就像你在典型青少年中的融洽度建立中所看到的。所以,一个孩子的面板说:“想听个恐怖故事吗?”如果你说“是”,那很好。如果你说“不”,那就太糟糕了,因为我要讲了。这是一个非常典型的阿斯伯格综合征式的故事开头,但它不会邀请与另一个孩子的太多互动。那个孩子说:“在看了互动之后,我应该使用更多的提问按钮。我可以再试一次吗?”这太疯狂了,因为那个孩子意识到,而与自闭症和阿斯伯格综合征儿童一起工作的老师们告诉我们,似乎有一种“热度”或者说“被烫伤”的感觉,当这个人群中的孩子不得不与其他孩子互动时,这几乎让他们僵住了。而现在他们可以从远处做到这一点,并与互动保持一定的距离。当然,圣杯,唯一重要的问题是,它是否能让他们与其他真正的孩子进行更令人满意的互动?事实上,我们确实发现了一个转移效应。我们进行了一项研究,让孩子们使用目前最先进的“社交故事”(social stories),孩子们阅读非常非常规则化的故事,并被告知规则:当有人问你问题时,你应该问一个问题回来。当有人说“你好吗?”时,回答是“我很好,你呢?”一些非常非常刺激反应的行为。如果你与以这种方式学习社交行为的个体互动过,你就能看到这一点。所以,在这个组中,孩子们被平衡了。一些人通过社交故事学习了一些行为,一些人学习了其他行为。而那些孩子通过虚拟同伴学习了其他行为,反之亦然。所以,每个组都通过社交故事学习了一些东西,也通过控制和作者化虚拟同伴学习了一些东西。结果是,通过作者化虚拟同伴学习这些行为的孩子,实际上更有可能将这些学习转移到他们与其他孩子的互动中,特别是对于互惠性或反应性响应和提供反馈等社交技能。这对我们来说非常令人兴奋。所以,我将在这里停止,比你预期的要晚得多,我对此表示歉意。我一开始说过,我不会给出答案,我也不知道未来会怎样。但我确实相信,我们可以利用人工智能创造一个社交互动得以保留的未来。我相信这可以通过利用社交人工智能来理解社交互动来实现,通过构建专注于协作而非替代的社交人工智能,并以一种唤起人们并坚持人们在日益技术化的世界中以人们的方式行事的方式进行协作。社交人工智能可以教会那些需要学习的人社交技能,并且我们正在创造一种不同于 Alexa、Siri 或 Google Now 的人工智能。你已经看到了很多父母的抱怨,他们说他们的孩子越来越不礼貌,他们不说谢谢。这是一种可能不会唤起“谢谢”的人工智能,它可能会唤起“这是个愚蠢的说法”,但这是自然的社交行为,而这就是目标,因为你可以从中成长,并走向一个你实际上是社交世界中的一个社交人的未来。所以,谢谢。[掌声] 这真的非常迷人。嗯,关于你试图让孩子们不要相信在线来源等等的另一面呢?有没有
某种程度上可以补充我的每一句话。我的意思是,我们通常希望我们的孩子能够信任他人,但有时又不希望他们完全信任,对吧?这是一个好问题。所以我们教导孩子们要警惕陌生人,但我们并不教导他们要警惕虚假信息源,但这两者之间并没有太大区别。你听谁的,不听谁的?如果有人告诉你跟他回家,你会跟随便便的人回家吗?如果有人说,“如果你填写这份问卷,提供你的家庭住址和电话号码,我可以在五分钟内让你赚一百万美元”,你会说“是”吗?我认为这些是育儿中至关重要的问题。至于虚假信息源的问题,我不确定我是否有正确的答案,因为我认为这是一个关于教育的问题,而不是一个关于网络世界的问题。我不认为这与……我正在即兴发挥,我不确定我是否能给自己一个充分的答案。我倾向于认为这更像是课堂上的学习,学习引用谁的作品以及如何引用,而不是关于网络……我的研究生,不是很多博士生,但硕士生仍然偶尔会引用别人的学期论文,这让我非常震惊,好像如果它被写下来并且在那里,他们就应该引用它。是的,获取信息的渠道增加了,但也有关于修辞和证据的问题。如果我们正确地教授假设检验,那么证据的性质就应该是我们涵盖的内容,这就是为什么我认为这更多的是关于教育而不是网络世界。谢谢。你好,所以,非常感谢你的演讲。从你的一些发现中,人们可能会推断出我们应该设计出不完美的社交人工智能,也就是说,这就是重点。如果我们实际上不再能区分真实的人和代理人,会发生什么?当然,有很多努力去做这件事,对吧?你知道的。那么,你如何看待“这让我们认为‘那不应该是目标’,而目标应该是设计出人工智能,它不是终点,而是总是可以区分的、可分离的、不同的类别”的论点呢?首先,我必须说,第一件事,谢谢。首先想到的是 1800 年代的一个短篇故事,叫做《沙人》,讲的是一个年轻人爱上了一个自动人偶。如果你还没有读过关于自动人偶的书,那会非常有趣,因为它们是两个世纪前的 AI,我们现在看到的 AI 现象和当时完全一样。所以这个故事是关于……首先,它们很棒,它们是研究人类行为的方式。瑞士的德罗斯兄弟建造自动人偶来理解我们如何写作,他们写得和我们一模一样。就像我建造东西来理解人们如何工作一样。然后它们变成了客厅里的玩具,然后出现了恐惧。这是一个关于一个年轻人爱上一个自动人偶的故事,他的朋友们很担心,因为她太完美了,她从不唱错一个音,她的钢琴弹奏完美无瑕。你知道我们赞美女性的一切,她的针脚很小。然后最终,他惊恐地发现她是一个自动人偶。从那时起,男人开始欣赏那些唱歌略微跑调的女人,甚至那些好像有自己想法的女人。我觉得这很棒。那样危险就来了。所以从这个意义上说,是的,我们需要不完美。要知道某样东西是人类的,有很多方法。这是对第二个问题的第三个回答。你会注意到,在我自己的工作中,我所有的虚拟人类都不是写实的,都不是照片写实的,那是因为我无意让他们看起来像人类,甚至不像人类。我的目标是激发出真人身上最像人类的行为,而不是制造一个最像人类的人工智能。所以,这是个人选择,我认为这是我们每个人都必须为自己做出的选择。无论我们做什么,都会有邪恶的人利用技术来实现邪恶的目的。铅笔非常适合刺人,这是一种老式的技术。然而,我认为在我们的有生之年,我们不会面临人工智能无法被区分,可以被误认为是人类的危险,因为那种照片写实的问题,也就是所谓的“恐怖谷”,这是一种不适感,甚至是一种恐惧感,就像你面对尸体时会有的感觉一样。人们经常这样描述照片写实角色所唤起的感觉,但我认为事实并非如此。我认为问题在于,看起来照片写实的东西应该表现得像照片写实,而我们没有能力让它的声音听起来像照片写实,让它的动作看起来像照片写实,让它的动作与语音的同步达到照片写实的精度。而且我认为,至少对于在座最年轻的人来说,在接下来的 70 到 80 年里,我们都不会达到这一点,因为这些都是非常非常大的理论问题,也是工程问题。现在,我可以……我与世界各地的领导人进行了很多谈话,我与世界各地的领导人交谈的原因是,他们想知道是否应该监管这项技术。世界经济论坛的每个人都想知道应该制定什么样的监管。今年我经历了一件非常有趣和好笑的事情。我被邀请,并且非常荣幸地与法国总统马克龙共进晚餐。他邀请了我认为的八位美国人,三位住在这里的法国人,五位美国人,参加在爱丽舍宫举行的一次非常小的晚宴,我们一共 17 人,讨论人工智能和人工智能的未来。第二天,我们都发表了演讲,他宣布了他的 AI 政策,他说:“我认为我们需要监管这项技术。”晚宴上我举起了手,说:“这是一个非常愚蠢的想法,我们不应该监管它,我们应该教育它。我们不能通过监管来做事,我们只能通过教育来做事。如果我们对工程师进行伦理教育,我认为我们不太可能出现这类问题。如果医生学习一些机器学习,机器学习科学家学习一些医学,我认为我们会做得比监管它好得多。”他说:“卡塞尔博士,我是一名总统,总统是负责监管的。”我当时想,“哦,我的天,我刚跟马克龙总统说他有个愚蠢的想法。”但他第二天确实提到了,实际上,他在公开演讲中说:“我会监管,但尽可能地进行教育。”然后对我眨了眨眼,我感到非常荣幸。所以,我认为在所有这些事情中,总而言之,我们无法阻止人们做邪恶的事情。我们必须牢记我们可以做出的个人选择,而且由于技术的现状,我们在很长一段时间内都不会面临危险。但在这段时间里,我们必须深入研究教育,这样我们才不会最终走向监管。这有点长,完美地契合了我的问题,太棒了。我在政策领域工作,实际上我在这里的学院里负责促进儿童认知、情感和行为健康的论坛。我们正在努力弄清楚的一件事是,当我们思考社交媒体和儿童以及所有这些事情时,技术发展的一个主要驱动力是广告,而公司里的人主要优化的是你在事物上花费的时间,以及点击率等等。所以,我想理解你,我确信教育而不是监管是其中的重要部分,但从这里到那里所涉及的经济学,因为我认为一部分是我们设想了自主人工智能,但另一部分只是日常的商业运营。那么,在政策科学方面,我们能做些什么来确保它的经济学朝着正确的方向发展呢?幸运的是,有像你这样的人在思考这个问题。这是一个我不太了解的领域,我也不想……我不想对一个我完全不了解的事情发表有根据的意见。我确实认为教育将是我们成功的关键,而不是监管,因为我认为我们无法监管技术。它可以在车库里建造,如果它不在公司里建造,然后卖给公司。是的,我很想听听了解这方面情况的人们怎么说,可以做什么,以及正在做什么,因为这是一个有趣且棘手的问题。我想我是在问同一个问题,但我自己写下了这个,随着理解的深入,同样的基础技术是否能够鼓励孩子服从,甚至更糟的是,互相欺凌,因为我们在这里谈论的一切,以及所有的驱动因素,都是为了帮助他们摆脱问题,或者帮助他们做事情,代理人来帮助教学或其他任何东西。但我想到中国的社会信用评分讨论,同样的底层技术,也许比我们意识到的更快,可以用于我们可能不认为……这是一个很好的问题。我喜欢我的研究,因为我可以看到很多孩子在行动,也许这就是为什么我对孩子的信心比很多人都多。最近我被要求做很多关于 Alexa 和 Siri 的采访,其中一位采访者说:“我们将制造像 Alexa 和 Siri 一样的小机器人。”采访者说,我能够指出,在网上已经有一个我认为是三年级学生的人发布了他如何破解 Alexa 的套件。这就是我为什么对孩子们有信心。这和我以前和我的同事亨利·詹金斯一起写一本关于性别和电脑游戏的书时使用的论点完全一样。人们过去告诉我们芭比有多邪恶,我们是否应该把芭比从市场上淘汰。我过去指出,实际上,Erica Rand 出版了一本书,叫做《芭比的怪异配饰》,她谈到了孩子们用芭比的脚从他们的易烤烤箱顶部刮掉糕点的一种常见行为。所以,我们很幸运,孩子们天生就具有好奇心和创造力。学校里有些学校尽一切努力压制这种好奇心和创造力,但幸运的是,他们没有成功,因为正是这种东西给了我信心,没有人会教一个孩子完全服从。我没有百分之百的服从。如果你找到了方法,你应该发表出来,你可以赚很多钱。但我认识的没有人做到过,我也不认为我们将来会做到。也许这就是为什么我能够构建这些技术,我构建了许多供儿童构建的技术,因为我认为成为一个构建者,而不仅仅是一个消费者,是我们孩子的一个非常重要的目标。是的,请。你一直在谈论,在开玩笑的时候,你说 Alexa 的目标并不是真正地帮助我们,而是说服我们买东西,而房地产经纪人的目标是通过建立融洽关系来卖给你东西,甚至在教育的例子中,通过建立融洽关系来提高信息的保留率。你提到通常的目标是改善融洽关系,尽管我可以在生活的许多不同点上想到我希望减少融洽关系。我们看到,在那些没有特定目标的孩子身上,你知道,这取决于他们如何处理这种情况,你可能会遇到一种情况,一个孩子非常努力,而另一个孩子则说:“我不想在这里,也不想和你说话,我们保持安静吧。”所以,我认为这与人们关于目标非常重要的问题有关,无论是研究还是我们学到的东西,以及你的思考方式是如何影响你选择看起来像什么的?所以,我正在思考如何变得更快乐,更经常……当我刚开始成为一名教员时,我一直对儿童的讲故事,自然的讲故事非常感兴趣,通常是关于个人经历的故事。我发现这非常迷人,因为它是一个很好的窗口,可以了解孩子们如何玩转生活的可能性,他们可能成为什么,他们可能想要成为什么,他们想要成为或可能想要成为或可能想要成为的所有不同变体。我们在网上也看到了这一点,当孩子们玩弄看似危险的行为,比如发色情短信或发布半裸照片时。我在纽约市长大,我做过比这更危险的事情。我不认为这是网络带来的。所以,我认为我们玩弄我们的经历。当我开始这项技术研究时,我真的很想构建故事构建和故事倾听系统,因为我认为人们没有足够重视孩子们必须讲述的这些极其重要的故事。好的,这将是回答的第一部分,这实际上有点……它不可能获得资助,直到我意识到讲故事是预测读写能力的一个好指标,我才终于从国家科学基金会获得了资助。我在 NSF PI 会议上站起来说:“为什么你们不资助更多这样的东西呢?”项目官员试图让我坐下。会议结束后,我说:“这是怎么回事?”他说:“我们是 NSF,国家科学基金会。你是我们这个部门唯一一个做过讲故事研究的人。”所以,获得资助并不容易。我经常从一种行为开始,我可能会看看它有什么用处,但这种行为本身可能对我来说很有趣,或者因为我认为它能深刻地理解人性、儿童、世界,以及我们作为人如何与他人相处。所以,这是……这是悲观的观点。另一种观点是,我们总是有目标和计划,它们不一定是邪恶的,也不一定是会让你害怕的那种目标。它们不一定是学习更好的线性代数,它们可能是拥有幸福的婚姻,而融洽关系对这一点非常有益。事实证明,一些非语言行为对离婚有极强的预测作用。如果你想知道,你可以稍后过来,我会给你看……有一个单一的肌肉可以预测离婚。这些也是我们想知道融洽关系在其中扮演什么角色的那种事情。你们大多数人都看到了《纽约时报》现代爱情版上关于如何随着时间的推移加深亲密关系的文章,你们可以互相提问。这已经促成了许多关系,这基于非常古老的关于随着时间的推移加深亲密关系的研究,即加深自我披露。这实际上是建立融洽关系,这正是我今天一直在谈论的。这是任务,但任务是社交的。所以我选择在大多数情况下向你们展示任务表现,其中任务表现是命题性的。但在患有阿斯伯格综合征和高功能自闭症的儿童的情况下,任务是……对于许多自闭症儿童来说,他们非常孤独和沮丧,抑郁症的合并症很高。所以,能够通过保持一致性来与其他孩子共度时光,能够在教室里获得社交互动带来的各种好处,需要知道如何在教室里进行互动。这是一项任务,但不是我认为你担心的那种任务。坏消息是,我将把它作为最后一个问题。好消息是,你们可以在三楼的酒水和食物招待会上继续交流。在大厅有一个招待会,你们可以从这里的楼梯上去,或者乘坐电梯,希望我们可以继续讨论人工智能如何让我们以一种与过去略有不同的方式思考问题。那么,让我们尽情享受吧。 [掌声]