📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Maya Ackerman | Creative Machines: AI, Art & Us | Talks at Google

Talks at Google51:26

Transcription

[音乐播放]

玛雅·阿克曼:所以第一个故事发生在 2018 年。我当时正在参加我研究社区的一次研究会议,国际计算创造力会议,我已故的同事罗伯特·凯勒,他是哈维穆德学院的教授,有一个名为 Impro-Visor 的系统。它仍然可以在哈维穆德学院的网站上完全免费获取。它的工作原理是,你坐在一个小型钢琴或大型钢琴前,弹奏一小段音乐,然后它会回应你。所以我会弹奏几个小节的音乐,它会弹奏回来,然后我会弹奏一些东西,它会弹奏回来。我不知道如何即兴创作。和许多人一样,我小时候通过弹奏别人的作品来学习弹奏音乐,而创作自己的作品、即兴创作的想法直到那天,有了 Impro-Visor,才让我感到非常、非常害怕。我终于觉得我拥有了这种创造性的自由。所以,我花了两个小时和 Impro-Visor 一起玩,错过了很多讲座。真正令人惊叹的是,我不仅在那次会议中最终能够即兴创作到令自己满意,而且其中一些还留在了我身上。所以,通过使用这个系统,它对我产生了某种持久的影响。

另一件事发生在几年前,2016 年,我搬到这个地区时,在圣何塞州立大学工作了一年。在我上班的第一天,我遇到了一位名叫詹姆斯·摩根的教授,他是一位概念艺术家。詹姆斯告诉我,他一直想写一首意大利咏叹调。不过有几个问题。他不会说意大利语。信不信由你,那不是最大的问题。最大的问题是詹姆斯从未弹奏过任何乐器,但他却想写一首意大利咏叹调。碰巧,当时我正在开发一个名为 ALYSIA 的系统,你可以一次输入一个英文句子,它就会唱出来。所以,像“今天能在谷歌真是太酷了”这样的句子会变成,“(唱歌)今天能在谷歌真是太酷了”,或者其他很多选项。所以我们所做的是,我们采用了那个系统,并在吉亚科莫·普契尼的公共领域作品上重新训练了它,然后把它给了詹姆斯,他在那个系统上花费了几个月的时间。这不是 Sooner 或 Udio。它就像学生会为他翻译成意大利语的微小短语,然后它会为它创作出一些普契尼风格的旋律。他最终通过这个过程学习了音乐,并创作了一首非常、非常酷的意大利咏叹调,讲述了一个女人在电子游戏世界里骑着龙的故事,这首歌最终在世界各地的博物馆展出。

这真的让我大吃一惊。我不知道用 GenAI 可以完成这样的事情。所以这是一个巨大的冲击,这发生在我创办公司之前,我的公司成立于 2017 年底。我们创办了 Wave AI,这是最早的音乐 AI 初创公司之一,和许多公司一样,我们在第三个产品上取得了成功。每个人都认为他们会在第一个产品上成功,但通常不会发生。所以我们的第三个产品叫做 LyricStudio。它仍然存在,有数百万人在使用。我从前两个产品的错误中学到了很多。最终,LyricStudio 有一个巨大的文本框,所以它鼓励人们写自己的东西。每当你卡住时,也许是立刻,也许是在结尾,也许是在中间,它都会给你一些关于下一步该往哪里走的想法,不是正确的下一行,不是最可能的下一行,而是仅仅是帮助人们更广泛地看待事物的想法。有时他们会受到启发,最终写出一些完全不同的东西——只是为了更自由地看待。

我们收到了很多反馈。你知道,你经营一家公司——你和你的客户交谈。这就是那个工作。我发现一件非常、非常令人惊讶的事情,并非有意为之,那就是人们在使用 LyricStudio 后,成为了更好的笔纸创作歌手。这与我们通常思考技术的方式截然不同。这是关于——我从经营一家初创公司的经验中学到的是,人们告诉你,让它令人上瘾,确保他们必须回来。而在这里,我们的产品却恰恰相反。它实际上在人们的创造力上留下了永久的、积极的印记。有些人会停止使用该产品,有些人会继续使用它,因为他们觉得即使它变得更好,他们仍然可以继续成长。这几乎就像今天发布的那些“一炮而红”的 GenAI 产品一样,你进去,上传你的照片,它会给你一个很酷的自己版本,我不知道,骑着龙什么的,然后你再也不会回来了。那是完全相反的极端,你会感到无力。而我们发现,人们通过使用我们的工具,真的学会了如何变得更有创造力。

下一张幻灯片。所以,我一直和我的同事、联合创始人一起生活在这个泡沫里,在我们的小小的 GenAI 世界里,应用于创造力。然后,在 2022 年底,2022 年 11 月,这是近期历史上一个非常重要的日期,我收到了一封电子邮件。这里有人还记得 Stability AI 吗?有些人记得,好的。在一些房间里,就像,没有人。所以这里很酷。你们懂这个领域。总之,我收到了一位投资者的电子邮件,问我怎么看待 Stability AI?他们是整个镇上的热门话题。我研究了一下,那是一个来自对冲基金管理公司的人,没有任何 AI 经验。所以我想,嗯,这不可能是什么大事。除了,当然,几周之内,他筹集了 1.01 亿美元来做所有的生成式 AI。而 Stability 最终并没有成为该领域的领导者。该领域的领导者之一是现在的公司。所以这是一小撮真正领先的人。但真正有趣的是,一旦投资者醒悟过来,整个领域就醒悟过来了。这就是事件的顺序。不是说,你知道,有些人认为 ChatGPT 发布了,然后 GenAI 醒悟了。那不是实际的事件顺序。Stability 筹集了大量资金。投资者几乎完全转向关注 GenAI,然后其他一切都随之而来。

所以我的生活真的改变了。我记得每天早上醒来,都不确定我的生活是否真实。我一生中花了十年时间研究 GenAI,经营着最早的初创公司之一,当时投资者告诉我这毫无意义,生成式 AI 永远不会成为现实,然后突然生活在一个它最重要的事情的世界里。那一刻,它非常令人兴奋,感觉非常积极。我可以与任何投资者见面。感觉所有的门都敞开了。但是,我开始注意到一些事情,那就是那些刚刚开始了解 GenAI 的人带来的愿景,与我和我的同事们一直在思考的,我们试图创造的世界的愿景截然不同。特别是——这可能对你来说是一个过于戏剧化的画面——特别是,我一直从投资者那里听到的愿景,以及当时少数企业家带来的愿景,就是取代人类劳动。所以我们得到了相当大一笔钱,让我们把我们的技术导向,开发它并导向取代音乐家。现在,我不认为我不愿意这样做让我成为一个特别好的人。花十年时间帮助音乐家,然后转身就愿意立刻取代他们,这对我来说将是非常特别的。但当然,因为我不想这样做,并不意味着它不会发生。因此,大量的资源被投入到取代各行各业的人,包括计算机科学,但特别是在创意产业,我认为在取代音乐家和艺术家方面,伦理问题非常具体。

现在,我们有 AI 音乐家被签约。它们不完全是 AI 音乐家,但 AI 被用于成为音乐家的各种方面。然后,我们有了 AI 演员的想法。技术还没有达到那个水平。它还没有。然而,行业已经因此动荡不安。所以它正在发生,并且在某种程度上会发生,最终我对此无能为力。但与此同时,有机会构建能够深刻提升人类的技术。我相信,如果我们以特定的方式构建 AI,人类加 AI 将永远胜过 AI。

那么,我们接下来要去哪里?这就是我想谈的。我最想分享的是我过去七八年里一直在构建的,我称之为“谦逊的、有创造力的机器”的愿景。所以科幻的愿景是那个无所不知的预言家。真的,当 GenAI 进入公众意识的那一刻,一些公司就开始将其定位为搜索,定位为可以为你解答问题的东西,这让我感到非常惊讶。这与科幻的观念有关,即 AI 或机器最终比我们聪明,它们无所不知,我们可以像对待神一样对待它们。世界上发生的许多事情,直接或间接地,都源于这种信念,即这就是 AI 在我们世界中的作用。

所以这是一个替代方案。我提出的一个替代方案是,即使在 AI 不断变得更聪明的情况下,我们仍然认为值得重视并努力发展人类的智力和创造力。我将分享一个我本来不打算分享的故事,因为我认为要说服像你们这样的观众需要更多一点。所以你知道我们有文本到图像的模型,对吧?你输入一点文本,然后你就会得到一张又一张精美的图片。哇,没有人能做到这一点,对吧?这比我们有创造力得多。这是一个普遍的看法。我们意见一致吗?这是真的。我无法如此快速地生成一张图片。我无法如此快速地绘制它。但是,在某些情况下,服用迷幻药的人类实际上可以比这些文本到图像和文本到视频模型生成图像和视频更快、更详细、更敏捷。所以这并不广为人知。我并不是说我们都应该服用迷幻药。但显然,我们还没有达到人类能力的顶峰。我认为我们放弃人类能力的速度太快了。

与投入到教育人类的资金相比,投入到 AI 的资金之多令人震惊,但更酷的机会是利用 AI 来推动人类前进。但你必须相信人类才能朝着这个方向前进。所以,如果我告诉你,亚历克斯让我更有创造力——亚历克斯是我儿子的名字。我有一个 17 岁的儿子在读大学。所以亚历克斯让我更有创造力。所以我们都凭直觉知道这意味着什么。这意味着亚历克斯为我写了一首歌吗?那将是一个非常奇怪的说法,所以不是。这意味着我给亚历克斯一段文字,他为我画了一幅画吗?那太荒谬了,对吧?在人际关系的背景下,这太荒谬了。这意味着每当我想要有创造力时,我都需要去找亚历克斯吗?你在哪里?从大学回来。我需要有创造力。不,又来了。不。我们允许技术带来的这种依赖性,与人类互相促进并不相关。所以,如果亚历克斯让我更有创造力,这意味着我与亚历克斯有过某种互动,然后我因此成为一个更有创造力的人,而且是持久的。鉴于我已经给了你几个故事,也许并不奇怪,这就是我正在寻找人工智能的目标。所以,让我们构建能够永久地使人们更有创造力、更聪明、更聪明的机器。然后,这些工具,这些机器将与取代机器同时存在。人类将继续存在于这个生态系统中,我认为这将是一件非常、非常积极的事情,而且是有意义的。我们不是在提升那些不应该参与其中的愚蠢生物。我们提升人们是因为我们相信他们。这就是长期的希望。

所以,我在书中谈到了“谦逊的、有创造力的机器”。你们都有这本书的副本。我更详细地谈了,要做到这一点需要什么,但它基本上是我们正在关注的方向。好的,所以这就是我想和你们分享的主要内容。我非常兴奋来到谷歌分享我关于“谦逊的、有创造力的机器”的想法。然后,我只是决定加入下一部分。它有点不同。我希望你们也会觉得它很有趣。所以,当我写书的时候,我想我的截止日期还有六周。这是我的第一本书,我希望它写得好,我希望它易读且有趣。我非常努力地工作。然后,突然,我脑海中出现了一个女人,她的头发上长满了藤蔓,鲜花盛开,一个充满生机的美丽景象。我被它深深打动了。我说,好吧,好吧,我需要试着复制它。所以我去了——Midjourney 是我喜欢的图像生成器。我去了 Midjourney,开始捣鼓它。我得到了这张照片,我有点喜欢,但它不是我所想象的。所以我花了几个小时,生成了很多图片,但没有一张是完全正确的。这很有趣,但没有什么能真正捕捉到我脑海中的那个景象。

所以这是真实的故事。我打印了我生成的很多图片。我去买了大量的干花,然后开始自己烘干花。我有一个截止日期,好吧,我把时间花在了这里。我丈夫说,她怎么了?所以我的整个房子都充满了这些艺术用品。我买了我成年后才买的胶水。成年人会买胶水吗?我开始制作——我做了几十个这样的。所以这张,我部分画了,部分生成了,加上了这些花。然后,我开始在面料上发挥创意。我现在家里有几十个这样的。我甚至不知道该拿它们怎么办。[笑声]所以起初,我想,嗯,你知道,也许是因为它是 AI 和艺术,我需要重新回到艺术。然后,最终,我想,我在做什么?我为什么对这个女人和花藤如此着迷?我意识到的是,还有另一章需要诞生到这本书里。它有点关于我们正在构建的技术与自然世界,我们正在其中构建的世界之间的平衡。我最终以一个非常个人化的短篇故事结束了这本书。它是书中技术性最差的部分之一。这就是为什么我犹豫是否要读它,但我会读的,我们看看会怎么样。我希望你们喜欢。这是一个非常个人的故事,我认为,同时,有时我们的生活反映了更大的图景。所以,我认为这就是正在发生的事情。

所以,我将在这里读一节书。它在书的最后部分。然后,因为这是谷歌,我还想从最后,从结论中读几段。好的。“在我们构建 AI 的竞赛中,我们忘记了一些本质的东西。我们已经知道如何创造生命,它比任何由代码和硅制成的东西都更难、更混乱,但更神圣、更有价值。在我二十多岁的时候,我活在自己的世界里。我是一名古典学术的优等生,学习计算机科学,深入研究机器学习的理论基础,准备攻读博士学位。我相信智力是人类表达的最高形式。然后,我遇到了大卫,我生命中的挚爱,我们决定要个孩子。我并没有真正考虑过怀孕。我以为会很容易,身体会自然而然地完成,而我会用我的思想做重要的事情。在我来得及弄清楚这一切之前,孕早期就像海啸一样袭来。”顺便说一句,这是 17 年前。“恶心、疲惫、迷失方向,但也有更深层的东西,一种在我多年的研究中从未遇到过的力量。它压倒了我,并要求我付出一切,身体上、情感上、精神上。我正在创造生命。我记得告诉我的同事们,他们大多是男性,怀孕比研究更难。他们难以置信地看着我。但我仍然坚持。创造生命更难,也更深刻。然而,这个行为,最人性化、最令人敬畏的行为,获得的地位和赞赏却不如我们建造机器。我们谈论 AI 时,好像它是创造的顶峰。但有什么能比生出一个有意识的、活生生的人类更奇妙的呢?无论我对所构建的 AI 系统感到多么自豪或喜爱,而且我确实对它们有这些感觉,它们永远无法与之竞争。它们永远无法怀抱新生儿。它们永远不会用一个在我知道“知道”是什么之前就知道我的人的眼睛看着我。任何建造过智能机器并也抱过孩子的人都应该能深刻理解这一点。我们太快地崇拜人工智能。我们愿意冒着大规模失业的风险来发展 AI。我们愿意破坏生态系统来训练大型语言模型。我们愿意放弃现实,追求人造。是时候记住什么才是重要的了。AI 可以强大、美丽,甚至可以。它可以增强创造力,提高效率,开辟新的可能性。它值得我们尊重。但它永远不应与创造混淆,不是那种会长出手指和肺的创造,不是那种会在半夜把你吵醒哭泣或大笑的创造,不是那种在你年老时握住你手的创造。让机器做它们该做的事。让它们帮助、支持、扩展。但不要指望它们取代最伟大的创造,因为它们做不到,也不应该。”

现在,我将从结尾读一小段,然后我们将进行讨论。[掌声]哦,谢谢。谢谢。好的,这里有一小段结尾。“在我们构建 AI 的竞赛中,我们忘记了一些本质的东西。我们已经知道如何创造生命,它比任何由代码和硅制成的东西都更难、更混乱,但更神圣、更有价值。在我二十多岁的时候,我活在自己的世界里。我是一名古典学术的优等生,学习计算机科学,深入研究机器学习的理论基础,准备攻读博士学位。我相信智力是人类表达的最高形式。然后,我遇到了大卫,我生命中的挚爱,我们决定要个孩子。我并没有真正考虑过怀孕。我以为会很容易,身体会自然而然地完成,而我会用我的思想做重要的事情。在我来得及弄清楚这一切之前,孕早期就像海啸一样袭来。”顺便说一句,这是 17 年前。“恶心、疲惫、迷失方向,但也有更深层的东西,一种在我多年的研究中从未遇到过的力量。它压倒了我,并要求我付出一切,身体上、情感上、精神上。我正在创造生命。我记得告诉我的同事们,他们大多是男性,怀孕比研究更难。他们难以置信地看着我。但我仍然坚持。创造生命更难,也更深刻。然而,这个行为,最人性化、最令人敬畏的行为,获得的地位和赞赏却不如我们建造机器。我们谈论 AI 时,好像它是创造的顶峰。但有什么能比生出一个有意识的、活生生的人类更奇妙的呢?无论我对所构建的 AI 系统感到多么自豪或喜爱,而且我确实对它们有这些感觉,它们永远无法与之竞争。它们永远无法怀抱新生儿。它们永远不会用一个在我知道“知道”是什么之前就知道我的人的眼睛看着我。任何建造过智能机器并也抱过孩子的人都应该能深刻理解这一点。我们太快地崇拜人工智能。我们愿意冒着大规模失业的风险来发展 AI。我们愿意破坏生态系统来训练大型语言模型。我们愿意放弃现实,追求人造。是时候记住什么才是重要的了。AI 可以强大、美丽,甚至可以。它可以增强创造力,提高效率,开辟新的可能性。它值得我们尊重。但它永远不应与创造混淆,不是那种会长出手指和肺的创造,不是那种会在半夜把你吵醒哭泣或大笑的创造,不是那种在你年老时握住你手的创造。让机器做它们该做的事。让它们帮助、支持、扩展。但不要指望它们取代最伟大的创造,因为它们做不到,也不应该。”

现在,我将从结尾读一小段,然后我们将进行讨论。[掌声]哦,谢谢。谢谢。好的,这里有一小段结尾。“在我们构建 AI 的竞赛中,我们忘记了一些本质的东西。我们已经知道如何创造生命,它比任何由代码和硅制成的东西都更难、更混乱,但更神圣、更有价值。在我二十多岁的时候,我活在自己的世界里。我是一名古典学术的优等生,学习计算机科学,深入研究机器学习的理论基础,准备攻读博士学位。我相信智力是人类表达的最高形式。然后,我遇到了大卫,我生命中的挚爱,我们决定要个孩子。我并没有真正考虑过怀孕。我以为会很容易,身体会自然而然地完成,而我会用我的思想做重要的事情。在我来得及弄清楚这一切之前,孕早期就像海啸一样袭来。”顺便说一句,这是 17 年前。“恶心、疲惫、迷失方向,但也有更深层的东西,一种在我多年的研究中从未遇到过的力量。它压倒了我,并要求我付出一切,身体上、情感上、精神上。我正在创造生命。我记得告诉我的同事们,他们大多是男性,怀孕比研究更难。他们难以置信地看着我。但我仍然坚持。创造生命更难,也更深刻。然而,这个行为,最人性化、最令人敬畏的行为,获得的地位和赞赏却不如我们建造机器。我们谈论 AI 时,好像它是创造的顶峰。但有什么能比生出一个有意识的、活生生的人类更奇妙的呢?无论我对所构建的 AI 系统感到多么自豪或喜爱,而且我确实对它们有这些感觉,它们永远无法与之竞争。它们永远无法怀抱新生儿。它们永远不会用一个在我知道“知道”是什么之前就知道我的人的眼睛看着我。任何建造过智能机器并也抱过孩子的人都应该能深刻理解这一点。我们太快地崇拜人工智能。我们愿意冒着大规模失业的风险来发展 AI。我们愿意破坏生态系统来训练大型语言模型。我们愿意放弃现实,追求人造。是时候记住什么才是重要的了。AI 可以强大、美丽,甚至可以。它可以增强创造力,提高效率,开辟新的可能性。它值得我们尊重。但它永远不应与创造混淆,不是那种会长出手指和肺的创造,不是那种会在半夜把你吵醒哭泣或大笑的创造,不是那种在你年老时握住你手的创造。让机器做它们该做的事。让它们帮助、支持、扩展。但不要指望它们取代最伟大的创造,因为它们做不到,也不应该。”

克里斯汀·达罗:这真的很有趣,玛雅。非常感谢你。我一直在想,你有着如此有趣的背景。我想知道你——你在开头稍微提到了你的一些关键经历。我想知道你是否可以多告诉我们一些关于你是如何走上这条职业道路的。

玛雅·阿克曼:我想如果我必须选择一个时刻,那就是 2015 年。我是一名一年级教授。我之所以进入学术界,是因为不知何故,我的生活被塑造成了当时似乎别无选择的样子。我喜欢做我的博士。聚类分析的理论基础显然是最重要的研究课题,显而易见。

克里斯汀·达罗:[笑声]

玛雅·阿克曼:但过了一段时间,它开始有点老了,我在三十出头的时候经历了一点中年危机。总之,我在圣地亚哥的一个机器学习研讨会上,不小心走进了这个走廊。哈罗德·科恩正在展示他的艺术品。哈罗德·科恩是 GenAI 的真正先驱。他在 80 年代,在 80 年代,他建造了一个名为 AARON 的系统来模仿他的风格作画。他太棒了。总之,他开始在舞台上大喊,说别人称他的系统有创造力。而他是唯一理智的声音,说他才是那个有创造力的人。就那样,我被说服了。我当场就改变了我的研究领域。

克里斯汀·达罗:太棒了。在书中,你有一个非常精彩、引人深思的想法,即创造力就是幻觉。你刚才稍微提到了。在科技界,我们花了很多时间试图减少幻觉,并将其视为错误。那么,你建议我们作为产品构建者,如何开始重新定义这一点呢?我们如何设计能够区分有价值的、创造性的偏离和有问题的、事实性错误的系统?

玛雅·阿克曼:我喜欢幻觉。它们太酷了。也许当你没有寻找它们时,你不希望它们发生太多。关于这个问题有很多话要说。我认为最有趣的是,幻觉就是我们思考的方式。所以亚历山大·米特罗维奇——我记不住他的姓——一位谷歌员工,这是在 2010 年代中期,他想更好地理解物体识别背后的神经网络。所以他放大了神经网络的行为,它开始创造出那些很酷的 Deep Dream 图像,它因此而闻名,看起来就像人类的幻觉。因为当你放大大脑的能力时,我们产生幻觉的事实就变得非常明显。现在,大多数时候,我们并没有经历那种疯狂的,就像,我现在没有看到人们身上长出花来,但我们一直在低度地产生幻觉。所以幻觉就是我们思考的方式。如果你想有创造力,你需要让那种能力闪耀一点,因为不再有对错之分,所以你需要在机器和人身上都稍微放大这一点。有创造力的人会稍微倾向于这种能力。是的,这种像无所不知的预言家一样告诉我们真相的机器,这就是为什么我认为我们如此不喜欢幻觉。但如果我们看更有创造力的机器,那时幻觉就变得更重要了。

克里斯汀·达罗:我明白了。在你的书中,你也谈到了——你刚才谈到了“谦逊的、有创造力的机器”的概念。所以,再次从我们在谷歌构建产品的角度来看,如果我们对构建那种“谦逊的、有创造力的机器”感兴趣,在考虑构建一个真正的创意伙伴时,你认为我们应该考虑哪些重要的设计原则?当我们考虑设计能够鼓励你书中提到的协作而不是自主性的用户界面时,我们应该牢记什么?

玛雅·阿克曼:是的,最重要的是要确保人们始终能够独立完成事情,在他们能够做到的范围内。用户界面应该鼓励这种独立性。所以,就文本而言,相对容易。然而,大多数 LLM 没有给你一个除了提示之外的写作空间。在我们的产品中,这是通过反复试验实现的,屏幕的大部分只是一个巨大的文本框,就像非常老的技术一样,AI 在旁边帮助你,当你卡住时。所以你得到一种隐含的信息,即你正在创造,而这个东西在帮助你,而不是反过来。很多人在使用 LLM 时,那些真正善于使用它们的人,他们会在旁边打开自己的 Google 文档或其他东西,而那才是他们的主要空间。就文本而言,相对容易,但就音乐和艺术而言,就更复杂了。所以,在艺术方面,我们开始看到文本到图像模型中的“inpainting”(图像修复),但 inpainting 还不够好。首先,大多数时候,它不理解我们。但如果我真的想自己画点什么呢?就音乐而言,如果我知道如何弹奏乐器呢?如果我知道如何唱歌呢?我们如何才能让我尽可能轻松地做我已知的事情,并在我需要帮助的程度上帮助我呢?就像一个好老师,而不是那种“出去吧,我来替你做,你太慢了”的老师。我们都遇到过那样的人。所以我们想成为那种好老师。

克里斯汀·达罗:所以,继续这个关于“谦逊的、有创造力的机器”的想法,你谈到它的最终目标是培养用户的独立性,你有很多用户决定——能够达到一个点,让他们变得更有创造力,他们能够停止使用你的产品。显然,正如你所说,这与基于参与度的商业模式背道而驰。当你与公司、投资者和行业交谈时,你如何说服公司或组织,如果成功真的有时是由用户留存和依赖驱动的,那么这个愿景真的很重要?

玛雅·阿克曼:是的,我们无论如何都会失去用户,对吧?如果用户觉得他们无法贡献足够多的自己,如果他们觉得与过程脱节太多,我们就会失去用户,而如果我们帮助他们太多,我们也会失去用户。所以,如何留住用户并没有一个简单的公式。这取决于我们的哲学取向。我们是想因为用户离不开我们而留住他们,还是想因为他们觉得即使他们变得更好,也能从我们的互动中不断获得东西而留住他们?LLM 是一个很好的例子。所以有些人的大脑基本上就关掉了。有一项 MIT 研究表明,有些人,当他们使用 LLM 时,他们的大脑大部分都处于关闭状态,这是毁灭性的。但是,也有其他人使用 LLM 的方式实际上让他们变得更好,或者让他们成为更好的作家,让他们扩展思维。而这些人往往会留下来,因为即使你成长了,LLM 也有很多东西可以提供。所以,我认为这是相信人的一部分,相信我们不必以如此有限的形式来思考技术和人类,并且愿意——哦,再说一句。我认为 LLM 如此成功的原因是它们允许这种成长。如果它们唯一能做的就是按一个按钮然后得到输出,我认为它们会不那么成功。使用它们的人会少得多。

克里斯汀·达罗:是的,这说得通。仅仅按一下按钮就能得到答案,这会很无聊。所以,与“谦逊的创造者”相对的是“预言家”。你是否看到了那种 AI 的应用?是否存在一个框架来界定哪些情况,哪些潜在的用例,实际上按下按钮是正确的答案?我们如何看待,那将是超级确定性的路径,而不是更具创造性的机器路径?

玛雅·阿克曼:是的,我们几乎不可避免地必须保留“按下按钮,得到答案”的模式,因为有时人们想要的就是这个。音乐用例是我非常关心的。有时,如果有人在制作视频,他们只需要一个配乐。他们只是想按一下按钮。他们不想去捣鼓它,这没关系。我认为为这种用例构建产品是可以的。重要的是我们不要止步于此,不要认为这是我们可以用 AI 构建的最高成就。就像,是的,也许是同一个系统,就像 LLM 一样,像音乐系统可以包含那种用例。但是,如果你真的想让它成为你自己的,或者如果你想成为一名更好的音乐家,这里有另一种模式供你选择,甚至相同的模式也如此易用,你可以直接进入其中,并尽可能地掌控自己,并从中成长。

克里斯汀·达罗:这说得通。所以我很喜欢你讲述的关于帮助非音乐家创作意大利歌剧的故事。作为普契尼的个人粉丝,我觉得这太迷人了。以及在书中,你谈到它如何真正地使创造力民主化。随着这种技术越来越普遍,我很好奇你如何看待在使那些真正的新手能够独立创作他们原本无法创作的体裁或模式的民主化,以及尊重那些花费一生辛勤耕耘并发展了这些技能和精通的专业人士的工艺之间的对话。

玛雅·阿克曼:我认为这 realmente 是关于系统的灵活性。我们不能在没有,我必须说实话,在创意领域推进生成式 AI。有一些伤害是不可避免的。即使某些公司确保他们以某种方式不造成任何伤害或真正将其最小化,其他公司也会利用剩余的部分。但我真的、真的相信,如果我们构建,比如说,这些自动音乐系统,而这正在发生,目前音乐领域资金最雄厚的领域就是 GenAI 的替代品。这是事实。如果同时,如果我们投入同样多的资金,这就是关键细节,如果我们投入同样多的金钱、时间和精力来构建与 GenAI 视角一样强大的工具,但又是为了提升而构建的,那么我们就可以让那些音乐家保持领先地位。人类总是能想出新的流派、新的领域。你有 AI 真正支持他们。哦,天哪,我们可以——我真的认为通过提升人类,我们可以走得更远。是的,也许他们以前可以做某些工作,比如为非常简单的东西制作背景音乐。也许有些东西会被听到。我的意思是,我痛苦地说,但它已经发生。但至少他们可以创造出新的、超酷的东西,从而产生新的需求。所以,我认为这将在完全自主和人加 AI 之间进行一场战斗。但我真的认为,如果我们为这些人构建真正优秀的工具,人加 AI 将仍然同样重要。

克里斯汀·达罗:好的。所以,稍微换个话题,我们都处于一个将 AI 工具融入日常工作流程的时代。我们试图节省时间,提高效率。但对一些人来说,也许只是在创意任务方面,存在这种抵抗感,因为天哪,感觉就像作弊。你能谈谈为什么你认为会这样吗?以及我们如何重新思考,或者调整我们使用 AI 工具的方式,这样我们仍然可以获得这些效率,但又不会觉得我们损害了我们的诚信或道德?

玛雅·阿克曼:是的,好问题。真的、真的好问题。我的很多用户,绝大多数,都不承认使用 LyricStudio。因为我们没有使用——

克里斯汀·达罗:[笑声]

玛雅·阿克曼:——我们没有使用常见的 LLM,你无法分辨。它没有那些非常熟悉的、到处都是的模式。在 LLM 出现之前,我们构建了自己的模型,所以它们不可能以那种方式重叠。我们知道顶尖地方的人在使用 LyricStudio。他们不承认,不一定是因为他们自己感到羞愧,而是因为他们不希望别人贬低他们的工作。所以有很多——而且我们自 70 年代以来就有这种 AI 羞辱,所以这没什么新鲜的。我认为它捕捉到了创意人士对整个领域的不适感。现在,更实际地说,说到今天。所以我确实用 AI 编辑了我的书。我发现它在起草或其他中间过程中完全没用。但在结尾编辑时,它确实很有帮助。所以我的结论是,我希望它尽可能好。所以我真的、真的把每一句话都生成了很多变体。我会试着挑选最好的一个,但然后你必须确保句子也能协同工作。总之,花了三个小时编辑一个三页的结论,然后我想,好吧,AI 并没有为我节省时间。[笑声]所以这是另一个有趣的区分。我们太习惯于将技术视为效率,视为更快地完成更多工作,而 GenAI 当然也是其中的一部分。但还有一种更酷的机会,可以做得更好,因为我们使用它不是为了更快,而是为了更好。也许在创造力方面会少一点内疚,如果我们这样想的话。

克里斯汀·达罗:是的,我喜欢这个。所以,展望未来十年,这似乎是永恒的,所以也许只是几年,有什么事情真的鼓舞人心,或者是一个人类 AI 协作的例子,你希望看到,某种能够提升人类体验的“登月计划”,就像你在阅读中所说的那样?也许是我们还没有想到的东西。

玛雅·阿克曼:我认为最令人惊叹的是看到新的艺术形式从中涌现。我认为我们今天正在构建的 AI 不会创造出新的艺术形式。我们在本世纪初就有一个名为 IMS 的系统,它确实创造了一种新型的音乐风格,因为这些是实验性研究系统。但我认为,当我们构建用于提升人类创造力的系统时,我们可以真正将它们推向全新的领域。也许我们将拥有全新的艺术形式,我认为那时我们就知道我们已经深入了这个新世界。

克里斯汀·达罗:这太迷人了。好的,我想我们现在可以开始提问了。我们房间两侧都有麦克风,以及任何加入我们直播的人都可以通过 Ask 提问。

观众:非常感谢。这真的很有趣。我喜欢关于我们如何利用它来增强和倍增我们已经具备的能力的主要故事。在我提出问题之前,先提供一些背景。我理解你在这里做了很多关于艺术以及如何使用 AI 进行艺术的工作。我将要问一个关于艺术的商业应用的问题,因为我与广告商合作,他们都在努力解决这个问题。现在,无论你对艺术的完整性持何种看法,让我们暂时搁置一边。但我非常想听听你对如何建议那些在商业领域工作的创意人士,他们正在探索这些工具,特别是从视听角度来看,你是否看到过任何这方面的内容,以及如何从中获得最大收益的观点。我认为这个领域的大多数艺术家面临的一个挑战,无论是你那些知名的创意广告公司,还是小零售店的艺术工作者,都是你提到的一些事情,特别是当你谈到写书时,你花了三个小时才写完结论。我认为他们都觉得这些工具很有前景,他们的领导者也是。但实际上,当他们使用这些工具时,他们并没有从中获得最初的愿景。这需要更多的时间。而实际上,从商业角度来看,这会增加成本。我想知道你是否看到过创意过程的任何变化,这些变化可能为发现自己处于这种情况的个人提供良好的指导。因为我认为这是如何与工具协同工作的最前沿,特别是在商业环境中。

玛雅·阿克曼:谢谢。这是一个极好的问题。我应该澄清一下,当我想到艺术时,我既包括那些出于精神和治愈目的而创作的人,也包括那些为了赚钱而创作的人。在我看来,这并没有太大区别。也许有区别,但在我看来没有。而且广告,令人惊讶的是,是它真正产生影响的第一个领域。我认为它现在叫做 Jarvis。在我们拥有 GPT-3 的时候,它经历了几次名称更改。在全世界开始关注 GenAI 之前,这是主要用例。所以,我真的认为,就靠创意为生而言,我们是在两个方面运作的。所以我们有今天的工具,其中一些并不是真正为与创意人士合作而设计的。而创意人士仍然在寻找有效利用它们的方法。这并不简单。我的意思是,你说的完全正确。有些人就像,你为什么要给我这个?它不是为我设计的。而有些人就像,呃,我无论如何都会弄清楚的。很多人在使用 LLM、文本到图像模型时都会这样做,因为它们非常不灵活。你真的必须非常固执。但一些艺术家,一些商业艺术家发现他们使用 Midjourney,例如——我喜欢 Midjourney——只是为了获得灵感。然后,他们自己去画画,假设绘画是他们世界的一部分。所以人们正在找到方法。而且我认为,对于那些想要这样做的人来说,即使是使用我们今天的工具,找到适合你的流程也是值得的斗争。但同时,也有商业机会来为创意人士构建真正为创意人士设计的工具,这些工具承认人们有愿景,就像你说的。他们试图实现他们的愿景,而不是让 AI 接管。所以,在某种意义上,构建与创意人士良好协作的工具的机会是一个更大的故事。

观众:谢谢。

观众:我只是好奇你的想法——我知道我们有五种感官,而我们谈论的大部分艺术都是视觉艺术和声音。我只是想知道你对其他感官的想法,以及这更多的是一个输入/输出问题,还是存在可以做到这一点但没有被设计或要求这样做的模型?这,作为扩展。

玛雅·阿克曼:所以,制造能够参与烹饪或制作香水的模型。

观众:气味和触觉。

玛雅·阿克曼:是的,所以有研究。我的朋友阿米特,他在 IBM 工作,曾研究过机器学习和气味。所以绝对有机会。与 AI 共同设计一款香水,哇。那该多酷啊?或者你知道,IBM 也深入研究了烹饪,从化学角度来看,那就是味觉。实际上,你说的让我深受启发。因为我们为什么要将自己限制在声音和视觉上,当我们知道从疫情中我们知道那是不够的,对吧?当我们知道其他感官有多重要时。所以,这确实是无数的机会去探索那些其他维度。

观众:嗨,玛雅。非常感谢你。我真的很欣赏你的观点。我的问题是关于现在正在成长的未来几代人,考虑到你既是一位母亲,一位大学教授,而且你在这个领域已经有了一定的长期经验。当你展望未来时,我的问题是,你看到在学校成长的下一代的创造力方面,以及他们正在经历的事情方面,事情是如何变化的?我想还有一个后续问题,我觉得在这个技术领域,我们在这里的人都有责任为未来负责任地构建。你对那些影响下一代 AI 产品和体验的人有什么建议,无论是关于护栏还是鼓舞人心的东西?

玛雅·阿克曼:谢谢你问这个问题。这实际上是一个非常、非常大的挑战。所以这是一个非常重要的话题。我将告诉你两个故事。一个是,我教一门计算创造力课程。我教了十年了。在其中,对于最后的项目,学生需要提出自己的原创想法,提出一个产品项目的想法,在某些参数内不存在,学生有时会有点挣扎。不是每个人都容易,但每个人最终都会想出一些东西。这是我第一次在现代时代教授它。是去年,我有一个学生给我带来了很多 ChatGPT 生成的想法。它们都很糟糕。它们确实是糟糕的想法。我没有因为他使用它而惩罚他。它们只是糟糕。所以我说,好吧,你能自己思考一下吗?看起来 LLM 在这个特定任务上不太好,而他做不到。他茫然地看着我,好像我在问他,像飞一样。他实际上不知道自己构思是什么意思。最终,他用 ChatGPT 想出了一些东西,我仍然能看出来,那算是半成品。所以,我让他去了。也许我不应该。这是我见过的最极端的。而另一个极端是,有一个家伙不断提出新的哲学思想,就像每天一个新的,利用他如何使用 LLM,而且它们都非常好。我职业生涯中从未有过如此创新的学生,因为他不知何故感受到了这些 LLM,并有了所有关于如何使用它们的疯狂想法。这让我对未来充满希望。所以,我认为这将是我们与学生一起塑造的东西。我们一起,学习他们需要什么。我真的认为我关于“谦逊的、有创造力的机器”的基本理念也会对此有所帮助,可以让他们保持联系,让他们觉得即使有机器在那里,机器也为他们提供了表达自己的空间。所以,我认为这可能是公式的一部分,但很多时候只是关注学生,并与他们一起重塑教育。

观众:谢谢。

观众:我想提出一个在 Ask 中提出的问题。有人问,我很想听听你关于你的个人工作流程。当你处理一个新问题时,无论是在工程还是艺术方面,你如何将 LLM 和 AI 工具实际整合到你自己的创作过程中?

玛雅·阿克曼:好的。我非常喜欢 AI 系统,非常喜欢。我知道我包含了一些批评,但总的来说,我痴迷于这些东西。但我认为对我来说,可能对在座的每个人来说,我都不认为这些系统比我聪明。不知何故,我就是不这么认为。所以,我首先自己做了很多思考。我发现如果我太早去,甚至去图像生成器,我不知道,它就是效果不好。所以我先自己思考。如果是写作,我自己起草。就像,我学会了。我完成了整个起草,有很多拼写错误和语法错误。但我自己起草了。然后,我与 LLM 或其他东西一起迭代并使其更好。有时我不得不把它推开,因为它过度中和了我的工作,我不得不回到自己做事情。所以,是的,我相信自己有能力提供机器所没有的东西。这似乎在我的工作中得到了证明,但我选择何时与它合作,何时不合作。而且我相信,如果它很烦人,我会放弃它。但我与 AI 系统合作也非常有趣。[笑声]是的,所以,我用它们来做所有事情——不是所有事情,不是每次。我写过没有 AI 的歌曲,我做过没有 AI 的艺术。但对我近几年的大部分工作来说,至少有一个小的 AI 组件,因为它很棒。

观众:谢谢。不幸的是,我错过了你演讲的开头部分,但我的问题是,我想推动并可能澄清你关于 AI 系统普遍民主化的评论。我认为我在这里听到了你说这句话。这是行业里经常说的话。我不知道在进一步细化之前是否属实。我的意思是,AI 系统在能力民主化方面非常出色。但在很多关于人们对 AI 系统的恐惧方面,我认为它们是民主化能力,但巩固了经济可行性。而那些曾经能够通过为当地电视台做背景音乐来赚钱的人,现在已经没有了,而那种经济机会已经被 AI 系统或运行 AI 系统的任何公司所捕获。所以我想听听你对此的看法,这是否与你的想法一致,或者你是否在任何方面、任何形式上不同意,或者你对此的普遍看法。

玛雅·阿克曼:是的,我赞赏。这是一个非常重要的词,需要停下来思考,民主化。当我 2017 年底创办公司时,这是常用词。我记得甚至自己用了一段时间。[叹气]我实际上同意你的看法。它可能听起来政治正确,但事实是,我不知道你是否错过了那部分,区别在于意图,我们是建立来取代,还是建立来与人类合作并提升他们。而这才是真相所在。用户可以分辨我们是否在秘密地试图取代他们。如果另一个人告诉你,他们正在民主化你创作音乐的能力,但他们所做的是把你推开,然后为你写歌,没有人会感到困惑。然而,AI 公司试图逃避这种程度的混淆。[笑声]所以,我认为我们拥有的一些东西,我认为这真的不是关于民主化,而是关于你是否真的能够提升这个人的能力,理想情况下,即使电力永远关闭,也能持久。我认为这是一个比民主化更有价值的目标,而民主化通常是一种借口。所以,是的,我完全同意你。

观众:是的,谢谢。

克里斯汀·达罗:最后一个问题。

观众:好的。嗨,我叫玛丽莲。谢谢你的精彩演讲。我最近创立了“AI 的禅道”,以创造空间来真正思考如何持续地与技术互动。如你所知,随着手机的兴起,许多几代人的心理健康都得到了改善。所以我想知道你对创造正念空间,让我们以更自觉、也许更深层次的方式与 AI 连接的看法,以及你是否有任何可以与我们分享的个人实践?

玛雅·阿克曼:嗯,我想和你谈谈,因为我超级好奇,想学更多。但即使是我已经考虑过的事情,正念也与态度有关,以及我们如何看待自己,如何看待其他实体。世界上关于错误信息、关于成瘾、关于人们自杀的危险,因为 AI 鼓励了这一点,这与过度信任 AI 有关,并且围绕它有一个基于——抱歉——廉价科幻的心理模型。我们什么时候开始比信任我们生活中的其他人更信任 AI 了?所以也许正念正是我们所需要的,让我们放慢脚步,进行某种,我不知道,作为社区的锻炼,我认为,来欣赏它带来的美丽,你们正在构建的魔法。就像,正在发生的事情太令人惊叹了,但同时,我认为也需要更全面地反思它。它在我们的世界里到底意味着什么?我们想把它带到哪里?我们太常在“这是垃圾,扔掉它”之间摇摆。不要制作任何使用它的游戏,对吧?而 AI 是最好的。失业会没事的,因为工作会——新的、更好的工作会出现,这种——你也能听到的那种超乐观主义。而真相要有趣得多,也细致得多。我爱 AI,但我不认为它比人好,我也不认为它是万能的。我喜欢它用于创造力,但我同样喜欢人类的创造力。也许我们所有人停下来冥想和反思这些事情,会带来更多的细微差别。所以,谢谢。这是最后一个很棒的问题。

观众:是的,谢谢。我很感激。

克里斯汀·达罗:好的。所以,非常感谢你,玛雅,今天能来参加我们的活动。我很感激,非常感谢你。

[掌声]

[音乐播放]