📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Rethink Reality — Dr. Fei-Fei Li on World Models, Perception, and What Counts as a “World”

Don Allen III44:24

Transcription

我们现在是在一个模拟中吗?>> 多年前,我只会一笑置之。但我将变得谦逊。我们尚未证伪这一点。>> 什么构成一个世界?>> 即使是一粒沙子也是一个作品。>> 那家商店的记忆在哪里?如果他们必须重新生长一切,>> 每朵花、每棵树、每只动物的形态都是进化的记忆。>> 你认为真实的体验发生在何处?发生的一切都是真实的。>> 你认为人工智能能拥有常识吗?>> 常识并非难事。>> 哇。我没想到会这样。现实是否只是一堆高斯散点,就像>> 真实的事情发生了?我们的模拟将开始模糊。我们的模型叫做 Marble。>> 什么?我怎么没看到这个?>> Marble 是一种帮助艺术家和创作者创造世界的材料。哇。>> 这项技术无疑将我们带到了我们从未想象过的地方。完整剧集,尽在 Rethink Reality。你好,欢迎来到 Rethink Reality 播客。Feay,你的工作真是令人难以置信。你帮助机器看到了。但当我看到你的作品并阅读你的书时,我真正着迷的是,你认为人工智能系统是否能在不采取行动的情况下真正看到它所看到的东西?>> 这是一个很棒的问题。首先,Don,感谢你邀请我参加你的节目。很高兴来到这里。你知道,当我的一个孩子六岁时,我们谈论为什么树没有眼睛,这与你的问题精神非常相似。当然,进化是反过来的。在进化的早期,5.4 亿年前,简单的动物开始获得感知能力,非常粗糙的感知能力以及一些触觉感知。这让他们移动得更多。所以从进化的角度来看,感知和感觉实际上是促使身体运动的驱动力。我们没有进化的反事实来问这个问题,即在不移动的情况下,你是否看到,你是否需要看到?我认为从技术的角度来看,被动观看实际上是一项合法的技术,对吧?就像软件层面的抽象,只是观察和理解是可能的。这实际上是我自己早期工作的一部分。但从完全解锁智能,特别是物理和具身智能的角度来看,我认为感知和行动之间的循环以及身体的行动是如此相互交织。>> 对吧?就像你说的,进化是动物去行动和影响世界的动力。他们必须先去看看。嗯,所以你认为没有行动,看到的感知是不完整的吗?>> 这是一个很棒的问题。这些定义非常微妙。如果看是看到某物,我认为感知可以在没有行动的情况下完成。如果看被定义为我们作为人类所能做的最全面的范围,那么它就与我们的行动纠缠在一起。现在,显然即使是人类也有行动不便的个体,我们不可能说他们没有全面的感知能力。对吧?这些是临床病例。有些只是,你知道,不是统计上的大多数,但确实会发生。然后我们必须深入研究不行动如何影响感知?嗯,它是否在生命中期获得的,以及是否有其他工具可以帮助这个人行动?所以,有很多细微之处,但总的来说,感知和行动之间的耦合对我来说非常紧密。>> 听到你这么说,嗯,只是一个随机的曲线球,动物,蝙蝠。你认为对它们来说,看是什么?因为你知道,我觉得它们有很好的意识。它们捕捉猎物,它们狩猎,它们有伴侣,它们知道哪里有庇护所,但它们不是以传统意义上的方式观看。那么,你对蝙蝠有什么看法?它们在看什么?>> 它们绝对是像蝙蝠这样的动物。还有一些水下动物使用声纳。嗯,首先,它们在感知。它们的感知非常重要。它们只是在感知,而不是我们通常许多动物所依赖的光谱。所以,它们在感知世界。它们通过声纳,通过回声,拥有自己对世界的表征。所以它们正在获得感知和行动之间的良好循环。现在,这是对感知重要性的反例吗?我不这么认为,因为感知本质上就是感知。事实上,为什么我们没有更多像蝙蝠这样的物种?嗯,基于声音的感知是一种比视觉更弱的方式。对吧?蝙蝠在运动范围、栖息地和行为方面不如狗那么复杂,这无疑限制了它们的行为。>> 所以听起来感知是理解世界的前提,而你拥有的传感器类型会影响你所处的哪些世界?>> 当然。在人工智能领域,我们现在有这个概念,数据定义了你的模型。你知道,我们甚至有“垃圾进,垃圾出”这个说法。我认为对动物和人类来说也是如此。我们如何获取信息,如何感知信息,决定了我们如何理解并在这个世界上行动。>> 哇。我的意思是,这是一个很好的观点。你知道,我喜欢你的标志,也喜欢你在 World Labs 所做的工作。我们会详细讨论,但我想问一个哲学方面的问题:什么构成一个世界?>> 哦,哇。这是一个很棒的问题。这里有许多维度可以调整,从宗教、精神到物理、物质。什么构成一个世界?我,我实际上非常非常非常好奇。你是在电脑前吗?人工智能会怎么说?什么构成一个世界?>> 嗯,是的,我是在电脑前,或者 Gemini。让我们看看会出来什么。我实际上非常好奇。我有很多想法,但你知道,一个世界可以被定义为一个几何空间,对吧?在那里可以放置事物,可以发生事情,可以移动事物。你知道,它几乎可以等同于空间,这是思考它的一个方式,一种非常物理的思考方式。但你也可以以一种更抽象的方式来思考它,即使思想被允许发生,那里也有>> 哇>> 你知道,有一个内在的世界,你知道,只要有思想的流动,就有世界。>> 所以我有一个有趣的挑战要给你,关于细胞。你认为细胞,个体细胞在身体里忙碌,你认为它们有一个它们理解的世界吗?>> 哦,绝对。现在有一首美丽的诗,我忘了我希望记住诗人的名字。它从我脑海中溜走了。这是一首非常佛教的诗,说即使是一粒沙子,甚至是一朵花的花瓣也是一个世界。当然,细胞可以是一个世界。世界。首先,它满足了更物理的定义。它是一个空间。里面有事情发生。分子和结构等等。所以绝对一个细胞是一个世界。我认为一粒沙子是一个世界,但我也认为存在一个抽象的世界。>> 所以我从 Gemini 那里得到了一个定义。>> 告诉我们。>> 它说“世界”这个词非常灵活,根据你是在谈论天文学家、哲学家、游戏设计师还是诗人,它的含义都会发生变化。>> 是的。>> 说它的核心是一个世界,是一个由一套边界、规则和居民定义的自成一体的系统。首先,它提到了诗歌、哲学、物理学。你知道,我们做得很好。其次,是的,自成一体。我的意思是,有多自成一体?就像我说的那样,一个世界可以是思想在其中流动,这可能不像物理世界那样有界限。>> 是的,他们最近对蠕虫进行了一项研究。他们试图看看记忆是否能存在于神经系统之外。他们用蠕虫进行了一项非常有趣的研究来测试这个理论。你看过那项研究或熟悉它吗?>> 没有,但我的第一反应是肌肉记忆。>> 好的。对。是的,我完全认为,有这种蠕虫,他们教它如何穿过迷宫>> 而且它记住了如何做到这一点,然后他们把这条蠕虫切成小块,让它重新生长>> 哇>> 这条新蠕虫能够穿过同一个迷宫,就好像它曾经那样。所以他们感到困惑的是,如果他们必须重新生长一切,记忆就存储在那里。嗯,>> 是的,这很迷人,>> 对吧?>> 我不知道那项研究,但这里有一件事人们不欣赏。我们、每朵花、每棵树、每只动物的形态都是进化的记忆。所以,我们的形态是我们智能的一部分。而那实际上有一个术语叫做形态智能。所以,所以你知道,我们在那个方面非常全面。不仅仅是我们的头脑,我们的眼睛,我们的身体。我们是一个整合的系统,在我们自己的身体以及在进化中。>> 哇。我以前从未听过这个术语。我一定会深入研究一下。你说的是什么?形态>> 形态智能。>> 哇。>> 形态智能。哇。是的,因为你真的无法将人类与我们必须与环境持续互动的事实分开。就像我们>> 而且我们进化了,对吧?哇。所以,嗯,这里有一个有趣的,嗯,思想问题给你。如果人工智能可以完美地描述一个环境,但它们从未与之互动过,这是否构成理解,还是仅仅是模式识别?>> 我认为那是理解。我实际上认为模式识别是理解的一部分。你知道,一个孩子可以在从未与老虎互动过的情况下被允许理解老虎。>> 谢天谢地。>> 是的,没错。所以我绝对认为那是理解。它是理解的全部吗?我不一定这么认为。所以现在我们可以更细致一点。例如,如果你从未与环境互动过,那么学习可供性是一个更加复杂的问题。你总是可以通过大数据进行训练。但你知道,著名的例子是制作临时的工具,对吧?如果你被困在森林里,如何在没有锤子、没有钉子、没有任何东西的情况下,建造一个小棚屋?在这一点上,人类的创造力就闪耀出来了。机器很难做到这一点。所以,还有很多,但简短的回答是肯定的。>> 你认为,嗯,你认为人工智能能拥有常识吗?>> 常识并非难事。常识实际上可能比人们想象的要容易,因为我们的许多常识都编入了我们的语言和数据中,人工智能可以从中学习。例如,一个非常极端的观点,我可能会被语言学家反对,没关系,因为我不是语言学家,那就是语言本身就是沟通的常识,我们通过一代又一代,数千年,对吧?他们将这些常用的东西提炼成语言。现在,嗯,嗯,你知道像画太阳这样的事情,即使是今天的人工智能也倾向于把太阳放在图片的上半部分而不是下半部分。这些都是常识。这些从何而来?你可以说它来自对牛顿力学、重力以及天体的深刻理解等等。但你也可以说这是一个统计上的常态。>> 好的。对。>> 所以人工智能绝对可以学习这些常识。事实上,一个五岁的孩子和一个人工智能可能没有太大区别。>> 好的。哇。我没想到会这样。那真的很酷。哇。我一直认为常识是一个难题。但如果你把它描述为平均值或常态,那么它似乎并不那么复杂。>> 常识在我们的语言、视频、图像中都有大量关于常识的数据,这些数据非常丰富。嗯,但要将常识提取成更深层次、更深刻的规律。例如,你谈论恒星的运动,>> 这是另一个层次,对吧?>> 是的,我的意思是,稍微过渡到物理学,更具体地说,是世界模型。我注意到,当我阅读你的书时,你谈到了 ImageNet 中涉及了很多人工标注来帮助它理解世界。我的问题是,对于世界模型,物理学对我来说是客观的,但是否存在主观层面,比如告诉人工智能这是重的、滑的或易碎的?这些词是什么意思?这是我们对物理学添加人类偏见吗?>> 这是一个很棒的问题。我认为我们的世界,当我说的“世界”是复杂的人类世界时,它总是会是>> 复杂。一部分将是客观和事实的,一部分将是主观的。世界模型,World Labs 正在构建的世界模型是多模态的。它具有语言和语义。我们的模型具有语言和语义以及几何学,最终还有物理学。因此,语言与几何学和物理学之间的相互作用肯定会混合客观性和主观性。例如,即使是“蓝色”这个词,它也是主观的,而“重”这个词也是如此,如果你去我们今天的模型,然后说,嗯,嗯,你知道,把一个沉重的沙发放在这个客厅中间,这是非常主观的,这种主观性是容易的。所以,这一切都是今天人工智能中数据和建模之间纠缠的一部分。>> 是的,我的意思是,我喜欢 Gaji 和 Splatting,就像你可以拆分粒子并用它们做很多事情一样。我有一个问题是关于分辨率的,你认为最佳分辨率是多少?它应该是像高斯散点最终在原子级别建模吗?>> 哦,我的天,这是一个很棒的问题。我确实认为我们的世界是分辨率的级联。所以对你我来说,在日常生活中,我认为我们不需要原子级别的分辨率。但当我们接受药物治疗时,是的,我们最好希望药物在分子水平上起作用,对吧?这意味着科学家们正在测试、开发和发现药物,他们肯定是在原子和分子层面工作的。所以我认为分辨率几乎取决于用例和场景,世界是嵌套的。说到世界的定义>> 所以就像,嗯,因为如果一个世界是一个封闭的系统,那么系统就嵌套在系统嵌套在系统嵌套在系统里。>> 当然。它是极其嵌套的。>> 哇。我想知道,嗯,好的。你认为现实本身有分辨率吗?就像如果你,我甚至不知道那是什么。就像像素是什么?是普朗克长度吗?有没有一个极限,你不能再小了?>> 我认为今天的像素是由硬件定义的。>> 好的。>> 对。你的屏幕分辨率,数码相机的分辨率。就是这样定义的。>> 好的。那没关系。我只是好奇,嗯,是的,因为我真的很喜欢你的世界模型,你可以走到事物后面>> 是的。>> 和周围。我知道我玩了很多工具,现在这有点困难。这对人工智能来说非常困难,但似乎每次我在 World Labs 中构建东西时,我都可以绕到后面和下面。那么,它是怎么知道的呢?>> 是故意的。这是故意的。我从第一天起就非常清楚。世界模型需要是三维的。>> 你知道后面、下面和上面这个概念是空间概念,>> 对吧?>> 我们为什么相信这一点?因为从游戏到视觉特效,再到机器人技术,再到模拟,有如此多的用例需要它来设计,你知道,把椅子放在沙发后面,你知道。所以,是的,这是我们模型表示中的一个意图。>> 它显示出来了,因为我可以移动我的 3D 相机,然后我说,“等等,后面有东西。”>> 是的。>> 什么?它是如何工作的?>> 而且它也让你拥有完美的控制。你可以以像素级的精度控制你的相机。对。这与其他人工智能工具非常不同,在那些工具中,相机只是大致地在某些方向上平移。>> 你通常只是在掷骰子。但在这里,我可以精确。我可以像我需要相机只走 20 英尺。>> 是的。>> 就是这样。>> 不是这种比喻性的,你知道,随机运动。>> 是的。>> 我猜这是因为它是三维的,因为它实际上是三维的。它实际上拥有这些数据。否则,你只是在猜测深度可能是多少。>> 没有猜测。就像这是深度。就在这里。>> 没错。>> 这令人耳目一新。如果你必须,哦,这是一个有趣的给你。是,如果你有一个虚构的旋钮,可以设置一个完美模拟的物理分辨率,你会把它调到多少?>> 哦,我的天,那又是一个,这取决于我想做什么。>> 嗯,知道你,你可能会研究或制作一些东西,所以就像>> 是的。嗯,知道我,我会做机器人,嗯,你知道,在 World Wars 中,我们的目标行业是游戏、娱乐、机器人和现实世界模拟。所以分辨率不会是亚原子级别的,我肯定不会,因为我认为我不需要。但如果我是一名高能物理学家,或者我是一名药物发现科学家,我会把分辨率调低到普朗克尺度或其他什么。>> 好的。所以这真的取决于你想要关注的领域以及它们需要工作的尺度。>> 是的。我惊讶地看到你在散点图上添加了碰撞网格。那就像一个,当我第一次看到它时,因为通常我必须尝试近似这些东西,但你的开箱即用。这非常有帮助。>> 是的。因为游戏开发者需要它,机器人模拟需要它,嗯,空间设计的迭代设计也需要它,对吧?所以我不会把椅子穿过墙壁。>> 对。我好奇的一件事是,我一直在关注一些不同的研究论文,我看到一些研究,人们正在尝试制作高斯散点的动画>> 因为世界不是静止的,你知道。所以,有没有一个世界,我们可能会在未来看到 World Labs,我不知道这是否会泄露信息,但如果这些散点图有运动,比如树在摇曳,>> 是的,我们称之为动力学。>> 当然。三维四维建模,对吧?动力学在我们的路线图上。哇。哦,我的天。因为那样你就可以真正地训练一个机器人。如果世界完全不动,然后你让机器人去学习,那将是一个完美的情景。但所有我从所有训练模型中看到的都是人们拥有这些静态世界,然后他们教机器人如何在其中行走,然后就像,嗯,如果地面移动了怎么办?你知道,如果汽车开过来了,或者你知道,一根棍子掉在你面前的路径上?>> 是的。>> 嗯,关于机器人,换个话题,你会说蛋白质、昆虫或简单的生物体可以是一种生物机器人吗?>> 我见过纳米机器人可以在血管中输送药物。现在,我见过原型。是的,它们被称为纳米机器人。我认为“机器人”这个词现在被大大扩展了。你知道,我曾经半开玩笑地说,我实际上是认真的,洗衣机就是机器人,对吧?它是一台移动并执行任务的机器。显然,那不是你典型的机器人形象,但纳米机器人也不是那种在血管中输送分子级别治疗的机器人。所以,我认为如果我们将机器人的定义定义为任何可以执行任务的人工制品,>> 嗯。>> 那么是的。就像>> 好的。因为你喜欢制造蛋白质,如果我去设计一种蛋白质来输送药物,我开发的这是一种纳米机器人吗?>> 是的。这就是,你知道,来自斯坦福大学的伟大校园,我在合成生物学和机器人领域有很多同事,我几乎需要尊重他们更专业的定义或更专家的机器人定义。我不知道有没有一种特定的蛋白质可以输送某种人造蛋白质来输送某种功能。它是否被称为机器人,我不知道。但这就是我们科学的迷人之处。我们开始看到工程与生物学、物理学与化学的交叉点,而这正是现在令人着迷的。>> 是的。是的,我看到我的许多物理学家朋友们在探索量子时开始变得非常哲学化。我当时就像,“哇,我没想到会这样。这似乎会很不一样。”>> 总是最哲学的科学家。>> 因为他们就在那个,他们就在那个边缘。>> 推动边缘。是的。>> 你认为人们对机器人、生物学和智能之间的界限有什么误解吗?>> 哦,是的,到处都是误解,对吧?部分原因是健康的,因为它很新。当它很新的时候,我们在探索。我们作为一个集体社会在探索,我们在个人层面也在探索。这也是当它很新的时候,有很多观点被误认为是事实,然后有些就是错误的。例如,关于人工智能的意识,这是一个永恒的辩论。这是很多争论的界限,机器是什么,不是什么,有时你知道,所以是的,我认为这是一件好事,我认为我们应该有公开和私人的,专业的和个人的讨论,关于这些东西是什么,因为它将定义我们未来生活和工作。你见过任何非人类系统吗?哦,抱歉。你认为已经通过了意识阈值的机械系统有哪些?>> 肯定见过通过了智能或图灵测试的系统。我的意思是,语言模型的整个进展绝对是通过了图灵测试,而且是毫不费力地通过的。顺便说一句,图灵测试是一个狭窄的测试。它不是所有智能的定义。事实上,有很多关于智能的定义在流传。所以,我们甚至没有一个关于人工智能通用智能的定义,但测试肯定已经通过了。所以,这意味着智能确实存在于机器中。如何将其与意识或觉知联系起来是一个更深层的问题。很多,再次,我不是神经生物学家或哲学家,但很多关于觉知和意识的原始研究都来自生物体,它们不仅拥有抽象的思维处理能力,而且还拥有你所说的具身细胞和身体去感受,以及拥有心灵或拥有>> 智能或感知能力,但也有我,你知道,Don,感到饥饿,Don 感到理解故事的快乐,这并不是今天的人工智能,因为今天的人工智能,你知道,在语言方面是一个抽象的软件,它没有身体来自我意识,当然,随着我们进入机器人领域,情况确实会发生变化,因为这些机器拥有感觉系统,但它们的感知系统与人类的感知系统非常不同。它没有与该生物的生存和进化本能联系起来。>> 关于进化本能,我有一个问题是关于奖励函数。我觉得人类有一个奖励函数,一个相当清晰的。我知道我们在尝试训练人工智能时会创建人工奖励函数。你认为人工智能的奖励函数是它们的本能吗?>> 你可以那样称呼它。再次,本能,我们几乎必须再次问人工智能如何定义本能。本能是一个非常微妙和抽象的,几乎是人类独有的词,对吧?所以,嗯,但如果问题是,驱动人工智能算法的奖励函数是它,答案是肯定的,这就是它的数学设置方式,它被优化以实现奖励函数。>> 你认为我们会在人工智能方面遇到极限吗?>> 是的,也不是,原因如下。人工智能是,让我问一个问题,我们是否在物理学理解和发展方面遇到了极限?>> 不,没有。>> 对。没错。而这是一门更古老的科学。你知道,我的意思是,我曾是一名物理学学生,我在世纪之交左右学习物理学时,物理学家们感叹或开玩笑说,伟大的问题已经解决,或者在早期就被提出了。然而,物理学领域仍在继续。我的意思是,那半是玩笑。物理学领域仍在继续,我们仍然有如此多的未知。我认为人工智能作为一个技术科学领域比物理学年轻得多。我们有如此多的未知问题,对吧?所以,所以,我没有在任何地方看到限制。它在执行特定任务的能力可能会根据算法和硬件而趋于平稳,我们还在发展吗?有像局部,你知道,细微的故事,你知道,人们说某些数据成为某些人工智能算法的限制因素,这可能在一段时间内是真的,然后我们有了新的模拟方法,或者甚至绕过数据的方法。所以,所以宏观上,我预计很快不会发生这种情况。>> 嗯,这很令人兴奋。从研究的角度来看,这意味着仍有大量的学习和探索空间。>> 当然。>> 在,嗯,你知道,我们谈了很多关于空间智能如何解锁了机器人和医疗保健领域的创造力,我也注意到它也解锁了很多监控应用。我想问一下,嗯,世界模型是否存在你担心的滥用方面?>> 当然。每一种工具,即使只是一张纸,我都会担心纸割伤,更不用说像人工智能这样强大的东西了,无论是语言模型还是世界模型,对吧?这项技术可以被武器化,这项技术可能被滥用,这项技术可能伤害人们。人类创造的每一件工具都是一把双刃剑。我认为了解这一点非常非常重要,我们是由好奇心驱动的。我们也由我们对拥有更简单的工具、更好的生活、更健康的身体的渴望所驱动,所有这些都有助于我们跑得更快,飞得更高。所有这些都有助于我们创新。但每一项创新都可能被滥用。当然,也有人只想创新来伤害别人,这真的很糟糕。但这在人类社会中确实会发生。>> 我们能阻止吗?这就是为什么我们有法律、秩序、治理、社会规范、教育、伦理和宗教以及人类社会。我们在许多维度上构建我们的社会,以便我们能够继续拥有更好的生活并避免伤害。>> 感谢您的回答。是的,这令人耳目一新。所以我们不得不依靠我们的创新能力来带来伤害,或者通过创新解决方案来减少伤害,就像围绕这些事物的有害方面一样。>> 我认为我们不必,我真的认为我们必须依靠自己,我们的心,我们的头脑,以及我们内心的仁慈。每个人心中都有一个天使和一个小恶魔。我们必须依靠我们人性的一面,人类的价值,来尝试利用技术造福他人。>> 谢谢。我完全同意。回到,你知道,谁拥有这些东西?如果有人创造了完美的物理引擎,谁应该拥有它?是机构吗?是私营公司吗?是人类吗?是海豚吗?没有人。嗯,谁拥有我们世界的物理引擎?>> 技术的好消息是它会传播。所以它以不同的方式传播。有公开传播,尤其是在公共领域,从学术界到开源等等。即使它是专有的,它也会传播,你知道,即使是专利也有时间限制。>> 市场竞争迫使不同的竞争者进行创新和竞争,这本身就是一种传播方式,而且至少在美国,我们有反垄断法来防止和阻止垄断。所以,谁拥有物理引擎?我认为我们将有多个版本。我们今天已经有多个版本的物理引擎了。人工智能原生的,神经模拟。我们将有多个版本。我确实希望 World Labs 能开发出最早的版本之一,但从哲学的角度来看,我认为技术确实会传播和分布。>> 哦,是的,我的意思是,我看着我工作室里所有的技术,现在有微芯片和微处理器,就像我拥有这些东西,但它们曾经只在研究实验室里,以及数十亿美元的研究,你知道,单个东西,它们已经小型化,成本已经下降。这令人兴奋。我想在我们结束时过渡到一点,是关于人类的工作和尊严。我一直关注你的工作,我从你所做的事情中受到启发。我有一个问题是,随着越来越多的学习系统进入现实世界并开始进行现实世界的实践,它们不再仅仅处于模拟中。我们如何确保人类的尊严得到保留,对于那些工作与这些全新的机器人系统交叉的人们?>> 是的,这是我最喜欢的话题之一。我们谈论人工智能很多,我认为,无论我们的工具多么强大,人类的尊严都应该处于这次对话的中心,我认为在这方面有多层责任。有我们的个人责任。我们的尊严掌握在我们自己手中。我们如何学习,如何使用工具,如何工作,如何在生活中表现自己,这种责任完全在我们身上。但我们也是一个相互联系的社会,作为父母、老师、同事、艺术家。我们也希望确保彼此的尊严。例如,现在我是一名初创公司的创始人,致力于产品开发,这让我感到很多快乐和希望,在我们公司内部,我们谈论赋权创作者,对吧?我们尊重创作者的尊严。我们希望创造一个创作者觉得他们可以利用它来改善他们的工作,而不是剥夺他们的尊严的产品。而且我认为我们可以与创作者进行很多合作,因为我知道人工智能和创造力在这一点上是一个棘手的话题。人们对创造力有很多焦虑。人类一直都在创造工具来帮助创作者。想想艺术史,对吧?>> 人类创造史和工具、材料甚至机器的历史一样悠久,对吧?所以,我认为在人工智能时代,需要进行更深入的对话,而不是更少的对话,在像我这样的人与创作者、医生、老师或任何其他人之间,关于我们如何利用机器来赋权人类。我喜欢你刚才让我想到,想象一下,如果在文艺复兴时期,他们不允许使用凿子,他们只能用双手雕刻大理石。那将非常不同。>> 一个很棒的双关语,因为我们的模型叫做 Marble。>> 哦,你看。>> 是的。因为我们真的,我们用它,因为我们觉得 Marble 是一种帮助艺术家和创作者创造世界的材料。>> 哇。>> 是的。>> 我不是故意的,顺便说一句,那是个好。我们有一个叫做 Chisel 的功能。>> 你是认真的吗?>> 如果你进入我们的 Marble 模型并打开高级模式,有一个叫做 Chisel 的特定功能。>> 哦,我的天。什么?我怎么没看到这个?哦,它在高级选项卡里。好的。>> 是的。是的。>> 哇。>> 你应该试试。>> 我会的。>> 它允许你>> 你能清理散点图吗?>> 是的,我们有。它在工作室功能中。Chisel 允许你使用 3D 布局来指导创作。所以你可以放置块,然后说创建一个遵循此布局的画廊。>> 它使用你放置的块来影响几何形状。>> 没错,没错。>> 我喜欢。好的。我一定会使用那个 Chisel 功能,我需要向我的观众展示。我不知道那个。哇。这就是你称你的第一个世界模型为 Marble 的原因吗?是那个原因吗?是的。它实际上是双关语。我们喜欢它。首先,地球有时被称为 Marble。>> 是的。>> 世界。你知道,Marble 是世界的昵称。但 Marble 也是一种艺术家和雕塑家最喜欢的材料,用来创造想象中的世界。所以,我们喜欢这个词,因为这个原因。>> 这真是太棒了。这就像锦上添花。这是我之前不知道的令人愉快的惊喜。>> 我很高兴。>> 是的,这真的很棒。我喜欢。哇。天哪,这项技术可以有很多方向。我有一个有趣的问题给你。如果一个机器人模拟练习折叠一万次衣服,然后在现实世界中成功完成,你认为真实的体验发生在何处?>> 发生的一切都是真实的。我的意思是,那件衣服是真的,机器人是真的,工作是真的,结果也是真的。而任何受益于这项工作的人都获得了真实的利益。所以我认为这是非常真实的。>> 但即使,但那个模拟的电脑,是真实的体验,还是当它在 Marble 世界中物理地完成时?>> 好的。现在我必须问你,谁的体验?如果体验是机器人,它确实有传感器,如果是物理传感器,那么真实的体验对机器人来说是真实的。如果体验是模拟计算机中的一块硅片,并且硅片通过零和一,那是一次真实的体验。它有意识和觉知吗?我认为没有。但这是一个真实的物理过程。如果我得到这件折叠好的衣服,我喜欢它,那种喜悦是真实的,那件折叠好的衣服也是真实的。所以有很多真实的东西。我们喜欢称模拟为虚拟,因为它是由比特组成的。不是原子。但这并不,但这有时具有误导性,因为即使它以比特的形式存在,也发生了一些真实的事情。>> 对吧?我的意思是,我真的很兴奋地看到,当我阅读你的书时,你一直是一个科幻迷。这就是为什么我想问一个更偏向科幻的问题。你认为,你知道,如果电脑中的学习是一个虚拟环境,这里的学习就像在物理世界中。你认为,我试着小心翼翼地问。我直接说吧。我们现在是在一个模拟中吗?>> 我知道你会这么说。你知道,Don,我,多年前,我只会一笑置之,现在我们不在模拟中。但我知道也有 Nick Bostonramm 谈过这个问题。埃隆·马斯克喜欢把它作为一个物理学学生来谈论。量子现实和平行宇宙,在量子意义上,今天是非常真实的事情。我想说,首先,什么是模拟的定义?就像如果模拟是一个允许基于某些物理定律和动力学定律的过程,并且这个过程发生了,你几乎可以说我们生活的这个世界可以被定义为模拟。>> 我明白了。>> 现在,它也可以是一个更深层的问题,有人设计了这个模拟吗?有更多的意图,我不知道。作为一名科学家,我的第一反应是,没有证据,我不这么认为。但我会谦虚地说,我们尚未证伪这一点。在有证据之前,我不想把一个假设当作是真的或假的。我也不想过度炒作潜在的可能性,但我也需要足够谦虚地接受这种可能性。而且,随着 World Labs 创造出像 Marble 这样的技术,我们在虚拟世界中模拟了如此多的空间。>> 是的。>> 这让我着迷,让我想哇,有一天我们的模拟可以通过 3D 打印,通过雕刻,无论是什么,来实现物理化,然后模拟和非模拟的界限将开始模糊。我们将在我们的模拟中训练机器人,最终它们将转移到现实世界。所以,所以这项技术无疑将我们带到了我们从未想象过的地方。>> 百分之百。我问的原因是,嗯,我有一个朋友,他不用电脑和科技。他不在科技领域。他确实使用很多迷幻剂。嗯,我给他看了一个我用 Marble 制作的视频,我让相机离开,我有一个,我用 Marble 重建了一个大教堂的内部,然后相机离开它,向上飞去。我给他看了这个视频,他说,这正是我在一次迷幻体验中离开身体时看到的样子。他说>> 这很有趣。他说,“现实是否只是一堆高斯散点,就像那些非常非常高分辨率的,一直在更新的,嗯,而且无论你往哪里看,它都会增加更多的分辨率。”我当时想,“哦,哇,让我问问创始人,让我,让我弄清楚到底是什么。>> 我可以回答。现实不是一堆高斯散点。高斯散点是表达现实的一种方式。>> 太棒了。>> 就像网格一样。就像平面像素一样。这些表示中的每一个都试图表达现实,它们各有优缺点,但高斯散点是目前最强大的表示之一,因为它具有视觉保真度以及几何信息。>> 我会把这段视频放给他看,他会说,“好的,谢谢你的澄清。”最后,我把你的一个散点图带到我的 Vision Pro 里,我在里面走来走去。>> 哦,我喜欢。>> 我把我的手放在散点图前面。>> 是的。>> 我可以把它穿过>> 触摸它。>> 是的。我拍了结婚照,然后我重新散布了环境,在里面走动,这很奇怪。我觉得我正在获得新的记忆,或者回忆起更多关于我自己的婚礼的记忆,在那里看到每个人都处于正确的比例。>> 是的。>> 正确的高度,你看着他们的眼睛,然后你说哇,我只是,你知道,你对此有什么看法?>> 我,这,我实际上>> 即使我们还处于早期阶段,我们的模型和产品也深受虚拟现实社区的喜爱,我对此非常感激。我想让它变得越来越好。但是的,沉浸感,空间体验。这不是一张照片,甚至不是全景图。这是一个可步行的空间,你知道,世界。我也喜欢这一点。我认为随着头戴设备和眼镜在硬件形态上变得更好,这一点将变得越来越受欢迎。Marble 的功能与这些硬件的功能相结合,将为人们带来前所未有的新体验。>> 是的,Feay 博士,非常感谢你的时间,嗯,嗯,加入这里并与我聊天。>> 嗯,谢谢你,Don。这是一种真正的喜悦。你问的问题非常深刻和有趣。好的,太好了。