📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

[SDF2025] Co-Founder, World Labs | The Next Frontier of AI with Dr. Fei Fei Li / SBS / SBS D Forum

SBS D FORUM (SDF)38:02

Transcription

让我们见见她。 >> [音乐] >> 嘿,[音乐] [音乐] 嘿,[音乐] 嘿。 >> [音乐] >> 热。热。 >> [掌声] [欢呼声] >> 这是您第一次通过本次论坛与韩国观众见面。呃,您能否首先向观众和我们的观众简短地打个招呼? >> 大家好。很高兴来到这里。这是我第一次面对韩国观众,呃,我非常兴奋地与大家分享我今天看到的关于人工智能的,呃,特别是空间智能以及以人为本的人工智能技术。最近您对空间智能的研究非常关注。这听起来有点陌生。什么是空间智能? >> 是的,当然。嗯,如果您想到人类智能,我们实际上是非常复杂的智能动物。我们使用语言进行交流和推理。人们倾向于称之为语言智能。当人工智能能够做到人类所做的事情,甚至做得更好时,我们称之为大型语言模型。同样,人类也能以非常非常深刻的方式感知和理解空间。我们不仅能解读三维世界,还能利用我们的创造力来创造它。我们可以与它进行推理。我们可以四处走动并与之互动。无论是描绘一幅美丽的风景,还是烹饪煎蛋卷,或者是在空间和其中的物体上进行创新,所有这些都需要空间智能,而这与语言智能是互补的,我认为这是人工智能的新前沿。它需要对世界进行建模,我们称之为大型世界模型,并且需要理解、推理和生成不同类型世界的能力,并与之互动。所以,这是一项我非常兴奋的非常深刻的技术。您提到我们需要大型世界模型。如果我们能够实现这样一个模型,会发生什么? >> 这是个好问题。嗯,事实上,我们可以利用空间智能的应用有很多。首先,人类有很多创造性的工作,人工智能和空间智能可以提供帮助。例如,许多视觉创作者希望以三维形式或电影形式表达故事,但创作它们需要花费大量时间,无论您是使用像虚幻引擎或Blender这样的传统工具,还是使用电影等等,表达人类的创造力都需要花费大量时间。如果我们能为人类提供更强大的工具来表达他们的故事和情感,这将有助于创作者做得更好。所以,这是与创造力相关的设计,对吧?今天的设计,尤其是无论是建筑设计还是其他类型的设计,人类都必须努力解决我们如何推理空间的问题,而人工智能空间智能工具可以帮助人类更好地设计。但除了这些创造力和设计应用之外,空间智能本身就非常强大,它可以帮助训练机器人,例如在空间中进行互动和推理。这是我们称之为具身人工智能的另一个前沿领域,我认为它在从医疗保健到制造业再到许多其他领域帮助人类方面具有巨大的应用潜力。那么,让我来转达韩国代表性人工智能专家的提问。我们收到了一些事先准备好的问题。首先,韩国人工智能软件产业协会会长、12 Labs的CEO、Furiosa的CEO和SBVA的CEO与我们同在。您好,我是韩国人工智能软件产业协会会长Jun-hee Lee。教授,您强调高质量数据将是人工智能开发过程中技术创新的转折点。您认为韩国如何才能实现高质量的制造业数据使用,我们必须解决哪些技术和制度上的挑战? >> 是的,首先,韩国几十年来一直是技术强国。就我个人而言,我曾与来自韩国的优秀学生和同事一起在人工智能领域工作。所以,我非常非常高兴看到韩国在人工智能领域进行投资。我完全同意。我认为制造业是当今和未来人工智能技术下巨大的增长领域。它不仅涉及语言能力,还涉及大量的空间和具身人工智能能力,而数据至关重要。因此,拥有高质量的制造业数据是非常重要的一步。需要解决的一些挑战显然是如何扩展数据,如何实现数据与建模之间的闭环。拥有数据很好,但将其应用于有效的建模也非常非常重要。当然,根据设置的不同,我们越能降低数据访问的门槛,就越有利于许多创新者使用这些数据。所有这些都是公司层面和国家层面都需要解决的关键问题。 >> 它已经发展成为一个ICT强国,现在正在寻求一种将全栈人工智能集成技术、数据基础设施和服务出口到关键合作伙伴国家的战略。我们应该考虑哪些核心原则来制定这个人工智能全栈出口模式? >> 我很高兴听到韩国有这样的承诺,即成为全栈人工智能模型,或者也有与全球合作的愿望。事实上,人工智能是如此的横向,不仅从功能、能力的角度来看,而且它也是横向的,因为它将影响到世界上每个人。所以,韩国在全球人工智能发展中发挥重要作用,这真的很棒。我们一直在看到的一件事,尤其是在斯坦福以人为本人工智能研究所,当我们与国际国家和机构交谈时,就是国际合作的愿望,尤其是那些拥有相似价值观的组织和国家。建立负责任的人工智能框架,从数据源到模型设计再到应用护栏,都保持透明和尊重,这一点非常重要。所有这些都是这项合作努力的重要组成部分,而且很高兴看到人才交流,无论是商业领袖层面、学生层面还是工程层面,全球人才的交流和信息的交换都很重要。我个人知道,有许多韩国公司,实际上从三星这样的大公司到初创公司,都在全球人工智能发展舞台上非常活跃,这些都是韩国在当今人工智能领域活力的绝佳体现。 >> 教授,我是12 Labs的Ezong。每次见到您,我都会感谢您的建议,因为您是我们的一位股东。我的问题可能听起来有点哲学化,但您认为通过生成来理解的极限是什么? >> 很高兴再次见到Jay。我们已经是朋友好几年了。这是一个很好的问题。通过生成来理解是否存在局限性?如果您指的是生成模型的极限,我认为还有相当大的空间。首先,在空间智能方面,我们还没有一个很好的生成模型。当涉及到空间生成模型时,它不仅需要语义上捕捉空间的内涵,还需要在几何上非常完美。如果我生成桌子上的一个杯子,那个杯子在代表空间方面必须结构非常完善。当一个人或机器人试图与杯子互动时,它也必须非常完美。它的形状不应该变形等等。所以,我们还处于起步阶段。并且,理解生成的内容。这也是正在进行的研究。当然,我们在计算机视觉或人工智能的识别子领域取得了很大进展,通过像素,人工智能可以识别是否有椅子,是否有道路,是否有树木。但理解不仅仅是语义上知道物体。那么,我们称之为“可供性”或物体的功能呢?例如,一块大石头。它可以是一块石头,但有时它可以变成一把椅子。它也可以变成建筑材料。它甚至可以被加热来保暖。所有这些都是对空间世界的深刻理解,至少通过今天的技术,它并没有真正通过纯粹的生成来体现。所以,从哲学的角度来看,这个世界有很多东西是人类可以理解的,而人工智能离那种深度和深刻的理解还差得很远。 >> 让我再问您一个问题。在您看来,LWM中的“ChatGPT时刻”是什么? >> 这是个好问题。嗯,我实际上认为我们离得不远。我的意思是,我如何定义它?在我看来,“ChatGPT时刻”是基于一个非常强大的大型语言模型GPT,特别是GPT3.5模型的一个应用时刻,当一个基于这个模型开发的产品以ChatGPT的形式出现时,它对许多用户来说变得非常流行,从消费者到开发者。所以,“ChatGPT时刻”世界模型的基石必须是,需要有一个非常强大的大型世界模型。我们还没有完全达到那个程度,但我们看到了萌芽的科学。在World Labs,我们一直在开发一个专有的前沿模型,它非常强大,并且是第一个演示生成三维空间的技术之一,其能力与人类相当,有时甚至超越人类。所以,将这些强大的模型产品化,并允许人们使用它并取得成功,将是一个“ChatGPT时刻”。当然,很难预测大型世界模型的病毒式传播。这取决于产品,产品如何服务于谁,客户的领域是什么。而且,我认为不应该只有一个“ChatGPT时刻”。世界建模在用例方面非常广泛,我们可能会看到大型世界模型的多个所谓的“ChatGPT时刻”。所以,我们将继续问答环节。在人工智能半导体领域备受关注的公司之一是Furiosa。这是来自Furiosa的CEO的问题。 >> 您好,Fei-Fei教授。我是Furiosa AI的CEO。我们开发人工智能半导体芯片。与目前主流的基于文本的LLM模型相比,世界模型可以更根本地理解空间世界。从范式上看,大型世界模型的基本区别是什么? >> 是的,这是一个技术问题,也是一个有趣的问题。语言是一维信号。它是一个序列信号,这就是为什么开发一个序列到序列的模型如此强大,输入是token,输出是token。但世界不仅仅是一维的。物理世界是三维的,如果我们加入时间,就是四维的。我们如何开发一个在表示和生成这些世界方面有效的模型?我们需要显式的三维表示吗?我们使用隐式的三维表示吗?我们如何输入我们没有太多三维数据的模型,并输出三维结果?所有这些都是极其技术上具有挑战性的问题,同时也令人兴奋。我们有责任发明新的方法和新的架构来回答这些问题。目前,大型语言模型需要大量数据进行训练和推理。您正在开发的世界模型是否需要比LLM更多的计算量,还是能够更有效地运行? >> 这是个好问题。嗯,世界模型还处于早期阶段。LLM令人兴奋但也是现实的一部分是,我们看到了一个规模法则。规模法则表明,当我们增加模型的复杂性和参数数量,并增加它摄入的数据量时,模型变得更强大。正因为这个规模法则,它在计算方面变得非常苛刻。我们正在看到一些关于大型世界模型规模法则的萌芽科学,但这还处于早期阶段。是的,简短的回答是,因为数据的复杂性更加丰富,我们将面临大量的计算需求。例如,如果您观看一个每秒六帧的4K视频,一小时的视频相当于数亿个token,为了生成如此多的数据进行推理,能够生成那种模型世界将需要大量的计算。但奇怪的是,到目前为止,我们所知道的所有讨论过的世界模型都比LLM小,而且我认为这种情况不会永远持续下去。这只是表明它仍然是一个非常年轻的领域,我们还在探索。但简短的回答是,我相信它将是计算密集型的。 >> 您好,我是SBVA的CEO。教授,在您看来,AGI(通用人工智能)之后,ASI(超级人工智能)何时可能实现? >> 这是一个好问题,也是一个非常哲学的问题。嗯,这在很大程度上取决于您如何定义人类智能。例如,今天的人工智能可以翻译许多不同的语言,它能翻译的语言数量几乎超过了世界上所有人类。我们大多数人最多只能说个位数种语言,但今天的人工智能可以翻译几十种不同的语言。所以,从这个角度来看,它已经是超级智能了。但是,虽然今天的人工智能,我相信随着人工智能变得越来越强大,它可以超越某些人类能力。这是否意味着它与人类相比是普遍的超级智能?还不清楚,因为人类有不同的理解世界、进行智力活动和创造思想知识的方式,而其中一些方式并不为人所知。例如,这是一个例子。从统计学上讲,我们的视频模型已经可以显示苹果会从树上掉下来。但我们还没有看到一个人工智能算法能够观察这些现象,无论是天体的运动还是自然的运动,并推导出F=MA这个方程。这是人类智能的一项了不起的成就,我们不知道人工智能如何才能达到那里。而这仅仅是数学或物理智能。人类每天都在以深刻的方式运用我们的智能,尤其是在情感、社交和同情心以及许多深刻的智能方面。所以我不知道是否有任何迹象表明会出现这种水平的超级智能。但当涉及到某些任务时,无论是翻译、创作照片、三维空间,还是关于我们能够获取数据训练数据的任何现有领域的知识,人工智能将变得越来越强大,我认为它可以成为人类使用的强大工具。 >> 再次感谢今天在座的各位专家。让我们继续下一个问题。教授,我知道您一直在为许多韩国人工智能领域的公司提供咨询和合作。您如何评价韩国人工智能技术和产业的当前水平? >> 我非常感谢这个问题,但我也想非常谦虚,不认为我了解韩国人工智能领域的全貌。我想说的是,正如我之前所说,在我整个职业生涯中,我与许多来自韩国的才华横溢的人、同事、学生和工程师以及研究人员共事过。这是一个拥有非常强大的STEM和工程、数学、物理和计算机科学K12教育的优秀国家。正因为如此,以及非常强大的本科项目,我得以与许多来自韩国的研究生以及后来的工程师共事。我也看到了韩国人工智能初创企业领域非常活跃的景象,每次我和在韩国的朋友和同事交谈时,人工智能的热情和兴奋是显而易见的。所以我非常期待更多地了解韩国,更多地了解韩国的人工智能领域。 >> 教授,您是斯坦福以人为本人工智能研究所的联合创始人,并且您一直引领着关于人工智能伦理和社会责任的全球讨论。您经常强调,除了速度和效率之外,真正重要的是确保人工智能的设计是以人为中心的。您能否分享一下您对“以人为本的人工智能”的理解? >> 这是个好问题。我认为“以人为本的人工智能”归根结底是我们应该如何开发、治理和应用人工智能的指导原则。我相信人工智能是一种工具。它是一种非常强大的工具。它可以做好很多事情。人类自文明之初就一直在创造工具,甚至在人类发明书面语言之前,人类就在发明工具,无论是火还是第一把石斧、刀具等等。随着我们发展我们的工具,我们了解到它们可以极大地帮助我们。它们可以帮助我们建立文明。但另一方面,工具是双刃剑。它们会伤害我们。它们可以被故意用来伤害我们。它们可能被无意中用来伤害我们。所以我认为,当我们开发越来越强大的工具时,将人类福祉和人类仁慈置于开发、应用和治理这项技术的核心是非常重要的。这就是我所说的“以人为本的人工智能”的含义。人工智能和数据资本日益集中在少数公司和国家手中,引发了对新形式不平等的担忧。您认为需要采取什么样的社会工作政策方法来缓解这种不平衡? >> 确实,在当前的人工智能时代,资源存在集中。我认为这就是为什么我一直非常积极地倡导鼓励创业、鼓励人工智能开源的政策。而且,我认为不同国家投资人工智能,投资人工智能基础设施,这也很棒。我相信一个充满活力的人工智能生态系统不仅需要强大的大公司,它还需要企业家,不同群体开发不同的应用。它还需要公共部门,从政府到高等教育到研究机构再到非营利组织,它们可以继续走在创新人工智能的前沿,并与人们沟通和教育人们关于人工智能。我们从预先提交的问题中选择了一个问题,我必须说我个人对这个问题也很好奇。随着人工智能的不断发展,我们已经看到许多工作被它取代。未来,是否仍然存在只有人类才能做的工作? >> 我认为会有很多工作是人类可以做的,而且工作也在不断发展。再次,您知道,一百多年前,几乎80%以上的人类是农民,而今天,美国不到10%的人口是农民。所以,工作已经发生了巨大的转变。我们已经看到工作或多或少地发展和消失了。但我们也看到了许多新工作的创造。例如,软件工程就是一个很好的例子。就在半个世纪前,50年前,软件工程这个职业并不存在。但今天,软件工程是薪酬最高、最棒的工作之一。当然,人工智能也在改变软件工程。但我的观点是,工作将会转移,有时也会发生变化,例如教师这个职业,我认为教学永远不会消失。人类是学习的动物,小孩子需要向成年人学习,我们也应该终身学习。但有新的学习工具,也有新的教学方式,这将会发生变化。所以,我认为我们将迎来一个非常有趣的时期,一些工作将会萎缩,一些工作将会发展,一些新工作也会出现。 >> 今天人工智能发展的速度正在超越我们现有的法律、伦理和教育体系。在这种情况下,为未来做准备到底意味着什么?有什么方法可以缓解这些挑战吗? >> 我认为今天机构和政府的责任之一就是进行有效的人工智能公众教育和沟通。我们的社会对人工智能存在很多焦虑。这种焦虑很大程度上源于它的新颖性。很多人还没有得到充分的沟通或教育,不知道人工智能是什么,然后它影响工作,影响教育,而且它还包含一些伦理问题,挑战社会行为,包括民主进程。所有这些都会产生焦虑。我认为,迅速投资于人工智能的沟通和公众教育,以及政府与公司、公众部门和高等教育密切合作,制定良好的人工智能护栏和监管政策,这一点非常重要。所有这些都是重要的努力。在预先提交的问题中,最常被问到的主题是人工智能时代的教育。教授,在您看来,未来的教育应该朝着什么方向发展,您认为最需要改变的是什么? >> 我对人工智能教育最感到兴奋。我认为这是人类更新和改进我们教育框架的巨大机会。在过去的100年里,我们的教育框架几乎没有改变。小孩子来学校,试图被灌输大部分是记忆性的知识,然后通过记忆进行测试,然后通过这种测试来提升他们的水平。现在我们拥有强大的人工智能,可以触手可及地提供如此多的知识,我们应该认真思考如何更新我们的教育体系,让我们的孩子不仅仅是学习知识,而是学习如何学习,学习创造力,学习如何最有效地使用工具,并为未来的工作学习。所以我认为教育有很多机会,无论是对老师还是对学生。 >> 那么,我来问下一个问题。在人工智能时代,我们应该持有什么样的态度? >> 我认为我们生活在人类创造了人工智能的这个时代,这是一个非常激动人心的时刻。我认为我想分享的最重要的想法是,每个人都可以参与人工智能。无论您是艺术家、音乐家、医生、老师、律师、运动员、数学家、计算机科学家、工程师、企业家。很多人问我,如果我没有计算机科学或工程学位,我是否会被人工智能落下?我不这么认为。有很多方式可以参与和影响人工智能。首先,您可以成为人工智能的用户。有许多人工智能应用程序可以提高您的生产力,让您的生活更美好,这对当今的任何公民来说,学习这些工具都是有用的。其次,在您的日常工作中,尝试利用人工智能来提高您的生产力,因为这就是未来。这能让您为未来做好准备。而且,作为韩国和您社会的公民,您在治理人工智能、使人工智能造福所有人方面拥有发言权。您的声音非常重要,无论您是艺术家、律师还是医生。所以,您可以参与到这种公民讨论和治理的民主进程中。所以我只想说,每个人都有自己的角色,每个人在人工智能方面都有自己的责任。 >> 教授,您能分享一下您接下来的计划吗?我非常热衷于空间智能、机器人模拟、机器人学习和计算机视觉。我现在非常专注于构建这些技术。 >> 非常感谢您分享您的见解,以及您对韩国观众的鼓舞人心的信息。您能与我们的观众分享您的最后一句吗?非常感谢。我非常享受所有的问题,我绝对期待继续与韩国的学生、研究人员、同事、企业家、商业领袖合作,并希望将来能访问韩国。谢谢您,Failey教授。我们的会议到此结束。明天再见,与Failey教授。非常感谢。 [掌声] >> 非常感谢。