Transcription
哇,那真是太疯狂了。今天是2月27日,星期五。过去一周发生了许多人工智能新闻,几乎每周都如此。我不是来浪费你的时间的。我们直接进入正题吧。首先是Nano Banana 2的发布。这是谷歌DeepMind最新的最先进的图像生成模型。它几乎和Nano Banana Pro一样好,但生成速度快得多,你可以在Gemini应用、AI Studio、Flow或Vertex中免费使用它。它具有搜索基础功能,所以当你要求它为你创建图像时,模型会从Gemini的真实世界知识库中提取信息,并由来自网络搜索的实时信息和图像提供支持,从而更准确地渲染特定主题。它在文本渲染和翻译方面也真的非常出色。
使用它的最简单方法是访问gemini.google.com。点击那个“创建图像”的小按钮,你就会知道你正在使用Nano Banana 2,因为现在你有了以前没有的所有这些样式选项。将这个小开关拨到“快速”,你就可以用Nano Banana 2进行创作了。它生成图像的速度大约是原来的一半。所以如果我想创建一个珐琅徽章,我会选择这种样式,然后把我的头像放进去,说“用我的头像创建一个珐琅徽章”。它可能需要大约13秒来生成图像,我们得到的东西看起来非常令人印象深刻。再次强调,它会搜索网络并根据它在网络上找到的内容创建图像。例如,创建一个信息图,解释AI模型蒸馏是如何工作的。它为我做了研究,而且它正在使用Nano Banana 2。几秒钟后,我就得到了一张相当不错的信息图。如果我们仔细看,文本非常准确。我没有看到很多拼写错误或文本错误。总之,现在可以在Gemini中免费使用。我不会深入探讨这个,因为我制作了一个完全专注于Nano Banana 2的完整分解视频,其中包含了关于该特定发布的所有细节。如果你还没有看过,请查看那个视频。
现在,你可能已经意识到,我们正处于人工智能代理真正有用的时代。随着OpenClaw等工具的巨大成功,每家公司现在都加入了人工智能代理的行列,它们会为你完成耗时的任务,真正为你减轻了很多负担。我本周看到的最令人印象深刻的发布之一,正是来自Perplexity。本周,Perplexity推出了Perplexity Computer。Computer将所有当前的人工智能能力统一到一个系统中。它可以端到端地研究、设计、编码、部署和管理任何项目。
现在,如果你好奇这与OpenClaw有何不同,它们都服务于相同的目的,即你给它一个任务,它就会去为你完成所有工作以完成该任务。它们都能够为不同的任务使用不同的模型。然而,Perplexity Computer被设计成更像一种“一站式”体验。你告诉它你想要什么,它就会去使用它能访问的所有不同模型和所有不同工具来为你完成任务。而且它都是在一种安全的云环境中完成的。另一方面,OpenClaw优先考虑自主性。用户将保留数据的完全所有权。它通常安装在你的本地计算机或你拥有和控制的虚拟私有服务器上,但你也要负责管理随之而来的所有风险。因此,Perplexity Computer试图将大部分风险转移到他们的平台上。
我们可以看到它可以将工作路由到19种不同的模型。你知道,GPT模型、Opus模型、Grok模型。它可以使用Nano Banana。它可以使用V3。它似乎可以与你想象的几乎任何工具一起工作。Slack、AirTable、Calendarly、ClickUp、Discord,你知道,应有尽有。它似乎可以帮助你完成该平台内的任务。现在,这个特定代理的一个缺点是它目前只对Max订阅者开放。他们确实说它很快会登陆Perplexity Pro和Enterprise,但你今天必须订阅他们每月200美元、每年2000美元的计划才能使用它。但我们可以在他们的一个演示中看到,它只是获取一个待办事项列表,不断向这个待办事项列表添加更多内容,并加载它,这样它就可以自主地去勾选你所有的待办事项,我想。而且它不仅仅是基本的东西。它是实际的半复杂的事情,比如创建移动网络应用程序和创建Rust ASCI编辑器。而且人们显然也用它制作了一些非常令人印象深刻的东西。
Hampton在这里说,Perplexity刚刚成为第一家真正与彭博终端正面竞争的人工智能公司。使用Perplexity Computer,无需本地设置或单一大型语言模型限制,它能够使用Perplexity Finance为我构建一个具有实时数据以分析英伟达的终端。在这里看一眼,它看起来像构建了一个彭博终端类型的环境,而且显然它都是自主完成的。Perplexity Computer像人类同事一样通过使用软件堆栈来操作。计算机进行推理、委派搜索、构建、记住代码并交付。从描述一个结果开始。Perplexity Computer将其分解为任务和子任务,创建子代理来执行。子代理可能会进行网络研究、文档生成、数据处理或对你连接的服务进行API调用。一个代理起草文档,而另一个代理收集所需数据。
再次强调,它与仅仅使用Claude或ChatGPT等工具的一个主要区别在于,它能够利用所有可用的模型。截至本文撰写之时,Perplexity Computer使用Opus 4.6作为其核心推理引擎,并使用最适合特定任务的模型来协调子代理。Gemini用于深度研究,Nano Banana用于图像,VO3.1用于视频,Grok用于速度和轻量级任务,ChatGPT 5.2用于长上下文回忆和广泛搜索。因此,它可以根据哪个模型最擅长你具体要求的事情来选择不同的模型。
现在,我自己不是Perplexity Max的订阅者,但他们确实有实际操作的演示。所以,我们可以在这里看到一大堆实时示例,比如一个S&P 500气泡图网站,我们实际上可以看到它正在运行所有这些过程。如果我点击这里,它会构建交互式S&P 500气泡图,并行运行任务,加载各种技能,它只是在这里完成整个过程。现在,因为这是一个演示,我实际上可以跳到最后,看到最终输出。它说:“你的S&P 500宇宙气泡图已上线。这是其中的详细信息。”我实际上可以打开并查看它创建的内容。这是一个非常交互式的气泡图,看起来令人印象深刻,因为它使用了最好的模型来创建这个东西。我可以将鼠标悬停在气泡上,是的,我的意思是它令人印象深刻。设计不是很好,但所需的功能都在那里。
这是另一个例子,它创建了一个特斯拉过去10年股价的动画GIF。我们再次看到它并行运行不同的代理。所以,它正在派出不同的代理来完成不同的工作。让我们快进到最后。我们可以看到它完成了所有创建工作。这就是它创建的动画。令人惊讶的是,我实际上看到过这样的小动画在YouTube上作为独立视频走红。所以它现在可以为你做这些。
哦,如果你好奇为什么你可能需要Perplexity Computer提供的这种“限制”,请查看这篇帖子。这来自SummerU,她在Meta Super Intelligence从事安全和对齐工作。她说:“没有什么比你告诉你的OpenClaw‘行动前确认’,然后看着它飞速删除你的收件箱更让你感到谦卑的了。我无法从手机上阻止它。我不得不跑到我的Mac Mini前,就像我在拆除炸弹一样。”我们可以在这里看到一些截图,显然,它试图删除所有电子邮件,她一直告诉它停止,但它没有停止。现在,OpenClaw的创建者Peter Steinberger本人说:“你本应该输入‘/stop’,那样就会奏效。”但即便如此,这就是为什么人们应该想要Perplexity Computer之类的东西所带来的那种“限制”。
如果你对人工智能工具更新和改变我们工作方式的速度感到不知所措,那么,排队吧。但说真的,我想创造一些能给我的观众带来真正实用价值的东西,让你们能够真正将一个很棒的、易于访问的人工智能工具融入到生活中,提高生产力。所以,我与HubSpot合作制作了一份完全免费的指南,介绍了20多种使用Notebook LM提高生产力的方法。现在,我之前在这个频道上已经多次谈到过Notebook LM,它是谷歌最被低估的人工智能工具之一,而且它是免费的。这份指南列出了许多有用的使用方法。所以,如果你经常做笔记、保存文章,或者为工作或个人项目研究事物,那么这值得一试。在指南中,我详细介绍了Notebook LM如何将你不同格式的零散信息转化为结构化的见解。我向你展示了如何提出更好的问题,并从经过验证的来源获得非幻觉的答案。你还将学习如何更好地使用人工智能,从而充分利用它。再次强调,这是我与HubSpot合作制作的免费资源。所以,感谢他们为我的观众提供这个,并赞助了今天视频的这一部分。再次强调,Notebook LM是免费的,你也可以在描述框中的链接免费查看这份指南。
微软也通过其新的Copilot任务加入了代理行动。这再次看起来像是他们对OpenClaw和Perplexity Computer等的回应。现在,这个功能尚未公开可用。你必须加入等待列表,他们正在提供一些早期访问。但如果我们看一眼,它似乎旨在做与我们刚才看到的非常相似的事情,从答案、想法和草稿到完成的任务。所以,这里有一个例子:制作一份演示文稿,说服我的伴侣收养一只狗。它会去创建一个计划。你可以看到它开始一步一步地执行计划。然后它说:“这是你的幻灯片演示文稿。”它就为他们构建了整个幻灯片演示文稿。然后他们说:“她喜欢我们的新狗。我们预订一次拍照吧。”然后让我找到一次小狗拍照。它会研究摄影师,推荐最佳选择,找到最佳预订时间,然后它就回来,说已经预订了周二。所以从他们的新闻稿来看,它可以执行重复性任务。所以你可以告诉它定期做事情,它会做一些事情,比如编译简报,找出紧急电子邮件并准备好草稿回复,诸如此类。它可以进行文档生成、购物服务和预约、物流。所以再次强调,非常类似于为你做事情的代理。OpenClaw、Perplexity Computer、Manis。这似乎是所有这些都应该发展的方向,我们终于通过这些工具实现了。
让我们在这里再多停留片刻,因为Cursor也刚刚推出了一项新功能,声称Cursor代理现在可以控制自己的计算机。我发现这其中一个非常有趣的地方是,当这个Cursor代理为你使用其中一台虚拟计算机时,它实际上会录制它使用那台虚拟机的视频。所以你可以回放并查看那台计算机在为你进行更改和双重检查时做了什么。而让我个人成为Cursor的忠实粉丝,并将其作为我日常大部分编码工具的原因之一是,就像Perplexity Computer一样,它实际上可以使用不同的模型。所以,对我来说,我以前喜欢使用Opus 4.5或4.6来编写代码。最近,我发现GPT 5.3 Codeex在编码方面表现更好,但偶尔它会卡住并陷入循环,无法解决问题。然后我就会切换到Opus,而Opus可能真的能够解决那个问题。所以,使用像Cursor这样的工具非常方便,因为你可以在模型之间切换,有时一个模型会解决你之前尝试过的模型无法解决的问题。但如果我们查看他们的演示视频,他们实际上有选项可以将其设置为三小时、五小时、十小时,直到完成。所以它就可以去为你做大量的工作。你可以去睡觉,第二天早上醒来,看看你在睡觉的十个小时里它在你的各种编码项目上做了什么。我们甚至可以在这里看到代理记录了它自己在虚拟机中与桌面应用程序交互的过程。所以,我们在这里看到的是实际的Cursor代理正在他的虚拟机中进行交互,并完成它需要完成的所有任务,以完成为它设定的任何工作。我个人还没有测试过这个功能,但我真的非常非常兴奋能去玩这个。给它一个我想完成的巨大项目,设置它运行10小时或直到完成,然后就去睡觉,看看第二天早上我醒来时项目是否已经完成。
好的。接下来,我想谈谈一个我认为有点被忽视的工具,但我实际上对它印象深刻,那就是一个叫做Quiver的工具。Quiver的作用是生成SVG图像。所以,它们基本上是从代码生成的图像。你可以在app.quiver.ai上尝试它,他们会给你20个积分。现在,每次你进行生成时,它都会为你生成四张图像。所以你可以看到我用了八个积分,但这只用了两个提示。如果我点击我的图库,你可以看到我生成的一些东西。我看到Twitter上有人用“X战机飞越霍斯星球”的提示生成了图像。所以我想自己也试试。所以你可以看到这是它生成的一张图像。这是另一张,放大后看起来不是特别惊艳,但缩小到更小的尺寸时实际上看起来有点酷。这是它制作的另一个变体。这是它制作的另一个变体。然后我想测试我自己的提示:“一只狼在使用电脑”。它生成了这张图像、这张图像、这张图像和这张图像。请记住,这都是代码。所以,显示代码视图。这不是一个像Nano Banana或Midjourney那样的实际图像生成器。这实际上可以复制粘贴到HTML网站中,让这张图像显示在你的网站上,甚至可能进行动画处理。
但是如果我来到这里创建,我可以输入一个提示。我们来做一个圣地亚哥教士队的棒球运动员打出本垒打。我提交后,我们实际上可以实时观看它绘制。所以,它开始了。我们实际上可以看到代码流在这里底部进来,因为它正在实际绘制这些。它不是世界上最快的东西。它确实需要四到五分钟才能完成所有四张图像,因为它正在为这些图像编写代码,而不是像大多数图像生成器那样通过扩散模型生成它们。但是坐在这里看着它几乎像一个画板一样实时为你绘制,有一种非常令人满足的感觉。现在我将快进到最后,这样我们就可以直接看到最终产品。它现在刚刚完成。所以我们这里有一个最终输出。这里有一个最终输出。你知道,它完美地捕捉了教士队的品牌颜色。这个有点奇怪,因为棒球看起来像是击中了他的肩膀,而不是他刚刚击中它。但我的意思是,拜托。这个看起来相当扎实。这个看起来相当扎实。这个看起来他正要击球。我不知道。我想我只是很容易被感动,因为我觉得这真的很有趣。无论如何,让我们进入下一个部分,因为本周我们确实有一些人工智能的戏剧性事件,而且说实话,这是相当严重的戏剧性事件。
所以,上周我制作了一个名为《Anthropic为美国军方辩护》的视频。老实说,我认为这是目前人工智能世界中最重要的故事情节之一,我认为每个人都需要关注,因为它对整个世界都有巨大的影响。自从我制作上一个视频以来,事情已经升级,那个故事情节有了更多发展。如果你不熟悉这个故事情节,让我快速为你梳理一下。直到最近,Anthropic是唯一一家能够访问政府内部机密信息的人工智能公司。美国政府实际上在委内瑞拉抓捕马杜罗时使用了Anthropic的技术。Anthropic的某人与政府的另一个人交谈,询问这是否属实。美国政府对他们询问技术用途感到不满,并基本上说:“我们希望能够将此用于所有合法目的。”Anthropic本质上说:“我们将允许你将我们的技术用于你想要的任何目的,但有两个例外。”这两个例外是:一,你不能用它来监视美国公民;二,你不能用它来制造没有人类参与的自主武器。
美国战争部的Pete Hedgees基本上说:“不,你不能告诉我们什么能用,什么不能用。”Anthropic说:“你可以用它做任何你想做的事,除了那两件事。”再说一次,我制作了一个完整的视频来分解这一点。但快进到本周,Pete Hedgeth给了Anthropic直到周五的时间,要求他们在人工智能安全措施上让步。他们还威胁Anthropic,要将他们指定为供应链风险,这是一个大问题,以前从未对美国公司这样做过。这通常是对外国对手进行的。现在,如果他们被指定为供应链风险,这意味着任何与美国政府有联系的公司也不再被允许使用Anthropic。因此,如果这个指定真的发生,大量大型公司也将不得不与Anthropic切断联系。然而,五角大楼也表示,Anthropic在他们所做的事情上仍然是最好的,并且对他们所做的事情变得非常重要。因此,美国政府不想放弃使用Anthropic,但Anthropic不想在那些两个条款上让步。不要监视美国公民。不要将其用于完全自主武器。“我们仍然与这些人交谈的唯一原因是我们现在需要他们,而且我们现在就需要他们。”一位国防官员告诉Axios。Anthropic表示愿意调整其对五角大楼的使用政策,但不允许其模型用于大规模监视美国人或开发无需人类参与即可发射的武器。Heads告诉Amodai,他不会让任何公司决定五角大楼做出作战决策的条款,也不会反对个别用例。显然,根据Axios的说法,五角大楼已经开始采取措施,对Anthropic进行这种黑名单式的处理。五角大楼周三联系了波音和洛克希德·马丁,询问他们与Anthropic的接触情况。
再次强调,五角大楼对Claude的表现印象深刻,但对Anthropic拒绝解除其安全措施并允许军方将其用于所有合法目的感到愤怒。现在,他们再次给了他们直到周五的时间来做这件事。嗯,这个视频在周五上线。我不需要等到周五才知道会发生什么。周四,也就是我实际录制这些视频的那天,Anthropic的Daario本人就他们与战争部的讨论发表了一份声明。现在,一如既往,我会在下面的描述中链接我的所有来源,但这是它的要点。他们在这篇文章中重申了他们不想让步的两件事。大规模国内监控。我们支持将人工智能用于合法的外国情报和反情报任务,但将这些系统用于大规模国内监控与民主价值观不符。根据现行法律,政府可以从公共来源购买美国公民的行动、网络浏览和社交的详细记录,而无需获得搜查令。强大的人工智能使得将这些分散的、单独无害的数据自动且大规模地组装成任何人的生活的全面图景成为可能。所以这是Daario担心的一点。第二点,完全自主武器。目前,前沿人工智能系统根本不够可靠,无法为完全自主武器提供动力。我们已提出直接与战争部合作进行研究和开发,以提高这些系统的可靠性,但他们尚未接受此提议。这篇文章重申了我们已经讨论过的一些内容。他们希望能够将其用于任何合法用途并移除安全措施。他们威胁要将我们指定为供应链风险,但他们也威胁要援引《国防生产法》强制移除安全措施。这两件事本质上是矛盾的。一个将我们标记为安全风险。另一个将Claude标记为国家安全的关键。
但这是回应。无论如何,这些威胁不会改变我们的立场。我们不能凭良心接受他们的要求。所以,Anthropic已经表示:“不,我们不会让你们将我们的技术用于那两件事。”实际上,几乎所有其他事情都可以,但那两件事不行。他们接着说,他们会尊重政府的决定,如果政府决定引入另一家公司,Anthropic不会大发雷霆,他们实际上会帮助他们进行引入。再次强调,对我来说,这就像是目前人工智能领域正在发生的最重要的事件。这正在开创一个先例。我们是否会允许美国政府将这些人工智能工具用于大规模监控和完全自主武器?这是我们愿意放弃给政府的东西吗?Anthropic说不。但政府显然不必看得太远,因为马斯克的人工智能和五角大楼达成协议,将在机密系统中使用Grok。所以,我之前说的Anthropic是唯一一家被允许在机密系统上运营的公司。嗯,现在Grok也获得了这个。Anthropic拒绝了五角大楼的要求,即让Claude可用于所有合法目的。XAI同意了所有合法使用的标准。
所以事实是,Anthropic可以坚持自己的立场,基本上说我们不允许将其用于那两件事,但仍然有公司愿意介入并说你可以使用我们的技术来做那件事。哦,在完全不相关的新闻中,本周《新科学家》发表了一篇文章,称人工智能在战争游戏模拟中无法停止推荐核打击。OpenAI、Anthropic和谷歌的领先人工智能在95%的模拟战争游戏中选择使用核武器。无论如何,继续。Anthropic本周还因其他事情上了新闻。他们发表了一篇名为《检测和预防蒸馏攻击》的文章。现在,这是我制作了一个完整视频的另一个话题。目前,它的标题是《Anthropic对中国所做的事情感到愤怒》。我在其中详细讲述了整个故事,但你知道我。我将在这里给你一个TLDDR(太长不看版)。基本上,来自中国的三家公司:Deepseek、Moonshot AI和Miniax被发现使用Anthropic的模型对其模型进行模型蒸馏。
现在,如果你不熟悉模型蒸馏,它基本上是当你去一个像Anthropic这样的模型,它完成了所有训练模型的工作,花费了数亿美元进行训练、研发,以及数月数月数月来创建这个模型。然后,你不需要进行另一轮完整的训练,你可以创建该模型的蒸馏版本,你给它一个提示,然后得到响应和思维链响应。这样你就可以实际看到模型是如何思考整个过程的。你获取这些提示和响应对,然后创建一个新的模型,该模型是在这些提示和响应对上训练的。所以你本质上是在更大的模型的输出上训练它,这样它就会以类似的方式响应,并且它会剔除更大的模型中很多冗余和额外的东西。这实际上在单个公司内部是常见的做法,对吧?就像当你拥有Opus 4.6时,他们可能会将模型蒸馏成Sonnet,然后将模型蒸馏成更小的版本,比如Haiku。ChatGPT也这样做,它有GPT 5.2,然后有GPT 5.2 mini,然后是GPT 5.2 Nano。如果它是你自己的模型,蒸馏是一种常见的做法。
这些中国公司,比如Deepseek、Moonshot AI和Miniax,正在使用代理服务器和数万个虚假账户,对Claude最先进的模型进行这种蒸馏过程。事实上,在一个案例中,他们注意到当Claude发布新模型时,Miniax在24小时内就将近一半的流量重定向,以捕获新模型的能力。再次强调,我制作了一个完整的分解视频。如果你想了解所有细节,请查看那个视频。但归根结底,这有点讽刺。Anthropic指责Deepseek很有趣。让我解释一下。没什么好解释的。你试图绑架我合法偷来的东西。是的,我的意思是,这有点像人们对此的看法。这是另一个梗图:Anthropic在公共互联网上训练。中国人工智能公司在Anthropic上训练。Anthropic、OpenAI、谷歌和所有这些公司。他们实际上是通过抓取互联网,未经人们许可,构建了他们的整个模型。他们通过抓取进行模型训练,违反了大量公司的服务条款。所以当他们发表一篇文章说:“嘿,同情我们吧。每个人都在抓取我们的东西。”很多人发现很难给予他们同情。
好了,让我们转向一些轻松的话题,因为本周还有更多新闻我想分享,我认为你会觉得有趣。但我已经讲得有点长了,所以让我们快速过一遍。Anthropic还在Co-work中推出了定时任务。所以Claude现在可以在特定时间完成重复性任务。所以如果你需要像早间简报、每周电子表格更新、周五团队演示文稿,你实际上可以让Claude Co-work在后台为你做这些事情,然后按计划运行。现在,如果你在桌面上使用Claude Code,你实际上现在可以在不离开实际桌面应用程序的情况下预览你正在运行的应用程序。这似乎与我们已经在Claude的网页浏览器版本中能够做到的类似,但现在它在桌面版本中。如果你是Claude Code的粉丝,这是一个非常棒的生活质量更新。他们添加了这个他们称之为远程控制的功能。现在,如果你曾经使用过Claude Code,其中一个烦人的地方是你可以要求它去做事情。但如果它需要为你运行终端命令或运行某些类型的脚本,它会要求你允许运行,即使你将其设置为“继续为我做事情”模式。有些事情它仍然会回来征求你的许可,如果你只是给它一个你想让它运行的任务,而你只想离开电脑让它运行那个任务,这会变得很烦人。你经常会回来发现它只是暂停在任务上,因为它在等你同意做某件事。嗯,这个Claude远程控制解决了这个问题。现在,你只需在手机上收到一条消息,说:“嘿,我们正在尝试做这件事。你愿意让我做这件事吗?”然后你可以点击“是”,它就会继续运行。
如果你是Notion的用户,他们也加入了代理游戏。Notion本周推出了自定义代理。他们在这里给了我们一个方便的TLDDR(太长不看版)。所以,这就是它们:自主人工智能队友,全天候24/7处理Notion、Slack、邮件、日历、Figma、Linear和你的自定义MCP服务器上的重复性工作。代理回答重复性问题,路由任务,编译状态更新,并自动化工作流程。只需描述你需要什么并设置触发器。嗯,你可以随意暂停并阅读所有这些。所以,这是他们的演示视频。它们可以自动路由任务。所以,这会将所有这些事情放入待办事项列表,并且它似乎会为你优先排序并重新安排它们。它可以根据Notion中发生的事情回答问题,为你自主编写更新,所以你可以让它根据Notion中发生的事情自动编写状态更新。看起来非常方便。我还没有测试这个新功能,但我很兴奋能去做。我自己也时不时地使用Notion。
本周我偶然发现了一件我认为非常有趣的事情。这家名为Standard Intelligence的公司声称创建了第一个完全通用的计算机动作模型。他们在一个1100万小时的视频数据集上训练了一个模型。该模型可以探索复杂的网站,完成多动作CAD建模序列,并在现实世界中驾驶汽车,所有这些都以30帧每秒的速度进行。它可以通过观看整个互联网上的视频进行无监督学习。所以,以前的做法是在承包商标注的计算机使用截图上微调视觉语言模型,然后构建强化学习环境来学习每个特定任务。而通过这种方式训练的代理无法在超过几秒钟的上下文上进行操作。但我们可以在这里看到一些例子,他们只是给了它一堆他们在互联网上找到的视频。这个模型从它被喂食的视频中学习。它在这里学会了如何使用CAD。它学会了如何驾驶汽车。它在这里在一个模拟银行应用程序中发现了一个错误。但这看起来像是一个相当突破性的进展,目前还没有多少人谈论,但我有一种感觉,很多人在不久的将来会谈论它。
Pika Labs公司推出了Pika AI selves。他们声称你孕育、抚养并放任它们成为你的活生生的延伸。它们是拥有持久记忆的丰富、多面体生命,甚至可能对花生过敏。这取决于你。让它们给你的群聊发图片。制作关于你的鱼的视频游戏。在你做任何事情但打电话给你妈妈的时候给妈妈打电话。可能性就像星星一样多。对我来说,这感觉有点酷和有趣,但我不太明白它的全部用例。你只是在创造一个自主生活的人工智能生命,它可能拥有自己的社交媒体账户,做事情,然后分享它正在做的事情。我不知道。它感觉就像一个非常高级的拓麻歌子之类的东西。我想我还没有完全理解它,但我会玩弄它并尝试弄清楚。
本周,Sam Altman的这段视频也在流传,他在视频中将训练人工智能模型比作抚养人类。这是我听过的比较反乌托邦的观点之一。让我们听听。>> 这种比较中总是不公平的一点是,人们谈论训练一个人工智能模型需要多少能量,相对于人类进行一次推理查询需要多少成本。但训练一个人也需要大量的能量。需要大约20年的生命,以及在此期间你吃的所有食物,然后你才能变得聪明。不仅如此,它还需要像曾经生活过的千亿人的广泛进化,他们学会了不被捕食者吃掉,学会了如何搞清楚科学等等来产生你,然后你拿走了你所知道的。所以公平的比较是,如果你问ChatGPT一个问题,一旦它的模型被训练好,回答这个问题需要多少能量,与人类相比呢?可能人工智能在以这种方式衡量时,在能源效率方面已经赶上了。所以,是的,他的观点是人工智能比人类更高效,因为人类你必须抚养、喂养并从错误中学习,而人工智能则不需要经历那么多,我想。
无论如何,当我们谈论OpenAI时,我们有一些传闻正在流传。OpenAI计划将智能音箱定价在200到300美元之间。所以,自从Sam收购了Johnny Ive的公司后,我们已经听说OpenAI的这款实体设备有一段时间了,我觉得每个月我们都会对这款设备是什么有新的猜测。有一次,它是一支笔,就像你用来写字的墨水笔,而不是像吊坠那样的笔。我们还听说它就像我们看到Scarsgard广告时那个小圆盘状的东西。现在看来,它可能是一个智能音箱。谁知道呢?这只是目前的传闻。
本周,三星还举办了一场大型活动,展示了Galaxy S26。正如你所预料的,这款新的Galaxy手机将引入许多新的人工智能功能。虚拟试穿、人工智能诈骗检测、圈选搜索、检测多个物品、我相信也内置人工智能的新款Galaxy Buds。Perplexity也将出现在Galaxy手机中。是的,有一大堆公告,他们只是将一大堆人工智能塞进了这些新的Galaxy手机中,这有点像我们现在对所有这些手机发布视频的预期,但我会在下面链接资源,如果你真的对三星设备中加入了多少新人工智能感兴趣,你可以深入了解。
是的,这也很滑稽/反乌托邦,但汉堡王将使用人工智能来检查你的员工是否说了“请”和“谢谢”。所以,他们实际上将人工智能嵌入到员工在汉堡王使用的小耳机中,以实际核实你是否对员工说了“请”和“谢谢”。所以,我想他们以后可以在你的员工评估中使用这些信息,或者什么的。我不知道。那也让我觉得非常反乌托邦。就像,嘿,悉尼,我们分析了数据,你这周只说了17次“请”和18次“谢谢”,但你和23位顾客交谈了。我们下周需要你把这些数字提高,拜托了。
这就是我想分享的新闻。但在你点击离开并认为“哦,这个视频结束了”之前,实际上还有一件事。我想快速提一下。看到这个东西了吗?这是英伟达DGX Spark。这基本上是一个小型个人超级计算机,可以在这个小设备上本地运行AI模型。它使用了英伟达一些最好的硬件。如果你有其中一个,你就可以在本地运行非常非常好的模型,而无需连接到云端。嗯,英伟达的年度GTC大会将于3月16日至19日举行。他们确实有一个大型的现场活动,但你实际上可以100%免费在线参加活动。就像,活动中发生的所有事情都会进行直播和录制,你可以在他们的网站上观看。嗯,英伟达确实给我寄来了那个GTX Spark,但他们也给我寄了第二个。而这第二个我将免费赠送给一位注册英伟达GTC的人。我把如何赢得那个DGX Spark的所有细节都放在了我的LinkedIn上。我会在下面的描述中直接链接到那个特定的LinkedIn帖子,但本质上你只需免费注册GTC。填写一份我将在GTC结束后随机选择获奖者的快速表格。如果我选中你,你就会得到我多余的那个DGX Spark。免费参加。真的没什么可失去的。你只需注册并参加GTC的一个虚拟会议。就这样。完全免费。
好的,这就是我这周为你准备的内容。再次强调,我离一百万订阅者越来越近了。我大概还差92,000人。我觉得我今年能达到这个目标。如果你还没有订阅,请考虑订阅。这真的,真的会帮到我。我知道这没那么重要,但我只是在心理上想达到那个百万里程碑,现在我有点能看到终点线了。所以,如果你还没有订阅,我真的,真的会非常感激。如果你想在你的YouTube订阅源中看到更多这样的视频,请考虑点赞这个视频。那样很可能会发生。所以希望你对本周所有的人工智能新闻都更加了解了。我制作这些视频的目标就是紧跟潮流,然后分享所有发生的事情,让你完全了解情况。我现在是在周四录制这些视频,它们在周五发布。所以如果周五有什么我错过的重大新闻,我一定会把它放到下周的视频中。但再次强调,这里是了解人工智能世界最新动态的地方。只要关注这个频道,你就会一直保持联系。至少这是我的目标,我正在尝试做的事情。所以再次感谢你和我一起。如果你坚持到现在,你真是太棒了,我特别感谢你。你是最棒的。非常感谢你的收看和陪伴,和我一起钻研技术。我真的很感激你。希望我们下个视频再见。再见。