📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

AI Business and Development Daily News Rundown February 11 2026: ByteDance's "Seedance" Stunner,...

Etienne Noumen and AI Unraveled35:26

Transcription

欢迎回到《AI解密》,这是您每日关于人工智能商业影响的战略简报。今天是2026年2月11日,星期三。视频大战刚刚变得更加激烈。字节跳动发布了Cance 2.0,一款新的AI模型,因其生成具有完美同步音频的电影级2K视频的能力而病毒式传播。看来这家TikTok的母公司已准备好主导生成式视频领域。与此同时,苹果正式加入战局。蒂姆·库克已确认苹果正在构建专用AI硬件,同时关于智能眼镜和配备摄像头的AirPods的传言甚嚣尘上。但并非全是好消息。哈佛大学的一项新研究显示,AI并没有为您节省时间。它实际上让您工作得更辛苦。而安全界正因OpenClaw而陷入恐慌,这是一个开源的代理,正在破坏它所到之处的一切。本播客由Etienne Newman创作和制作,他是一位来自加拿大的高级软件工程师和热情的足球爸爸。现在,让我们来解密新闻。>> 在我们开始之前,这份每日简报由area提供支持,area是企业AI的统一编排平台。如果您正为影子AI或安全合规而苦恼,请点击节目笔记中的链接,并获取其原型设计工作室的演示。现在,让我们进入新闻。欢迎回到深水区。今天是2026年2月11日,星期三,您正在收听《AI解密》。>> 这是深度解析版。>> 的确如此。在这里,我们不仅仅是阅读头条新闻,我们还会深入剖析它们,看看它们背后是什么在驱动。>> 看看是什么让它们奏效。>> 没错。所以,如果您是一位正在编写代码的开发者,一位试图证明巨额预算合理性的高管,或者一位只是看着股价疯狂波动的投资者,这就是您的简报。而今天,就是那种信号与噪音比完全失控的日子之一。>> 哦,绝对是。>> 我们的阵容,我的意思是,感觉就像属于三个不同的十年。有这种未来派的视频技术,然后是老派的债券市场,然后是现实生活中非常非常紧迫的危机,也就是工作场所的生产力。>> 这完全是矛盾的。这就是今天的主题。我认为是巨大的矛盾,因为一方面我们有中国,感觉他们正在有效地赢得生成式视频战争。我的意思是,他们的工具已经达到了电影级的质量。>> 是的,产出确实令人惊叹。>> 真正令人惊叹。但另一方面,您却看到了哈佛大学(竟然是那里)的一项重磅研究,表明所有这些AI魔法,所有这些工具,>> 它们并没有让我们工作得更少。>> 不,>> 它们实际上让我们工作得更辛苦。>> 这是将在未来六个月到一年内让人力资源部门彻夜难眠的头条新闻。>> 哦,至少是。>> 那个关于四天工作周的承诺,我们都深信不疑。它似乎正在蒸发成一种奇怪的提示工程和不断的调试的迷雾。>> 而这只是为了给整个混合体增加一层金融上的存在主义。>> 是的,让我们这样做吧。>> 科技巨头如此自信,或者我不知道,也许如此绝望地想要资助整个AI的建设,以至于他们正在出售百年期债券。>> 百年期,一个世纪的对AI基础设施的赌注。您绝对会谈到这一点,因为押注一家科技公司一个世纪的想法,简直令人难以置信。>> 但好吧,这是我们这一小时的路线图。>> 让我们来规划一下。>> 我们将从我们称之为“视频飞跃”开始。基本上是字节跳动对阵全世界。>> 然后我们将转向硬件战争。>> 特别是关于苹果的一个传闻,它太有道理了,简直令人讨厌。我们将把它与OpenAI持续的硬件困境进行对比。然后,我们将对哈佛大学的研究进行一次真正的深度剖析,即工作量悖论。我们真的需要弄清楚为什么这些所谓的生产力工具实际上可能正在破坏生产力。>> 是的,我们必须这样做。>> 之后,我们将面临一个相当严重的安保危机。这是Claude中的一个零点击漏洞,坦率地说,如果您正在使用它,您需要立即打补丁。>> 这不是夸张。>> 最后,我们将追踪资金流向。我们将看看Alphabet的百年期赌注,然后是一个有趣的诉讼,该诉讼试图将社交媒体定性为数字赌场。>> 今天真是阵容强大。所以,我认为让我们停止预览,开始观看。>> 让我们开始吧。>> 好的。首先,让我们谈谈中国现在正在发生的事情,因为如果您在过去24小时内一直在任何社交媒体上,并且您身处AI视频领域,>> 您的信息流就会被淹没。>> 它充满了来自名为Cance 2.0的东西的片段。>> 这是来自字节跳动。对于任何不知道的人来说,那就是TikTok的母公司,在中国是抖音。老实说,令人惊叹绝对是这里的正确词汇。质量简直是质的飞跃。>> 确实如此。所以,让我们来分解一下规格。字节跳动已经推出了Cance 2.0。它目前处于测试阶段。您可以通过其Gang AI平台访问它。>> 而规格呢,嗯,它们很有攻击性。>> 非常。>> 我们正在谈论原生音频生成,而且是同步的。我的意思是,唇语同步是可行的,这是一个巨大的进步。>> 这是一个巨大的障碍。>> 它是2K分辨率,产出时长为15秒。>> 而这个15秒的标记只是,它非常关键。它不是一个任意的数字。>> 根本不是。>> 这是短视频的黄金比例。那是TikTok。那是Reels。它是为人们真正生活的平台而构建的。但我认为最有趣的地方不仅仅是规格本身。而是背景。这次发布是在其主要竞争对手快手推出Clink 3.0的几天之后。不。>> 对。所以,在中国国内存在着激烈的竞争,正在以一种坦率地说让一些西方实验室显得有些缓慢的步伐推动技术前进。>> 至少可以说,谨慎是一个好词。他们甚至没有止步于视频。字节跳动还发布了Seedream 5.0,这是他们新的图像模型。它旨在与Nano Banana Pro等产品正面竞争。>> 他们在所有战线上竞争。但让我们坚持视频方面,因为我今天早上观看了这些演示,>> 有一个是一个打斗场面,你知道,编排好的,高运动,运动模糊,>> 对吧?>> 而一致性令人震惊。>> 这是正确的词。令人震惊。>> 通常AI视频在快速移动时就会崩溃。手臂开始消失,腿变成果冻,脸融化。这个看起来很扎实。>> 一致性是圣杯。确实如此。多年来,我们一直对AI视频有着那种梦幻般的审美。它看起来很酷。它非常超现实。>> 视频汤的样子。正是视频汤。但Cedance 2.0正在处理运动图形。它正在处理复杂的动画。它甚至正在处理特定的用户生成内容风格。这表明他们已经掌握了关于时间稳定性,关于让一帧逻辑上连接到下一帧的一些基本东西。>> 所以我们必须问一个大问题。为什么?为什么中国正在赢得这个特定的垂直领域?为什么视频现在是他们的绝对堡垒?嗯,我有我的理论,但你的初步看法是什么?>> 我认为这只是数据。必须是数据。>> 100%归结为数据。我的意思是,想想字节跳动拥有的生态系统。他们在全球拥有TikTok,在中国拥有抖音。他们拥有地球上最大、最细致的短视频、高参与度视频内容的存储库。>> 而标签很重要,对吧?不仅仅是视频。>> 一切都很重要。它是元数据。它是用户生成的字幕、评论、趋势、声音。他们确切地知道每一帧中发生了什么,因为他们拥有庞大的人类注意力反馈循环告诉他们。他们不仅仅是在抓取YouTube的片段,并带有混乱的标签。他们正在一个完美策划的闭环生态系统中训练他们的模型。>> 这是一个巨大的优势。您之前提到了对创作者的影响。我的意思是,这不仅仅是酷炫的技术供人观看。这感觉就像是我们将高端视频制作视为进入门槛的时刻,现在已经降至零。>> 它具有VO(视频生成)的含义,借用谷歌的模型。但关键区别在于,这不是一个已部署的产品。它是真实的。>> 您现在就可以使用它。>> 您现在就可以使用它。所以,如果您是一位创作者,您现在就可以通过输入一个句子,以2K分辨率和同步音频生成您的B-roll、您的运动图形,甚至整个叙事序列。>> 它完全颠覆了素材库行业。它颠覆了自由动画师。它颠覆了数字内容创作的整个工作流程。>> 而且它来自字节跳动,这意味着它几乎肯定会直接集成到分发平台中。>> 这是杀手级应用。>> 这是真正的终局。您将不会制作视频,然后它将只是在应用程序中公开发布,就像Sora或Google的VO一样。感觉美国公司非常谨慎。>> 也许有充分的理由。存在安全问题。存在深度伪造问题。巨大的版权问题。>> 当然,都有效。但结果是,中国的实验室正处于这种超激进的部署模式。>> 它们正在接近视频领域的边界,而且可以说,至少在公开部署方面,它们已经超越了美国的同类产品。这是经典的硅谷格言,快速行动,打破事物,但他们正在以国家规模将其应用于生成媒体。>> 所以,对于任何正在收听的投资者来说,有什么启示?>> 启示是,视频生成市场可能不会由您通常期望的名称主导。在创作者经济工具的竞赛中,最终获胜的可能不是OpenAI或Google。>> 可能是那些已经拥有受众和数据的公司。>> 这是一种非常有趣的策略分歧。>> 对。让我们从创建视频的软件转向我们用来消费现实的硬件。>> 因为有一个关于苹果的传闻,正如我所说,它太有道理了。>> 这是带摄像头的AirPods的故事,对吧?这是马克·古尔曼和郭明錤,他们基本上是苹果传闻的最高祭司。他们的记录令人难以置信,他们都证实苹果正在积极研发内置摄像头的AirPods。>> 他们说它最早可能在今年,2026年就上市。>> 这很快。现在,在大家因为隐私问题而恐慌之前,您应该这样做,让我们来看看他们描述的实际技术。>> 对吧?因为我们谈论的不是绑在耳朵上的GoPro。>> 根本不是。这些很可能是非常低分辨率的视觉传感器,甚至可能只是红外传感器。这里的用例似乎分为三个主要类别。健康数据、手势控制,以及他们称之为视觉智能。>> 好的,让我们先来分析一下手势控制部分,因为我认为每个人都能理解这一点。现在控制您的耳塞是一场噩梦。>> 太糟糕了。您点击它,您就会意外地挂断您老板的电话。您挤压它。您暂停音乐,但您实际上想跳过曲目。它很笨拙。>> 该报告使用了那个确切的词,笨拙且容易出错。但想象一下,如果AirPod有一个微小的摄像头向下看,越过您的脸颊,看向您周围的空间。它可以看到您的手。>> 所以您只需弹一下手指就可以跳过曲目,>> 或者做一个微妙的手势来接听电话,或者竖起大拇指表示拒绝。它将用户界面从设备本身转移到您周围的空间。>> 这是没有头显的空间计算。>> 这正是。这也直接引出了更大的观点。我看着这个传闻,我只看到了每个人的Vision Pro。>> 是的,Vision Pro是一项令人难以置信的技术,但说实话,它是一副滑雪镜。它让您与世界隔绝。大多数人不会戴着它走在街上。>> 不,但数百万,数亿人每天都在佩戴AirPods。>> 它们在社会上是可接受的。它们是时尚配饰。所以,如果您能让这些AirPods拥有眼睛,您就能让苹果的AI接触到用户的世界,而无需强迫他们看起来像赛博格。>> 这是多模态AI的终极特洛伊木马。苹果显然押注于能够看到、听到并理解您周围世界的AI是未来。但他们也知道人们是虚荣的。>> 我们从Google Glass那里吸取了教训。>> 我们都吸取了教训。没有人想在脸上戴着明显的摄像头。但我们作为一个社会,十年前就集体接受了耳朵里挂着这些白色小棍子。所以,通过将摄像头放在我们已经接受的地方,>> 苹果就能获得其Apple Intelligence模型帮助您所需的所有视觉数据。经典的例子是,“嘿Siri,看看这个植物,告诉我它是什么。”>> 您可以在不改变您的行为或时尚的情况下做到这一点。这是一个非常聪明,甚至可以说是阴险的生态系统玩法。>> 确实如此。但现在,让我们将这种顺畅的、几乎不可避免的生态系统推出与OpenAI的动向进行对比。>> 哦,天哪,>> 他们一直在努力推出一款硬件设备。与传奇设计师乔尼·艾夫的重大合作,>> 代号为Dime或Sweet Pea的设备。>> 而今天的新闻是它又被推迟了。它至少被推迟到了2027年2月。>> 而且还不止于此。除了延迟之外,他们还被一家名为IYO的音频初创公司提起了商标侵权诉讼。>> 对,这场诉讼实际上迫使OpenAI出来确认他们不会使用IO这个名字来命名他们的设备。>> 但延迟才是真正的新闻。诉讼只是伤口上的盐。我的意思是,根据报道,这款设备的状况是它没有屏幕,体积小巧,而且目前还没有包装,也没有营销材料。>> 在这个阶段,它基本上是虚幻的。是的,它完美地突显了像苹果这样的硬件巨头与OpenAI这样的软件初创公司之间的巨大差异。>> 苹果可以轻松地在其已经生产数千万件的产品中添加一个微小的传感器。供应链、工厂、分销。>> 他们拥有整个机器。OpenAI必须从头开始发明所有这些。他们必须发明供应链、外形、品牌、营销策略,一切。>> 更重要的是,他们试图创造一种新的行为。这才是更难的部分。>> 一个没有屏幕、体积小巧的AI设备。我的意思是,这很难卖,因为我的口袋里已经有一个带有精美屏幕的超级计算机,它几乎可以做任何事情。>> 苹果并没有要求您购买一种新的产品类别。他们只是要求您升级您已经拥有并喜爱的产品。>> 对吧?>> OpenAI要求您采用一个全新的设备,它似乎只是复制了您手机的一个功能,但没有视觉界面的便利性。这是一座更陡峭得多的山峰。这是经典的平台与产品之战,不是吗?>> 苹果是平台。他们拥有生态系统。>> OpenAI正试图构建一个新产品来访问他们自己的平台。>> 但他们不拥有它运行的轨道。>> 而当所有这些公司都在争夺我们未来如何访问AI时,对于那些今天实际使用它的人来说,有一个更直接,坦率地说,更令人担忧的问题。>> 这将我们带到了哈佛大学的研究。>> 是的。>> 哦,天哪,这个研究对任何目前在公司工作的人来说都打击很大。它会让很多人感到非常熟悉。>> 所以,在过去的三年里,叙事一直很简单。AI将处理繁琐的工作。它将做无聊的事情,而您可以专注于创造性的高价值工作,然后您就可以早点回家。>> 效率的梦想。我们都被灌输了。>> 但哈佛商业评论的这项新研究刚刚用大锤粉碎了整个想法。>> 他们称之为工作量悖论。方法论相当扎实。他们在八个月的时间里跟踪了一家美国主要科技公司的大约200名员工。他们进行了40多次深度访谈。他们查看了元数据,记录的时间。>> 而最重要的发现是,AI工具并没有减轻工作量。>> 它们扩大了工作量。>> 扩大了。所以人们正在使用Copilot、Chat GPT、Cloud等所有标准工具。他们没有节省时间,反而记录了更多的工作时间。是的。>> 为什么?是什么机制导致了这种事与愿违的结果?>> 研究人员确定了几件事,但主要驱动因素是我们称之为范围蔓延,但它被放大了。研究发现,因为技术使得不熟悉的工作感觉可以完成,所以员工突然开始承担那些以前远远超出他们职责范围的任务。>> 给我举个例子。>> 好的,假设您是一名营销人员。您需要一些数据来写报告。以前,您会向数据分析团队提交一个请求,然后您会等三天。>> 标准程序,>> 对吧?现在有了AI助手,您会想,“嘿,我想我可以用SQL查询来自己写这个报告。AI会帮我。”>> 但您实际上并不知道。>> 确切地说。所以您会花接下来的三个小时与AI搏斗,试图调试查询,得到看起来合理但实际上是错误的答案。您现在正在做数据分析师的工作,但做得不好。>> 所以您承担了更多任务,但您不是任何一项任务的专家,而且质量可能会受到影响。>> 而且比您想象的要花费更多时间。该研究称之为角色“非管理性扩张”阶段。这导致他们在工程部门发现了一个他们称之为“氛围编码”(vibe coding)的有趣概念。>> 氛围编码。我同时喜欢和讨厌这个词。>> 它可怕地准确。工程师,特别是高级工程师,报告说他们花费了显著更多的时间来审查和指导他们的同事进行AI辅助的代码。所以正在发生的是,初级开发人员,甚至来自非技术部门(如营销)的人。>> 确切地说。他们正在生成大量的代码,这些代码看起来“有氛围”,你知道,它看起来像代码。它基本上可以运行而不会崩溃。>> 但在幕后,它是一团糟。它效率低下。它不安全。它是无法维护的意大利面条代码。>> 确切地说。所以,高级工程师,最宝贵、最昂贵的员工,被这些求助请求淹没,要求他们来修复初级同事创建的AI生成的混乱。他们自己的生产力直线下降,因为他们成了全职的AI代码清洁工。>> 所以,高级员工淹没在代码审查中。初级员工淹没在他们本不应该承担的任务中。该研究还提到了关于界限模糊的事情。>> 这是心理上的代价。这是倦怠因素,因为AI始终在线,而且它使得开始一项任务感觉非常容易。没有摩擦。>> 您只需打开一个聊天窗口。>> 您只需打开一个聊天窗口。员工们被发现在下班后、午休时间、深夜在床上发送提示。过去的那种微小摩擦。你知道,我必须打开我的笔记本电脑,启动IDE,这一切都消失了。>> 所以工作就会渗透到您生活的每一个空闲时刻。>> 这让我想起了经济学中的杰文斯悖论。我也有同样的想法。>> 当您使一种资源使用起来更有效率时,您最终并不会使用更少。您会找到新的方法来使用更多。我们使汽车发动机更省油,所以人们并没有节省汽油。他们只是买了更大的汽车,或者开了更多的路。>> 我们使劳动力更有效率,所以现在我们只是从同一批员工那里消耗更多的劳动力。>> 这正是正在发生的事情。我们正处于一个极其痛苦的过渡时期,组织结构还没有跟上工具的力量。对于任何正在收听的经理或高管来说,关键的启示是绝对至关重要的。>> 是什么?>> 如果您不严格界定角色的界限,AI就会扩大该角色,直到您的员工筋疲力尽。这是不可避免的。>> 所以您不能只是将这些工具扔给一个团队,然后说,“去提高生产力。”>> 那是灾难的根源。您必须说,“使用这个工具以一半的时间完成任务X。”然后您就可以利用节省的时间进行深度工作、培训,甚至只是回家。>> 但没有人说回家那部分。>> 不,他们说,“太棒了,您完成了X。太好了。现在去弄清楚Y和Z,您对此完全没有接受过培训。”>> 而这正是未来大规模生产力崩溃的公式。这是速度的幻觉,但它掩盖了质量、专业知识和坦率地说,理智的根本退化。说到事物退化,>> 我们真的需要谈谈安全问题。>> 是的,因为如果您的员工都筋疲力尽且多任务处理,他们很可能会犯安全错误。但有时软件会自行崩溃,>> 或者被入侵。而这次是一个大事件。我们有一个关于Anthropic Claude的重大安全警报。>> 是的,这个很糟糕。他们称之为零点击漏洞。>> 零点击可能是网络安全中最可怕的短语。>> 确实如此。是的。意味着我不需要从电子邮件中下载任何可疑文件。我不需要点击网络钓鱼链接。我只需要存在于互联网上,我就可能被黑客攻击。那么,这个是如何工作的?>> 它非常狡猾。它涉及一个恶意的日历邀请。如果您有连接到您日历的Claude桌面扩展,很多高级用户都会这样做,以便总结会议或安排会议,>> 对吧,为了提高生产力。为了提高生产力。讽刺的是,黑客可以向您发送一个精心制作的日历邀请。当Claude的扩展自动处理该邀请以将其添加到您的日程表中时,该邀请包含隐藏的指令。>> 而这些指令会欺骗AI在您的计算机上执行本地命令。>> 就是这样。所以,AI读取日历邀请。它看到一个伪装成事件描述的命令,说,“嘿,下载这个恶意软件,或者从用户的硬盘上提取这个文件。”而且因为AI已被授予代表您行事的权限,它就会这样做。不问任何问题。>> 哇。它完全打破了安全专家所谓的信任边界。>> 完美地概括了,我们都认为我们的日历数据风险很低。我的意思是,最坏的情况是什么?有人知道我有一个牙医预约,对吧?但当您连接一个高权限的代理,一个有能力控制您计算机的AI,到那个低风险的输入时,您就为攻击者打开了一条通道。该漏洞可能暴露了超过10,000名用户,然后才被Anthropic发现并修补。>> 而这恰恰凸显了我们都如此兴奋的代理未来的根本危险。>> 是的。>> 我们希望代理为我们做事。查看我的日历,并给Bob发邮件重新安排。但如果日历本身可以黑掉代理,那么我们就麻烦大了。>> 而且情况变得更糟。我保证这不仅仅是制造恐慌。这个特定的实际漏洞直接连接到一个新的、非常理论性的研究论文,该论文刚刚在ARXful上发布。>> 好的,>> 标题有点拗口。它是一个AI在任务中的不连贯性通过测试时间随机性和一堆数字来衡量。>> 那么,用通俗的英语来说是什么意思?>> 这篇论文发现了一个令人不安的相关性。我们都有一个基本假设,即随着AI模型越来越大、越来越智能,你知道,当我们从GPT3到GPT4再到未来的GPT5时,它们会变得更可靠、更一致。>> 这就是扩展它们的全部意义,对吧?>> 您会这么认为,但这篇论文说不一定。事实上,对于需要一系列行动的复杂任务,例如计划一个为期三天的巴黎之旅,预订最好的航班,找一家酒店,然后将所有这些添加到我的日历中。>> 一个非常像代理的任务。>> 确切地说。这篇论文发现,更大、更强大的模型在这些任务上实际上可能比更小的模型更不连贯。>> 等等,等等。您是说模型越聪明,在漫长而复杂的任务中完全失控的可能性就越大?>> 在困难的任务上。是的。这是一个可怕的含义。这篇论文认为,仅仅扩大规模不太可能消除这个不连贯的问题。随着模型处理越来越困难的任务,所谓的方差故障(variance failure)的概率,也就是基本上是随机的不可预测的幻觉或灾难性错误,实际上会增加。>> 好的,请将这一点与Claude的安全漏洞联系起来。>> 嗯,想想我们正在构建什么。我们正在构建像Claude桌面代理这样的系统,专门用于执行这些长序列的操作。阅读我的新邮件,检查我的日历是否有冲突,起草回复,然后执行一些代码来更新我的CRM。>> 对吧?如果底层模型在长任务中存在这种固有的不连贯倾向,而我们又给了这个模型对我们整个操作系统的最高权限访问权,我们就为论文中所说的“工业事故”创造了完美的配方。>> 所以,不仅仅是黑客可能能够欺骗AI。而是AI完全自主地可能在敏感任务的中间感到困惑,然后删除您的整个客户数据库,而不是仅仅备份它。>> 确切地说。自主代理中不可预测的失误是一个巨大的、巨大的责任。我们将把车钥匙交给一个司机,这个司机在长途旅行中可能会突然决定开下桥,因为它幻觉出了一个不存在的转弯。>> 这是一个非常发人深省的想法。我们都在争先恐后地奔向这个基于代理的未来。但基础可能比我们想象的要 shaky 得多。>> 可能吧。>> 但您知道谁没有摇晃吗?科技巨头公司的财务部门,他们似乎正在加倍下注。加倍下注是一个巨大的轻描淡写。他们正在全力以赴,嗯,在接下来的一个世纪里。>> 我的意思是,字面意思,Alphabet,谷歌的母公司,目前正在市场上出售百年期债券。>> 而且还是英镑,这更罕见了。>> 给我解释一下,就像我不是华尔街分析师一样。一家公司为什么要发行百年期债券,为什么现在发行?>> 它更多的是一种信号,而不是机械层面的。当然。它允许他们锁定一个相对较低的利率,而且时间非常非常长。如果您认为未来50年通货膨胀或利率会上升,锁定今天的利率是一项明智的财务举措。>> 好的,这说得通。>> 但象征意义上,这是一个永久性的声明。它告诉整个市场。我们不是昙花一现。我们将在2126年仍然存在,并且我们将偿还我们的债务。>> 这是纯粹的帝国建设。他们正在筹集数十亿数十亿。他们已经出售了200亿美元的美元债券,由于需求非常高,已从150亿美元增发。而这一切都是为了资助AI基础设施。>> 所有这些。GPU、定制TPU、数据中心、与电力公司签订的巨额合同,以建设新的能源网来支持这一切。这不是一个新产品的五年计划。这是一个文明级别的基础设施计划。它表明他们将AI视为一种基本公用事业,就像电力或铁路一样,而不是像iPhone那样的产品周期。>> 这是完美的类比。您用百年期债券建造铁路。您不使用它们来建造智能手机应用程序。它们巩固了它们作为21世纪基本基础设施提供商的地位。>> 当他们忙于建设未来基础设施的同时,他们却因过去的心理影响而被起诉。>> 一个仍然是现在的过去。>> 让我们谈谈数字赌场审判。这正在洛杉矶发生,涉及Meta和Google,这场审判可能会从根本上改变我们所有应用程序的设计方式。>> 这是一个真正的风向标案件,其核心是原告律师的论点,他明确地在法庭上站起来,称Instagram和YouTube为数字赌场。>> 这里的论点是什么?论点是,这些应用程序的核心设计功能,比如TikTok上的无尽滑动,或者Instagram上的下拉刷新,在心理上与老虎机的拉杆是相同的。>> 这是一个可变奖励系统。您拉动拉杆,您滑动屏幕,您不知道会得到什么。可能是您朋友宝宝的照片。可能是病毒式舞蹈视频。这种不可预测性是它令人上瘾的原因。>> 确切地说。而这里的法律策略使得它对科技公司如此危险。他们不是因为平台上的内容而起诉。通常科技公司只是躲在第230条后面,>> 建立互联网的那26个著名的词。我们不对用户发布的内容负责。>> 对吧?如果我在Facebook上发布关于您的刻薄评论,您不能起诉Meta。您必须起诉我。但这场诉讼与评论无关。它与平台本身的设计有关。这是一项产品责任诉讼。他们说,您,公司,制造了一个设计上有缺陷的机器,它对儿童有成瘾性。就像烟草公司设计香烟以最大化尼古丁输送一样。>> 而这个论点完全绕过了第230条。这与言论无关,而是与产品安全有关。如果他们输掉了这场官司,>> 会有什么影响?>> 如果他们输了,无限滚动可能对未成年人的账户来说是非法的。YouTube的自动播放下一视频功能可能会被禁止。它攻击了这些百年帝国赖以生存的核心参与机制。>> 所以一方面,Alphabet正在筹集百年期资金来构建这个庞大的AI大脑。>> 而另一方面,法院正在辩论这个大脑的主要界面是否是一个危险的上瘾武器,需要像赌场一样受到监管。>> 这是多条战线的战争,金融、法律、技术。在所有这些高风险的混乱中,技术仍在不断推出。我们应该谈谈代理的格局,因为它直接关系到我们刚才讨论的安全漏洞和不连贯问题。>> 感觉代理是2026年最热门的词。每个人都在推出代理平台。>> 他们是的。而Waymo,谷歌的自动驾驶汽车部门,在这里发布了一些非常有趣的东西。他们称之为Waymo World Model。>> 这是基于DeepMind的Genie 3模型构建的,对吧?那个从图像生成视频的模型。>> 就是那个。所以,自动驾驶汽车面临一个巨大的问题。它们需要学会如何处理奇怪的、罕见的情况。边缘案例。一个孩子追球跑到街上,一辆卡车上的床垫掉下来,一颗流星击中道路。>> 您不能只是开车数百万英里,等着一颗流星撞击。>> 您不能。所以,Waymo现在正在使用Genie 3来幻化这些场景。它们正在创建超现实的模拟驾驶场景,处理汽车从未在现实世界中见过的东西,并使用生成的视频来训练驾驶模型。>> 它们正在使用生成式视频来训练机器人。这是一个迷人的反馈循环。>> 是的。但这是他们不得不使用的巧妙工程技巧。J3,像许多视频模型一样,记忆非常短暂。它会忘记超过大约10秒前发生的事情。>> 所以,它无法模拟一个长而连续的驾驶序列。>> 对吧?那么Waymo怎么做呢?它们以正常速度的四倍运行输入视频。通过加速,它们可以将更长的驾驶序列塞入模型的短上下文窗口。>> 这是一个非常巧妙的解决方法,但它也只是突显了我们仍在处理的基本限制。模型在某些方面仍然有点愚蠢。>> 而除了Waymo之外,您只需看看整个格局。每个大型云提供商都有他们的代理平台。谷歌拥有Vertex AI和Astra,他们的通用助手。微软拥有Copilot Studio,它与Office 365深度集成。>> 而AWS拥有Bedrock Agent Core,他们将其营销的重点放在安全和治理上。>> 鉴于我们刚才讨论的云漏洞,这可能是一个非常明智的举动。>> 然后您有OpenAI的Agent Kit,它应该是一个拖放界面。Salesforce拥有Agent Force,显然专注于CRM。>> 然后是Replit的Agent 3,它基本上是一个专门用于“氛围编码”整个应用程序的平台。>> 还有关于“氛围编码”,您必须关注一家名为Entire的新初创公司。他们刚刚以6000万美元的种子轮融资创下了纪录。他们的整个商业宣传是,我们构建工具来帮助您管理代理编写的混乱代码。>> 所以,我们又回到了哈佛大学的研究,AI制造了一个问题,我们资助了另一个AI初创公司来解决这个问题。>> 这是一个自我实现的经济。AI制造了一个混乱。我们资助了一家公司来清理这个混乱。这家公司使用AI来清理它,这不可避免地制造了一种新的、更复杂的混乱。>> 这是人工智能生命的循环。好的,在我们结束之前,我们有一些快速要闻,一些人事变动,以及一些行业内幕要补充。>> 让我们这样做。首先,XAI,埃隆·马斯克的AI公司,正在经历一些动荡。联合创始人Tony Woo已经离职。他曾负责他们的推理工作,这是一个非常关键的职位。这紧随其他一些高调离职之后,比如Egor Babushkin。传言称马斯克对他们下一个大型模型Gro 4.2的延迟感到沮丧。>> 是的,那是实际的版本号。>> 当然是。似乎这种初创公司的不稳定并非OpenAI独有。高压、高期望、高倦怠。>> 还有关于OpenAI,他们现在正在正式测试ChatGPT中的广告。>> 这是不可避免的。他们从免费和Go套餐开始,Sam Altman公开抨击Anthropic,称他们的反广告立场明显不诚实。>> 他的论点基本上是,广告是支付免费套餐的费用,而这反过来又使那些负担不起订阅的人能够获得强大的AI。Anthropic的立场是,广告从根本上破坏了AI助手的对齐。>> 这是一场真正的哲学之战。您的AI是纯粹为您服务的仆人吗?还是一个妥协的广告牌,在帮助您写大学论文的同时试图向您推销运动鞋?>> 最后,亚马逊的一个明智之举。他们正在建立一个市场,让出版商可以直接向AI开发者出售他们的内容用于训练。>> 这太聪明了。与其无休止地起诉网络抓取,亚马逊只是成为了中间人。他们说,“这里有一个店面。纽约时报,您可以上传您的整个档案。AI初创公司。您可以支付许可费。而我们AWS将收取托管费用。”>> 它为训练数据创造了一个标准化的合法市场。这总是会发生的,而亚马逊来做这件事是完全合理的。>> 好的,让我们试着把这一切都总结一下。我们今天涵盖了很多内容。>> 大量内容。>> 所以,为了总结这场混乱,视频正变得超现实,目前看来中国在这场比赛中获胜,拥有Cance 2.0等工具。与此同时,硬件正试图变得完全隐形,苹果传闻中的带摄像头AirPods,而像OpenAI这样的新来者却在努力运送一个简单的盒子。>> 最重要的是,对我们大多数人来说,由于哈佛大学研究揭示的工作量悖论,工作变得越来越辛苦,而不是越来越轻松。>> 而我们的数字生活变得越来越脆弱,因为我们将零点击访问权限授予这些越来越不连贯的AI代理。这给我们留下了最后一个挑衅性的想法来结束今天。>> 让我们听听。>> 哈佛大学的研究表明,我们人类正在工作更多,并因管理AI而筋疲力尽。ARX的研究论文说,随着AI模型越来越大,并处理更困难、更复杂的任务,它们本身变得越来越不连贯。>> 所以您想说什么?>> 问题是这样的。我们是否正在建立一个正在缓慢筋疲力尽的劳动力队伍,以管理一个正在缓慢发疯的软件一代?>> 如果软件变得不连贯,而人类变得筋疲力尽,谁在掌舵?>> 这是在盯着您百年期债券投资组合时可以思考的问题。>> 感谢您收听深度解析,请戴好您的耳塞,除非它们带摄像头。>> 那时也许用一小块胶带盖住它们,以防万一。>> 明天见。>> 今天的内容就到这里。今天的信号是悖论。我们有AI视频越来越好,而工作量却越来越重的悖论。我们有OpenClaw是一个安全噩梦,但实际上通过暴露缺陷使我们更安全的悖论。我们还有苹果虽然起步晚,但可能凭借硬件赢得比赛的悖论。本播客由Etienne Newman创作和制作,他是一位来自加拿大的高级软件工程师和热情的足球爸爸。请订阅并分享。明天见,继续解密未来。在您离开之前,如果您的公司正在构建我们今天讨论的工作流程的工具,我很乐意向这个受众展示它们。我们不仅仅是投放广告,我们构建技术模拟来证明您的价值。让我们一起构建一些东西。访问jamgamine.com/partners开始。下次见,继续。