Transcription
各位美人儿,大家好啊?欢迎回到《糟糕的决定》播客,在这里,我们为您带来科技、人工智能和商业领域最热门、最酷的分析。我们每周一、周三和周五都会回来。有人说他们上次不喜欢你的开场白。所以,我们又带回了“各位美人儿,大家好啊”。哦,是的。那是两集以前的事了。没错。你好吗?我很好。你呢?我棒极了。你怎么样?我希望他们今天过得愉快。今天是周三,我们又带来了大量精彩的新闻和更新。
没错。我们有针对动态图形设计师的虚幻引擎更新。我们收到了关于Anthropic以及他们与中国模型之间的一出戏的更新。我们有一篇关于Netflix和Comfy UI的新闻。今天晚些时候我们还会有一位特别嘉宾加入。太棒了。法拉,我们从第一个开始吧?开始吧。
所以,对于所有使用虚幻引擎的动画师、设计师、动态图形艺术家和3D艺术家来说,你们现在应该感到非常兴奋,因为Rive即将登陆虚幻引擎。对于第一次听到“Rive”这个词的听众来说,这是一款强大的设计和动画工具,它允许创作者构建交互式2D图形,这些图形可以在应用程序、网站和游戏中无缝运行。过去几个月、几年里,很多人都在谈论Rive。我不确定他们何时首次推出,但它已成为那些想要创建用户界面的人的首选软件。在这里,你可以看到我们有一个非常棒的公告,Rive将加入虚幻引擎,不是被收购,而是以合作伙伴身份加入虚幻引擎的Fab市场。是的。这对于设计不同关卡、不同用户界面的游戏开发者来说会很棒。此外,我认为你也可以在广播中大量使用它,无论是新闻广播还是其他体育节目。许多用户界面元素现在都可以使用Rive进行动画制作。显然,制作复杂动画要容易得多。
据我所知,Rive的惊人之处在于,一旦你在应用程序中设计并精美地制作了用户界面元素的动画,你就可以将其作为单一事实来源,应用到应用程序、网站和游戏中。所以你只需制作一次,设计就能在不同平台之间保持一致并转换。之所以将其引入虚幻引擎令人兴奋,正如法拉所说,是为了所有那些视频游戏。想想开场菜单。那是你在视频游戏中看到的第一件事。想想《侠盗猎车手》或赛车游戏中的地图。想想《使命召唤》等游戏中的HUD,即平视显示器叠加层。所有这些都可以精美地制作动画,不仅可以在虚幻引擎中使用一次,还可以在网站上或游戏可能拥有的应用程序中使用。
此外,别忘了汽车。像Rivian这样的品牌,现在正使用虚幻引擎在仪表盘上创建交互式体验,现在可以使用Rive来创建更加无缝、精美的设计。我还在想《堡垒之夜》。如果他们将此引入UFN,许多创作者主导的地图现在可以使用Rive来制作他们的地图、用户界面和HUD。所以它也可以在《堡垒之夜》生态系统中大量使用。从技术上讲,你在虚幻引擎中制作的任何东西现在都可以使用Rive进行增强。所以我甚至在考虑精灵图。哦,用于不同的尼亚加拉粒子。想象一下使用Rive制作它们的动画,然后将它们放入你的精灵图中,让它们作为粒子,因为也有节点系统。你可以看到,这将为这里的创作者带来巨大的创作空间。我是它的忠实粉丝。我个人从未接触过。所以,这对于我们《糟糕的决定》团队的所有人来说,将是一件令人兴奋的测试。如果你们接触过Rive并对此感到兴奋,请在评论中告诉我们你们目前是如何使用Rive的。我很想知道你们这些创作者有哪些用例。
好的,到目前为止,我想带大家了解几天前发生的一出戏。Anthropic在推特上发布了一些内容。我来给大家读一下。Anthropic,Claude的创造者。Claude。是的。我们发现Deepseek、Moonshot AI和Minimax对我们的模型进行了工业规模的蒸馏攻击。这些实验室创建了超过24,000个欺诈账户,并与Claude进行了超过1600万次交互,提取其能力来训练和改进他们自己的模型。所以这些特别是中国的模型所做的,就是开始“攻击”Claude来训练他们自己的小型模型。基本上,当你说“攻击”时,我认为这比那要微妙得多。仅仅通过交互,这不是黑客行为。仅仅通过与模型进行交互,他们就可以从Claude的响应中学习,然后用这些来训练他们自己的模型。
所以基本上,目标是将知识从大模型转移到小模型,使学生模型更快,但同时更轻。没错。现在,如果你往下看,呃,普拉特,如果你能拉下来,我们来谈谈这条消息的其余部分。Anthropic表示蒸馏可以是合法的。人工智能实验室用它为客户创建更小、更便宜的模型。但非法蒸馏美国模型的外国实验室可以移除安全措施,将其模型能力输入到他们自己的军事、情报和监视系统中。这些攻击的强度和复杂性正在增加。解决这些问题将需要行业参与者、政策制定者和更广泛的人工智能社区之间迅速协调行动。
但你知道有趣的是,人工智能社区并没有表示同情,评论真的非常有趣。我认为最好的评论来自埃隆,他在我这里有的评论中说。我不确定你是否有相同的。哦,是的,我们有一个不同的,但我会读两个。Anthropic被指控大规模窃取训练数据,并因其自身的盗窃行为支付了数十亿美元的和解金。这只是一个事实。埃隆·马斯克还有另一篇帖子写道:“太棒了,他们怎么敢偷Anthropic从人类程序员那里偷来的东西。”所以有人正在从已经从别人那里偷东西的人那里偷东西。
这就是它的演示。公共互联网和所有人的数据,Anthropic用吸管吸取这些数据来训练他们的模型,然后中国的人工智能公司又把另一根吸管插进Anthropic,然后把数据拿走。还有一个更有趣的。呃,往下看。往下看。是这个吗?哦,是的。这个。这个。真实数据。Claude和Anthropic捡起来,然后其他人拿着渔网伸进他们的桶里,把数据拿走。这差不多就是正在发生的事情。你们对此有什么看法?这很有趣,值得讨论,因为如果Anthropic用所有人的数据训练了他们的模型,那么从技术上讲,中国模型是否有同样的权利去训练所有人的数据?但为什么他们,我认为,或者他们没有呢?
我的意思是,我认为这里没有人能决定谁对谁错,但事实是,现在,因为我认为他们花了很多精力抓取所有数据,中国模型不想再经历所有这些努力。想要走捷径。是的。并从Anthropic那里获取。我在想,现在有什么能阻止,例如,一个俄语模型或一个印度语模型做同样的事情呢?
我认为没有什么能阻止,因为我认为他们以同样的方式训练。我相信我可能读过非常相似的内容,Deepseek也使用完全相同的技术训练了他们的一个模型。所以,这并不是什么新鲜事,但Anthropic首席执行官对此大声疾呼,并表示这对美国来说是一个巨大的风险,这让很多人在评论中产生了分歧,他们说,你知道吗,你首先就对人们的数据做了同样的事情。你不能跑去哭诉说别人也对我的数据做同样的事情。呃,因为归根结底,没有人同意。
这很有趣。是的。每个人都说:“嘿,你拿了数据。”但我在想,这是否让其他小型人工智能公司现在更容易训练他们的模型,并且在三四年后,我们将拥有不同的LLM,它们在这些大型LLM上训练,具有相同的功能,而无需他们遍历互联网上的每一个数据?你知道我的意思吗?我们现在有很多来自不同国家的小型强大人工智能,它们可能不如Claude好,但也许能达到其80%或70%的容量。
我明白你的意思。我在这里的担忧是这个。当谈到数据时,必须明白人工智能模型,这些大型语言模型本身需要数据才能变得更智能。所以,我认为不言而喻,它们必须在人类创造的东西上进行训练。是的。没错。无论是图像、视频、文本、音频还是代码。所以所有模型都经过人类数据训练。一些公司声称他们有道德来源,就像食品公司声称他们的咖啡豆成分有道德采购一样。
但对于普通人来说,几乎不可能验证这些来源。然而,我们相信标签,食用这些食物并将其摄入体内。到了2025年、2026年,很多人都意识到,许多向我们出售食物和零食的公司都在欺骗我们。我们在超市看到的大多数东西对我们的身体都不好。然而,正面标签却说它们是好的。但如果你真的查看那些他们无法撒谎的成分表,你会发现它们对你的身体有害。我认为同样的事情也适用于这里,一些公司声称他们的数据来源是道德的,而另一些公司甚至不谈论它。但最终,我们怎么能知道呢?因为在我看来,当我看到一个可以创造任何东西的超级智能模型时,那肯定它们一定是在大多数可用的公开、私人数据上进行过训练的。再次,有无同意是一个巨大的灰色地带,我们可以看到这样的新闻一次又一次地出现。话虽如此,Anthropic所说的一点很有趣,如果你采取一种爱国民族主义的方法,比如说我是一个美国人,那么这里的辩护是,这对美国人来说是一个国家安全问题,这是这里的说法。不,但他们不只抓取了美国数据,他们抓取了全世界的数据。
不,不,不。我说的最初他们做了什么,对吧?我不是在说Anthropic。Anthropic做了什么。Anthropic声称的是,我们需要对此做些什么。美国的政策制定者、州长以及像XAI和OpenAI这样的其他人工智能公司必须对此做些什么。我们应该作为一个团体团结起来,因为另一个国家窃取我们的模型是一个国家安全问题。他们正试图将所有公司联合起来,这是一个聪明的策略。但我的问题是,所有首席执行官都在争吵。埃隆不会和他坐下来谈。山姆·奥特曼不会和他坐下来谈。山姆·奥特曼和他没有在空中牵手。埃隆在X上公开谈论他,这引出了一个问题,好吧,Anthropic拿了数据。道德与否,无关紧要。在这种情况下,我谈论的是,这是否真的是一个国家安全问题,埃隆、山姆·奥特曼和政府是否应该联合起来制定一项政策,以确保这种情况不再发生?
他们怎么能阻止它?他们,我认为他们会想出,中国模型会想出新的方法来提取数据,因为这些模型对全世界的人都可用。他们正在使用API,对吧?因为当我读到关于蒸馏的时候,基本上发生的事情是他们正在使用相同的API,并从中训练他们自己的数据。所以当它们对公众开放时,中国模型基本上可以使用他们的模型。这个问题超出了我的理解范围。我需要对此进行更多研究。但我很好奇他们为什么用“我们必须作为一个社区团结起来对抗它”来结束最后一篇帖子。我想知道会是什么,因为我认为如果他们没有发布最后一条推文,没有人会关心前两条,因为你们即使有了最后一条,但最后一条就像是“伙计们,国家安全之类的”。请让我们,让我们呃,考虑一下这个。但你看到评论,人们实际上并不关心。
是的,在评论中人们不关心。我真的很想知道这对我们作为一个整体,在与中国和俄罗斯的军备竞赛中意味着什么。在人工智能方面,与中国、俄罗斯以及其他公司。有趣。让我们知道你们对这个具体问题有什么看法。
那么我们进入下一个话题,Netflix现在正在多个Netflix游戏中使用Comfy UI。当然,由于保密协议,游戏名称尚未披露,或者游戏仍在开发中。但Comfy UI的首席执行官在领英上解释了Netflix如何在他们的流程和工作流中使用Comfy UI。我和法拉一看到这条新闻,我们就讨论了这对娱乐业意味着什么,以及这对业内从事游戏甚至电影等作品的人意味着什么。
法拉,你觉得呢?如果你允许我,在我们进入辩论之前,这将非常酷,我想向人们介绍Comfy UI和Netflix游戏的概念,以防他们不了解。当然。
Comfy UI是一个开源平台,它允许你使用节点系统通过人工智能创建图像、视频,你可以将你的平台连接到本地计算机上免费可用的模型,或者你可以连接到其他模型,例如Nanab Banana Pro,并创建最复杂的节点系统来生成图像和视频。它是与Hicksfield和FreePay一起使用的最受欢迎的平台之一,提供更多控制,更多的控制,更细致的控制,一致性,而且你可以免费使用它。这是最重要的一点,因为它是一个开源平台。是的。
所以,Yoland和他的团队所做的一切对社区来说非常棒。然而,我对这篇帖子和信息有一个根本性的问题,我稍后会谈到。所以,这篇帖子以联合创始人Yoland的话开头,他说他们现在正在为多个Netflix游戏提供制作支持。现在,我个人从未玩过Netflix游戏,所以我不得不查了一下。什么是Netflix游戏?这是一项游戏服务,为订阅者提供90多款免费手机游戏,例如《死亡细胞》、《忍者神龟》、《荒野大镖客:Netflix版》。而这些游戏,他们之所以产生这个想法,是因为如果Netflix上有非常受欢迎的电影或剧集,他们可以立即将其改编成视频游戏。
但最大的挑战是,多年来我们都知道游戏开发成本极高,需要大量时间和人力。那么他们能做些什么来加快制作速度,以便一旦《鱿鱼游戏》等内容走红,他们能在6个月内推出一款游戏,而不是花三年时间,因为到那时《鱿鱼游戏》的热度已经消退了。这就是为什么人工智能变得如此有趣的原因。但我最大的挑战在于传达的信息。所以,Series Entertainment,这家人工智能原生的游戏开发工作室,正在率先使用生成式人工智能,他们使用它的原因是因为他们需要快速扩展多个Netflix作品的制作。快速扩展通常在没有人工智能的情况下,我们只谈论人类,当电影、剧集和游戏快速扩展时,我们最终会得到粗制滥造的东西。质量下降。正是如此。让我们谈谈第一批漫威电影和最新的电影。我非常肯定你们很多人都会同意,故事叙述和视觉特效的质量已经大幅下降。这不是视觉特效艺术家的错,而是因为制作公司和投资者进来并说:“我们需要快速制作电影。”时间线。是的。而且一年内制作多部剧集。当然。而那是在人工智能出现之前。所以想象一下,现在我们有了人工智能的粗制滥造和人类的粗制滥造叠加在一起。你会得到一个超级粗制滥造的东西。这就是我反对的。如果他们以正确的方式使用人工智能来创造更好的作品,当然可以加快速度,但不要试图,你知道,如果他们投入180倍的速度,让我们在两周内制作2亿款游戏。那就是我的问题。
我相信你可以用人工智能以很好的方式来增强你的故事。讲述一个更好的故事,拥有更高质量的资产,让游戏变得更好。但如果你想用所有生成资产和生成故事来制作20款游戏而不是一款,没有人会喜欢那些游戏。谢谢。我就是这个意思。因为最终,那些不了解游戏开发基本原理、只关心利润的最大投资者和董事会,他们将是推动更多产出的力量。当他们知道有人工智能参与,事情可以更快完成,并且用更少的人力时,通常会发生的情况是他们试图压榨这些工作室,让他们创造越来越多的内容。因此,牺牲了质量。
我完全支持使用技术。我完全支持使用新工具。我完全支持使用人工智能,但不是为了牺牲这么多,而是为了真正创造更好的东西。创造更好的故事。塑造更好的角色。这就是为什么这个故事相当有趣。作为创意人士、艺术家,了解这种情况正在发生是很重要的。他们将使用这些工具。那么,你希望如何定位自己?你对此有何看法?在评论中告诉我们。我很期待看到结果。我真的很想尝试一下。让我们看看它看起来怎么样,感觉怎么样。再说一次,它有助于故事吗?它有助于提高游戏质量吗?如果能,为什么不呢?是的。如果不能,那么我们必须重新思考这个想法。没错。
法拉德。好的。这将很有趣,因为在我们进入下一个话题之前,我们现在将邀请一位嘉宾加入我们。这位嘉宾我们在上一集中曾简要讨论过,因为我们看了他的作品——一张关于当今世界人工智能采用情况的照片,每个人都相信我们正处于人工智能泡沫中,但显然,如果你看数字,我们离泡沫还很远。让我们请达米安接电话。
那么达米安,我们在上一期节目中谈到了你的帖子,我认为当我们第一次在X上看到它时,它真的让我们大开眼界。我们今天真正想和你谈的是,是什么让你创建了那篇帖子,因为我认为它在人们中引起了很大的关注。我看到像诺亚这样的人甚至在他们的文章中使用了它。所以我们想深入了解它的细节。百分之百。我认为一切都充满了“害怕错过”的情绪,以至于我认为这是第一次,它几乎是反“害怕错过”的,对吧?当谈到使用工具、新发布等等时,我们几乎生活在一个回音室里,它几乎把人们带回了现实,对吧?数字本身就说明,84%的人没有使用人工智能,4%的人甚至为人工智能颜色代码光标这类工具付费,所以我认为这几乎像是一种反冲击,让人们惊叹不已,所以我在这个角色中24/7,人们说我们处于泡沫中,但实际上我们才是处于泡沫中的人,因为世界上大多数人甚至没有使用这些工具。
绝对是,老兄。你知道,我们总是谈论这个,因为我们大部分时间都花在互联网上,我们在X上刷,在Instagram上刷,这些平台非常了解我们,他们知道我们对技术感兴趣。所以,它向我们展示的都是新的更新、新的工具,我们睡了6个小时就醒了,这并不多。我的意思是,我跟我大多数朋友聊天,他们睡八九个小时。我们睡五六个小时,醒来后仍然觉得错过了所有的新更新。人们已经制作了各种视频,内容是“如果你不使用这个,你就落后了”。如果你没有使用,或者像这个人,他用开放云建立了一个完整的行业,这个人用云代码建立了一家完整的公司。所以,实际上很难驾驭它。百分之百,百分之百,我认为我们总是处于时间线和算法中,对吧?所以你会有那种“害怕错过”的感觉,你醒来会想我该怎么办?我觉得我需要做些什么,我觉得我需要做些什么,世界在进步,世界在进步,但实际上人们是知道的,显然,如果我们坐在这里说人们不知道人工智能,那是在撒谎,但显然存在一个采用差距,对吧?无论是消费者将其融入日常生活以改善生活,还是从商业角度来看,这显然是每个人都在努力弄清楚的,即企业如何真正实施人工智能,而不仅仅是“害怕错过”?
我认为这非常重要,因为当你处于那种“害怕错过”的状态时,你无法很好地进行创作,因为你试图追赶其他人,就像马戴着眼罩,这样它们就不会去看其他赛马,从而可以专注于自己的比赛一样,人类也需要戴上眼罩,因为如果你不戴,你就会不断地看着所有这些人建造东西,然后你每天都会改变你的想法,永远无法真正落实到某件事上。我喜欢你的帖子的一点是,它给了我们一种放松感,那就是,好吧,我们不晚。我们仍然很早。有很多炒作。我们处于一个泡沫中。所以,我们实际上可以放松下来,专注于我们正在构建的东西,而不必跳来跳去那么多次。我想问你的是,因为我确信当你做研究时,你必须更深入地了解各行各业如何使用人工智能,你自己如何使用人工智能,现在像你、我们和听众这样的人都了解这项技术了,你认为最大的机会在哪里?百分之百,我认为正如我之前所说,现在注意力已经到位,现在是关于真正的采用,对吧?我认为人工智能的问题在于,很多都是锦上添花的东西,对吧?没有真正合适的用例,有,但人们在实际实施方面所销售的。它并没有真正推动许多中端市场或中小企业或我喜欢在我的动态中称之为“无聊企业”的发展。对吧?所以,随着采用加速,我们如何才能真正进行适当的实施对话,对吧?因为就像我之前说的,人们是知道的,对吧?但我们如何才能真正优化工作流程?我们如何帮助客户摄入?我们如何才能改进工作流程,而不仅仅是这种“害怕错过”和炒作,以及“哦,人工智能这个,人工智能那个”?我们现在如何才能变得真实?作为一个机构,我们如何才能真正帮助企业?我们如何才能真正帮助企业优化工作流程,而不仅仅是炒作?
我还想问点别的。很多企业,当你走进去问他们如何使用人工智能时,大多数答案是“哦,我用它,我用Chat Gribb来改进我的电子邮件。我用Chat Gribbity来创建文档。”但我认为有了人工智能,你的业务可以获得更多好处。你可以自动化很多流程。你可以改进你业务中的许多管道,无论你是小型企业还是大型企业。你认为一家公司如何才能从这种用于电子邮件的ChatGPT阶段过渡到真正在其业务中使用这些工具?百分之百。我认为人们把它当作终局来推销,对吧?人工智能工具、新代理等的问题是,你不知道在三个月、三天、三年内会发生什么,对吧?所以,很多这些机构,很多人都在推动那个最终结果,那个全栈系统,但实际上,它是寻找快速的胜利,对吧?你如何才能真正帮助一位律师每周节省五小时,对吧?每周10小时。如果是可计费小时或一百美元,那就是每周1000美元,每年56000美元,对吧?所以,那里有明确的投资回报率,对吧?寻找快速的胜利,无论是通过工作流程、代理等等,嗯,这就是这些企业的投资回报率所在,对吧?这不是整个“让我们完全人工智能优先”的问题,因为你不知道三个月内会发生什么。所以,这是关于寻找这些快速的胜利,让这些企业明白,嘿,人工智能不仅仅是问ChatGPT天气或写电子邮件。你可以把它连接到工具。你可以做很多事情,它是关于找到那些瓶颈,找到企业中的那些低效率,然后自动化那些工作流程。
我同意你的看法。我认为我遇到的最大挑战,尤其是在我们现在更积极地在X上寻找节目信息时。很多围绕人工智能创作内容的人只是在猜测企业需要什么,例如使用Open Claw并说OpenClaw将自动化你的整个业务,但他们实际上并没有去和律师或房地产经纪人交谈,看看实际问题是什么。当然,Open Claw可以做很多事情,但你只是在猜测他们的问题是什么,并说这将自动化房地产。这将自动化律师的工作。我认为当这些不同行业真正拥有他们可以信任的人,进入这些企业,正如你所说,关注一个问题,而不是整个业务,一个困扰他们的问题,并试图解决那个问题时,我才会看到他们对人工智能的巨大信任,那时我们才会看到真正的采用。嗯,你是否亲自在教育人们方面或与某个机构合作?在这方面你做了什么来帮助教育?因为通过这篇帖子,一张照片,你教育了很多人。我想知道你还在做些什么。
当然。而且我认为你之前提到过。人们不知道他们不知道什么,对吧?所以,需要某种教育,让人们明白,嘿,这就是这个行业可能实现的事情。这就是我们与这位客户正在做的事情。这就是实际可能实现的事情,而不是“害怕错过”的炒作,让我们回归现实,理解工作流程,对吧?所以作为一个机构,简而言之,我们帮助公司优先采用人工智能,这在高层面上没有任何意义,但当你真正进入一个企业并找到一个快速的胜利时,对吧?回到律师的例子,你帮助他们处理客户摄入,无论是什么,对吧?一旦你参与到业务中,就像你所说的专业知识方面,你就会开始更多地理解工作流程,你需要融入这些工作流程,否则你只是在猜测。你只是在猜测,对吧?这就是代理机构的问题所在,它们有很多流失和消耗,一次性构建。他们构建了一个代理,三个月后就不再使用了。这是因为没有真正的转型。而作为一个企业,你需要转型。不能只是,“哦,我们来做一个代理”,对吧?比如,你必须真正地改造业务。你必须改变思维方式。而这需要通过教育来实现,对吧?我希望,我认为那张图表做到了这一点。我认为你提到的教育部分非常重要。我认为一个新的工作类别将是那些去这些公司,教育他们可以改进什么的人。就像我们今天的顾问一样,他们不一定需要实施任何东西。他们可以进来,进行教育,告诉他们可以在哪里,你知道,优化他们的工作流程并赢得他们的信任。我认为我们现在小型企业,特别是实体店面临的最大问题之一是缺乏信任。好的,如果我把所有事情都交给这个黑盒子来做,我怎么检查?我怎么验证?但如果你有一个值得信赖的第三方进来,一个协调者或架构师,他可以说:“嘿,律师先生,”或者,“嘿,美容诊所,你必须这样做才能节省预约时间”,那么他们可能会更信任他们,并且可以找其他人为他们提供服务。
百分之百。我们已经看到了。我们有几个客户进来,说:“嘿,来我们这里全职工作吧。成为那个AI操作员,对吧?”我认为不仅仅是知识,对吧?对这些工具的了解,以及作为一个生活在算法和时间线中的人,我看到了所有这些不同的工作流程等等。事实是,这些工具现在允许你拥有10、15、20人的产出,对吧?所以,除了咨询之外,许多这些AI操作员,你能够执行,对吧,使用像quadco、cursor、naden等工具,在许多这些较小的工作流程上,你也能够提供执行,对吧,不仅仅是最初的咨询,对吧?因为正如我之前所说,一旦你作为操作员真正参与到这些工作流程中,你就会说:“好的,如果我们自动化这部分,我们就可以自动化这部分。”好的,人力资源部门每月收到50万份简历。我们如何才能找到一种方法来节省50%的时间,对吧?我们如何才能更快地筛选?我们如何才能更快地过滤等等。所以,除了咨询之外,还有一个完整的执行层,这些工具允许像我这样的人拥有10、15、20人的产出。我完全同意你的看法。
达米安,你现在还在忙些什么?因为我很期待看到你接下来会发布什么样的帖子。我们的屏幕上显示着你的个人资料,大家可以去关注。你是否有正在进行的新研究,值得我们期待的?
百分之百。我们有很多事情要做。显然,我们经营一家代理机构。我们将人工智能引入公司。这需要大量的教育。所以,我们真的在努力寻找方法来弥合这种采用与关注之间的差距。嗯,是的,就是不断推动人工智能向前发展,帮助企业了解有很多他们不知道的事情,对吧?并教育他们他们不知道什么。然后显然,显然,显然在后端提供实施。
你认为哪些行业对所有这些新技术最开放?我会说是“无聊的”。我会说是“无聊的”行业,对吧?暖通空调工人、水管工、律师、房地产,这些传统行业,对吧?那些依赖传统系统生存的,对吧?那本身就是一个问题,对吧?让这些公司摆脱那些传统系统,或者围绕那些传统系统进行建设,但作为一个整体,这个行业是“无聊的”,对吧?那是非常高层次的,但“无聊的”行业,传统行业,呃,已经成熟,可以被颠覆,这就是我们作为一家代理机构的目标。
他们是否愿意作为代理机构与你们进行讨论?通常情况下,百分之百。而且我们已经相当完善地设置了,很多进来的潜在客户都是内向的。所以,他们在销售周期和知识周期上比大多数人走得更远,对吧?嗯,显然,在X上,看到所有这些不同的代理、工作流程等等,他们对他们想要什么有更多的了解。但要回答你的问题,是的。没错。让律师,不,不是律师,让水管工实施人工智能更难,对吧?因为他们只想工作,对吧?很难让他们完全改变他们所做的事情,改变他们的日常工作。但就像我之前说的,如果你能找到快速的小胜利,那就能为他们打开更大的局面,对吧?所以这确实是一次艰难的对话,但如果你从投资回报率的角度来构建它,嘿,我们可以为你节省10小时。而不是“嘿,这里有一个代理”,因为那是他们被推销的东西,对吧?但在这里,我们可以在这里节省10小时。我们可以在这里削减成本,对吧?我们可以优化这个,对吧?与其销售工具,不如销售结果。尤其是对于这些“无聊的”企业,他们真正理解的只是结果,而不是实际的代理和技术方面。如果这说得通的话。
我认为那非常重要。谈论结果而不是功能。你可以开始列举你要使用的所有工具,那是另一个元素。他们实际上不知道。他们不需要知道。如果你告诉一个水管工你要使用Open Claw,他们会说:“别跟我说话。那听起来很可疑。”但如果我想为你节省一天中的2小时,或者我将你的成本降低10%,那完全是不同的对话。
比如,所有要预约你的人现在都会和这个聊天机器人对话,然后你自动收到一份报告,告诉你需要去谁家提供管道服务,而且你不再需要接电话了。而且你不再需要接电话了。你就是这样和他们沟通的,他们就会觉得“好吧,听起来不错”。但如果你开始为他们列出功能清单,比如“我们将用这些开放AI模型或这个云为你构建这些东西”。他们会说:“不,不,不,不。别这样。这些人不关心那个。那是你的工作,对吧?”你只想专注于告诉他们你将如何让他们更高效。
呃,那非常有趣,老兄。Damian Player是你的X账号的标语。所以对于那些想去关注并看看你那里有什么的人,希望有更多这样的反“害怕错过”的帖子,给人们一个我们所处世界的真实视角。我很乐意看到更多这样的内容。达米安,非常感谢你来参加节目。
当然。我很感激。谢谢你们。祝你们愉快。再见。
好的。到目前为止,我想接下来我们想讨论另一个非常重要的话题。我在X上看到了。呃,Comfy UI上有一个工具。你不打算把功劳归给第一个看到它的人吗?你先看到的。我先看到的。我发给了普拉特。你发给了普拉特。我比你先看到。谁先看到的?普拉特正在抢麦克风。嗯,说实话。法拉先看到的。法拉怎么知道的?因为我会发给你。你可以去查一下,兄弟。不,但我先看到的。这不意味着如果你发了,好吧,你就做了。谢谢。那你来做开场白吧。把功劳给我。把功劳给我。做介绍。那么,我们有一个有趣的新模型。我们将看看Quen的模型。
没那么好。总之,3D角度相机控制。简单来说,你给这个模型一张图片。下面你会有一个3D相机,你可以在3D空间中旋转它,以生成同一张图片的不同角度。我们用几张不同的图片测试过这个。它对网上公开可用且流行的内容(比如布加迪)效果非常好。网上有多少布加迪的图片或视频?很多。所以它确切地知道每个角度是什么样子,并且生成了非常好的结果。我们用蒙娜丽莎的肖像测试了它,试图看看蒙娜丽莎从另一个角度看是什么样子,显然你可以看到它失败了。它生成了角度,但它是错误的。它不起作用,因为我们只有一张蒙娜丽莎的图片。它不知道,没有足够的数据,而且它不够智能,无法尝试生成和预测那些像素可能是什么样子。呃,普拉特,如果可以的话,你也许能为我们现场生成布加迪和另一张蒙娜丽莎。
为什么?在普拉特生成布加迪照片的时候。老实说,当我看到Framer在X上演示时,我之所以被吸引,是因为这正是艺术家未来所寻求的精确控制。
我实际上并不太关心这个模型的质量,以及它现在能提供什么。但我可以想象,我们在Hicksfield、Freepick或任何图像生成工具中遇到的最大问题是,如果你想改变角度,你必须和它对话。你必须提示它说:“嘿,我想要一个45度俯视图,或者我想要一个仰视图。”在这里,你实际上可以在3D空间中控制相机。这正是你在虚幻引擎或Blender等3D软件中拥有的。再增加一层,我不知道是更好的图像生成还是视频生成。这在未来将非常强大,这也是我希望在3D软件中看到的功能。
我完全同意。普拉特,我们能再向大家展示一次布加迪模型吗?所以这就是有趣的地方。我想再深入一点。是的。所以输入图像是左上角那个,对吧?
所以Quen图像编辑3D相机控制。左边是输入图像。那是我们从谷歌上找到的一张图片,是一辆布加迪。我们想以完美的连贯性创建另一个角度。我们可以绕着车旋转相机。我们不知道从图片上看,车后面是什么样子,但我们现在可以生成它。它应该保持背景色调、汽车和汽车形状的一致性。看,它确实创建了汽车的俯视图。我们可以换个角度吗?这太迷人了。
这是背面视图。是的,那是汽车的背面视图。你能转到侧面角度吗?呃,汽车的侧面角度。是的。把相机放高一点。是的。是的。好的。让我们看看。给你。完美。我的意思是,完美。是吗?不,但它保留了背景。它保持地面不变,汽车不变。它没有改变汽车的颜色或任何东西,但它在蒙娜丽莎那里惨败。
再次,嗯,我真的很喜欢3D控制。我真希望我们能在所有人工智能生成工具中拥有这些3D控制,因为那会给艺术家最大的灵活性来讲述他们的故事。想象一下你在拍广告。你真的很想拥有那种特定的相机控制。搞什么鬼。实际上,我们确实有蒙娜丽莎的鼻子。你能放大那里吗?蒙平。也许她是平的。这是一张图片。它真的在试图猜测蒙娜丽莎长什么样。
但我们没有这方面的数据。所以这就是它失败的原因。哦天哪。这太搞笑了。法拉,你没把手机静音。还是我的?是你的笔记本电脑在节目中响。你没把笔记本电脑静音。等等,它关着呢。是的,但它是 哦,那就是蒙娜丽莎从后面看的样子。
不错。实际上,我们为它生成了腿。蒙娜丽莎在照片中是坐着的。布拉德,你能生成蒙娜丽莎的其他角度吗?我们还能再试一个产品吗,呃,在你点击生成之后?不,不。别这样。别这样。去低角度。去低角度。去低角度。是的,生成。我们能找到另一个,呃,物品,比如连帽衫之类的吗?
呃,不。它不适用于,我认为它不适用于绘画。我们找一个真实世界的东西。也许像一件耐克衬衫,因为这幅画已经是2D的了。2D。所以我认为它很难处理。
我们再试一张图片。在普拉特找到那张图片的时候,我想快速将大家的注意力引到上一集。对于所有观看和收听的人来说,我们介绍了Trellis 2.0,它是微软的3D资产生成模型,我们在Hugging Face上展示了它可以生成什么,并且Michael Habib有一条评论说,嘿,你实际上可以在Comfy UI上获取Trellis,并且可以在未经微软公司许可的情况下使用它,因为我们以为我们必须这样做。他是对的。我们在电脑上测试了它,效果非常好。而且因为我们对样本有控制权。哇。
这真的很好。那真的很好。因为,耐克鞋是3D的。这是在现实生活中。不,不,不。我的意思是,互联网上有大量的耐克鞋照片。你去耐克网站,你会看到不同角度的。这就是为什么他们拥有所有数据。
我快速说完最后一点。我们在Comfy UI上测试了Trellis 2.0。它在你的电脑上本地运行。生成速度快,而且做得非常好。我们将不得不等到下一集,因为我们想对Trellis 2.0和Honuan进行全面比较,真正看看我们能将它们推到什么程度,以及模型的质量如何。当我们这样做的时候,我们会把它带到节目中,向大家展示一个完整的比较。这样,Michael Habib,你就能在这里看到完整的展示。我们只是要等确保我们完成那个。我想再看一眼这只鞋子的另一个角度。我实际上对一件事很好奇。
什么?耐克和布加迪很有名,所以有很多数据,它应该能做对。它做到了,对吧?不,不完全是。你看到那个,哦,飞人。是的,飞人,飞人标志搞砸了。但再说一次,我只是喜欢3D控制。我不认为这真的是你可以用于最终作品的东西,但3D相机控制是一个不错的功能。
我很确定最终所有人工智能模型都会拥有它,希望如此。顺便说一句,它对视频也会有很大帮助。如果想象一下你的摄像机运动,我们这里谈论的是照片,但对于视频,如果你可以在虚幻引擎中用人工智能生成的模型绘制你的摄像机运动,那么你将拥有很大的控制权。
绝对是。我认为未来会发生这样的事情。无论如何,我很好奇你们对这个Quen图像编辑有什么看法?这仅仅是我们对人工智能生成内容拥有更多控制的开始。当然,正如法拉所说,这将使我们能够对我们创造的细节有更细致的控制,这正是艺术家最终想要的。当它更先进、运行正常并具有100%的一致性时,这绝对会令很多人惊叹。
是的,没错。各位女士先生,这期节目到此结束,这让我很难过,因为我真的很喜欢和大家一起。他周五会回来。我们每周三天都在这里。你知道的,对吧?每周三天。周一、周三、周五在X、Spotify和YouTube上。不要忘记在YouTube、X和Spotify上订阅我们的频道。如果你正在从这些平台中的任何一个观看,因为那将帮助我们接触更多人,并教育更多人了解外面有什么,以及他们如何使用所有这些工具和技术来改善他们的职业生涯、他们的工作流程,基本上是他们正在做的任何事情。
而且这个节目是免费的,所以这确实对节目有帮助,因为它免费,不是付费节目。我们感谢您通过点赞、评论、分享和在YouTube上订阅来支持我们。
直到下一集,再见。再见。