Transcription
Clank 3.0 可能是我们迄今为止对 AI 视频最大的更新。我指的是多镜头生成、令人惊叹的角色一致性以及原生音频,所有这些都在一个工具中。今天,我将一步一步地向您展示如何使用每一个功能。一如既往,如果您对 AI 视频工具感到沮丧,这或许就能解决您最大的问题。那么,让我们开始吧。要访问 Clank 3.0 和 AI Master,请转到视频部分。您会看到一个下拉菜单,其中包含所有可用的视频模型。点击该下拉菜单,然后从列表中选择 Clank 3.0。就是这样。您现在正在使用最新版本。现在,让我带您了解界面。正中间是您的文本提示字段。在这里,您将精确描述您希望视频显示的内容。您可以根据需要简单或详细。在这里,您还可以选择视频方向。16x9 用于横向,9x6 用于纵向,或 1x1 用于方形格式。接下来,您将看到质量选项,标准或专业。标准提供良好的质量和更快的生成时间。专业版生成需要更长的时间,但能提供绝对最佳的输出质量。右侧是模式选择器。您可以在单镜头(使用一个提示生成整个视频)或多镜头(为每个需要的镜头编写单独的提示)之间进行选择。我们稍后将深入探讨多镜头。您还可以选择视频时长,从 3 秒到 15 秒不等。最棒的是,您不受固定间隔的限制。您可以选择正好 6 秒、7 秒、8 秒、9 秒、10 秒,任何您需要的时长。非常精确的控制。此外,您可以根据是否希望视频带有原生音效和环境音频来打开或关闭音频生成。最后,您可以上传帧。您可以上传一个起始帧来启动您的生成,一个结束帧来控制它在哪里结束,或者两者都上传以获得对视频的最大控制。但这里真正的游戏规则改变者是元素选项卡。这是我们首先要介绍的内容。让我们来谈谈元素。这是 Clank 3.0 中的第一个主要功能,它终于解决了 AI 视频中的角色一致性问题。那么什么是元素?元素是您为最大化一致性而创建的角色或产品集。您可以创建任何您想要的 AI 角色,制作一个自己的 AI 副本,或者创建一个产品。这样,Clank 就能理解您正在创建的角色或对象的完整上下文,并以最高质量将其集成到视频中。设置方法如下。点击添加资产按钮。您会看到两个选项。选择一个您之前创建的现有资产,或者创建一个新的。现在,让我向您展示如何实际创建这些角色和产品。要创建 AI 角色,请点击加号按钮。这将打开角色构建器。在这里,您可以选择角色的外观。选择外观、风格、性别、年龄、肤色、发色、任何特殊特征、服装以及整体氛围。系统会根据您的选择生成一个提示,您可以对其进行修改和调整,或者直接生成。这样,您就拥有了自己的自定义角色,可以用于您的视频中。有趣的部分是,您可以为这个角色设置信用点价格。如果其他人想使用您的角色生成内容,他们将支付信用点,您将赚取代币。一旦积累了足够的代币,您就可以提取真实的货币。所以,您不仅仅是为自己创建角色,您实际上可以从中获利。要创建您自己的数字副本,一个 AI 克隆,请点击相应的加号按钮,然后点击开始。输入您的姓名和描述。然后上传您不同角度的照片。确保至少包含一张显示情绪的照片。这样 AI 就可以学会模仿您的表情,并将它们以各种情绪集成到视频中。之后,您需要录制一个短视频来验证您的身份。完成后,您的 AI 克隆就创建好了,可以使用了。创建产品也是同样的道理。只需添加名称、描述和产品的四个不同角度的照片。为了演示,我已经创建了一个包含我自己的资产。我上传了四张不同角度的照片,并创建了一个名为我名字的集合。现在,要使用此资产并将我自己集成到视频中,我只需要在提示字段中输入 @ 符号,后跟我的集合名称,再加上描述我想要发生的视频的主要提示。让我给您做一个快速测试。我将写下“Arthur Winer 走过一个未来主义的霓虹灯城市,夜晚。电影般的相机从后面跟随。”让我们生成它,看看结果。如您所见,角色一致性已锁定。面部、比例、服装,所有内容在整个生成过程中都保持一致。这正是元素所提供的。但这里是它变得非常强大的地方。您可以在单个提示中使用多个集合。您可以拥有两个、三个、四个、五个角色,任意数量的角色,它们都将在同一个视频中互动,并且它们都将保持一致。或者您可以将角色与产品混合。让我给您一个例子。我将生成一个视频,其中我将与我们的产品吉祥物之一 Cyberkitty 一起跳伞。提示是“Arthur Winer 和 Cyberkitty 跳出飞机,带着降落伞,史诗般的广角镜头,蓝天背景。”让我们生成它并检查结果。看。角色和对象在整个跳跃过程中都保持了完美的连贯性。这对广告商、产品创作者和电影制作人来说是颠覆性的。您现在可以在一次生成中创建具有多个一致元素的复杂场景。但这里有更重要的事情。大多数人拿到这些工具却不知道如何正确使用它们。这就是为什么 AI Master 包含 190 节课程,关于提示、视频 AI、图像工作流程的完整课程,所有我将在这些视频中展示的内容。您学习方法,然后立即在工作室进行练习。还有提示实验室。300 个专业提示,您可以复制和自定义。AI Master Chat 是一个了解整个平台的 AI 导师,可以帮助您优化提示,解释出现问题时哪里出了错。专业计划每月为您提供 2000 个代币,以便您在学习课程的同时进行练习。现在,年度计划有 30% 的折扣。我将在下方提供链接。您可以免费开始,探索课程,感受平台。准备好后,升级到专业版并开始生成。好了,现在让我们来谈谈多镜头生成。这是 Clank 3.0 的另一个绝对颠覆性的功能,也是最让我惊叹的功能。多镜头允许您在同一个 15 秒的生成中创建多个不同的镜头。因此,而不是生成一个连续的摄像机移动,您可以有镜头一,然后切换到镜头二,然后切换到镜头三,所有这些都具有不同的摄像机角度、不同的动作、不同的所有内容。而且所有这些都在一个 15 秒的剪辑中生成。这太棒了。传统上,如果您想创建一个多镜头序列,您需要使用像 Nano Banana Pro 这样的工具单独创建每个起始帧,然后在 Cling 中单独制作每个动画。这需要大量工作。但通过多镜头提示,您可以创建一个完整的自成一体的故事,多个镜头,多个摄像机角度,对话,您想要的一切,都在一次生成中完成。让我向您展示它是如何工作的。打开多镜头选项。您会在界面上看到它。启用多镜头后,您可以添加多个提示,每个镜头一个。每个镜头必须至少有 3 秒长,每个提示最多包含 500 个字符,因此您需要简洁明了。现在,从头开始编写这些提示可能会很棘手。所以,这里有一个专业技巧。使用 AI Master Chat,您会在屏幕右侧找到它,来帮助您编写它们。这是我对 AI Master Chat 说的话。“为我写一个多镜头提示,展示 Arthur 和 Cyberkitty 在一座古老寺庙中发现一个发光传送门。使用各种摄像机角度来确保场景充满活力且节奏良好。将此写成单独的提示,以便每个提示都可以放入多镜头字段。具体说明角色和对象的 [位置]、动作以及每个镜头使用的镜头。所有动作都必须在 15 秒内完成,每个镜头至少持续 3 秒。每个提示最多 500 个字符。”AI Master Chat 给了我我需要的东西。一系列单独的镜头提示。每个提示都描述了镜头、摄像机角度和动作。现在,这是关键部分。在每个提示字段中,您可以使用 @ 符号来引用您预先创建的角色或产品。所以,我将每个提示复制并粘贴到单独的镜头字段中,确保在提示中包含 Arthur Winer 和 Cyber Kitty,以在所有镜头中保持一致性,然后点击生成。说实话,当我第一次观看这个生成结果时,这对我来说是一个重要的时刻。我没想到这会奏效。具有多个角色的复杂多镜头序列一直是 AI 视频工具的弱点,但这个,这个奏效了。您看到我与 Cyber Kitty 从不同的摄像机角度,穿过这座古老的寺庙,发现传送门,并且两个元素都保持一致。动作充满活力。剪辑感觉自然。关键在于,通过使用 @ 符号在每个镜头的提示中引用您的元素,您可以确保整个序列中的角色和产品一致性。因此,即使您在不同的角度和不同的动作之间切换,角色和产品在每个镜头中看起来都一样。我真诚地认为这标志着 AI 电影制作的一个真正时刻。我们已经翻开了新的一页。现在可以创建具有多个一致元素的复杂场景了。好了,在继续之前快速现实一下。AI 电影制作人通过使用 VO3 在 UA 政府主办的 10 亿粉丝峰会上创作 AI 电影赢得了 100 万美元。用我们现在正在使用的同一个工具制作视频就获得了 100 万美元。这是模式。早期掌握这些工具的人不仅仅是创作很棒的视频。他们正在建立实际的收入来源。所以问题很简单。您是袖手旁观,看着这一转变发生,还是将自己定位为从中获胜?这就是结构化学习真正重要的地方。Outskill,第一个专注于 AI 的教育平台,旨在加速像您我这样的 AI 学习。他们将于本周六和周日太平洋标准时间上午 10 点至下午 7 点举办为期两天的 AI 大师培训。现在是加入的完美时机,因为您可以在接下来的 48 小时内免费加入。这次为期 16 小时的 AI 培训已经为全球培养了超过 1000 万名 AI 优先的专业人士,并在 Trustpilot 上获得了 4.9/5 的评分。来自营销、金融、运营、产品和工程领域的人们都加入了,因为这并非特定于任何行业,而是现在每个行业都需要的东西。在这里,您将学习如何构建能够为您规划、编写、执行和报告的 AI 代理。自动化即使在您睡觉时也能运行的工作流程。连接 Sheets、Notion、CRM 和电子邮件等工具以创建盈利系统。使用 AI 每周节省数小时,并在工作中获得不公平的优势。不仅如此,您还将学习如何从这些技能中获利。来自这次培训的人已经推出了 AI 驱动的服务,通过应用他们所学的系统,每周可带来 3000 至 4000 美元的收入。为了启动您的这一年,您还将获得高级终身奖金,如 AI 提示圣经、AI 利润路线图、您的个性化 AI 工具包构建器,前提是您参加两天。最有趣的部分是,当您注册时,您将获得 2026 年 AI 生存黑客手册的访问权限,这是一份关于 2026 年即将到来的 AI 转变的全面汇编,以及您可以采取的实际步骤来做好准备。座位有限。使用描述中的链接加入,并加入 WhatsApp 社区以在大型爆炸前保持更新。现在,开始和结束帧。这是 Clank 3.0 中最强大的控制功能之一,它为您提供了对视频开始和结束方式的精确控制。那么,您为什么要使用这些帧呢?开始帧让您精确定义视频的开头外观,构图、灯光、场景设置等一切。结束帧让您控制视频的最终去向。当您同时使用两者时,您实际上是为 Clank 3.0 提供了一个路线图。从这里开始,到那里结束,然后弄清楚中间的运动。当您需要特定的构图进行编辑时,当您正在创建需要匹配特定镜头的序列时,或者当您想确保视频顺利过渡到另一个剪辑时,这尤其有用。添加方法如下。在提示字段正下方,您会看到上传帧的选项。您可以上传开始帧、结束帧或两者都上传。界面非常简单。只需点击上传按钮并选择您的图像。现在,让我向您展示三个不同的测试,以便您可以看到每种方法的工作原理。对于第一个测试,我只上传了一个开始帧。黄昏时森林里的一个露营帐篷。提示是“一只大熊慢慢走向帐篷并进入其中。”让我们生成它,看看结果。如您所见,Clank 3.0 采用起始构图,并根据提示进行动画处理。熊自然地走近,灯光保持一致,运动感觉自然。仅使用起始帧会让 Clank 在视频结束时拥有创意自由,但会锁定您的开场镜头。对于第二个测试,我只使用了一个结束帧。一个火箭矗立在月球表面,背景中可以看到地球。提示是“一艘火箭飞过太空,飞向月球,下降,然后平稳地降落在月球表面。”让我们看看会得到什么。这很有趣。Clank 3.0 必须自己弄清楚起始构图,但它确切地知道它需要结束在哪里。火箭飞过太空并精确地降落在我们指定的位置。结束帧完美锁定。这让您能够控制最终镜头,当您需要特定的结尾进行编辑或过渡时,这非常完美。现在,对于使用两个帧的最受控方法,对于起始帧,我有一个放在海滩上的关闭的木制宝箱。对于结束帧,同一个箱子是打开的,里面有发光的金色光芒。提示是“宝箱慢慢打开,露出里面神奇的金色光芒。”让我们生成它。看,它就在那里。Clank 3.0 在两个帧之间创建了完美的过渡。箱子平稳打开,光线自然出现,开头和结尾都与我们指定的完全匹配。当您需要精确结果时,这是终极控制方法。因此,根据您的需求,您可以使用起始帧进行受控的开头,使用结束帧进行受控的结尾,或者两者都使用以获得对整个视频的最大精度。Clank 3.0 的最大改进之一是增强了真实感、情感表现和原生音频生成。让我给您举个例子。我让 AI Master Chat 为我写了一个多镜头提示,关于两个老朋友多年后在城市公园重逢。我只输入了每个镜头的文本提示,然后让 Clank 从零开始生成一切,使用纯文本到视频。让我们看看结果。对我来说,这真的令人印象深刻。Clank 3.0 的主要改进之一是提高了表演的情感冲击力。这些 AI 演员在这里传递着真实的情感。惊喜、喜悦、重逢的温暖。有很多值得称赞的地方。看看细节水平,皮肤纹理,飞散的头发,浅景深,脸部微妙的灯光。这感觉非常真实。而这一切都是通过纯文本提示和多镜头生成实现的。原生音频,它会与您的视频自动生成。您会得到音效、环境音频,甚至与场景匹配的对话。它并不总是完美的,但它是一致的,而且通常相当不错。市场上大多数最好的 AI 视频模型现在都包含原生音频,Clank 3.0 在这方面做得相当不错。这里的真实感比以前的版本有了真正的飞跃。头发的运动方式,光线与表面的交互方式,面部表情的丰富性,都明显更好。这就是为什么 Clank 3.0 感觉像是 AI 视频生成的一次真正的飞跃。好了,现在让我们来谈谈如何处理 Clank 的一些不准确之处,因为它并非一切都完美。您需要牢记一些事情才能获得最佳结果。第一件事,角色与相机的距离。当您的角色离相机很远时,质量会显著下降。这似乎是目前几乎所有 AI 视频模型的限制。如果您的角色离相机很近,结果看起来很棒。但在角色很远的广角镜头或远景镜头中,面部细节往往会变得相当模糊。所以这里有一个变通方法。如果您想要最好的结果,请让您的角色靠近相机。Clank 3.0 在这里真正 shines。更紧密地构图您的镜头,您将获得更好的细节和一致性。第二件需要注意的事情是文本渲染。Clank 3.0 声称改进了文本渲染,但在我的测试中,它仍然是好坏参半。我让 AI Master Chat 为我写了一个非常复杂的文本渲染提示,一个带有大量信息的公交车或火车时刻表。不幸的是,仍然有很多不准确之处,简单的文本似乎还可以,但复杂的文本,带有多个行、符号和细节。这很糟糕。奇怪的伪影,奇怪的语言使用,没有意义的符号。摄像机移动本身看起来很棒,灯光,它在 3D 空间中的移动方式,但文本渲染仍然需要改进。所以,如果您的项目严重依赖文本渲染,请知道它还没有完美。它比以前好,但对于复杂的文本来说,它还没有达到生产就绪的水平。暂时坚持使用简单、短的文本,您会获得更好的结果。这是我推荐的工作流程。第一步,创建您的元素,您的角色和产品资产。这可以锁定每次生成的连贯性。提前构建您的资产库,以便在需要时随时可用。第二步,如果您想精确控制您的构图,您可以上传开始帧、结束帧或两者都上传。这是可选的,但它能让您更精确地控制视频的开始和结束方式。第三步,如果您想创建具有多个摄像机角度的复杂序列,请使用多镜头提示。使用 AI Master Chat 来帮助您编写单独的镜头提示。具体说明镜头、位置和动作。每个提示保持在 500 个字符以内,并确保每个镜头至少有 3 秒长。第四步,使用 @ 符号在您的提示中引用您的资产,以在您的生成过程中保持角色和产品的连贯性。第五步,生成并审查。并非每次生成都会完美。您会得到一些糟糕的结果,但当它起作用时,它真的会起作用。这个工作流程解决了自 AI 视频生成首次出现以来一直存在的问题。角色一致性问题已解决。无需手动创建每个帧的多镜头序列问题已解决。专业外观的输出和原生音频已完成。如果您想自己测试这些功能,AMSR Pro 让您在一个地方访问所有内容。链接在下方。我们目前提供年度计划 30% 的折扣。非常感谢您的观看。下次再见。