📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Seedance — the Veo3-Killer that's 25x Cheaper is NOW in n8n (AI Agent Tutorial for Viral Videos)

AI Luke26:34

Transcription

所以,抖音刚刚发布了一个谷歌的竞争对手。如果你还没听说,Bite Dance 公司,也就是拥有抖音的公司,刚刚发布了 Cance 1.0,它能从零开始创作视频,对吧?你只需要给它一个提示,它就开始创作这样的内容了。太不可思议了,对吧?在排行榜上,它实际上击败了谷歌。那么,这些排行榜是什么呢?它叫做视频生成竞技场。你可能听说过聊天机器人竞技场,基本上就是我们在这里点击它。视频竞技场。你会得到两个视频,对吧?像这样,你必须决定哪个你认为更好。所以,如果你看这两个,我会说这个看起来更好。在这里,你会看到那是 Halu Bet Sora,这实际上很有趣。从那个排行榜上,你可以看到 Bite Dance 的 Sea Dance 实际上是第一名。现在,VO,如果你不知道,V3 是谷歌几周前刚刚发布的。基本上,它是市场上最好的视频生成器。最酷的是它能同步生成视频和声音,这太棒了。所以,我之前做过一个关于它的视频,但今天我们将向你展示如何使用 NE,一个 AI 自动化平台,自动创建 seed dance 视频。之所以这么酷,是因为对于 VO,人们用它来获得数百万的观看量,就像你在这里看到的,对吧?对于像 Bigfoot、Vlog Life 等等。但现在人们也使用 Seance,它的价格便宜 25 倍,人们正在创作这样的视频。为什么?因为它不能自动同步音频。所以,最好做那些不需要真正同步音频的事情,对吧?比如 ASMR。正如你在这里看到的,人们获得了数百万的观看量,对吧?那么,它要多少钱,等等。让我们快速看一下。V3,对吧?如果我们看这里,一个带音频的 5 秒视频,3.75 美元,这相当贵。但请记住,这一切都是因为它是自动化的。这不是免费的东西。这就像在想办法让你不必去做工作。而你的成本可能很高,与这个相比。然后在这里,wave speedi 是我们将要使用 bite dances seance 的地方。在这里,你有四种不同的选项。你看,你有 480p 的选项,这很酷,然后是 720p 的选项,如果你真的想利用它来在社交媒体上爆红,这通常是你想要的。但即使是这样,每段视频也要 30 美分。而一段视频可以长达 5 秒。所以,你可以看到,这比其他选项贵 10 倍,或者说是 12 倍。但对于这个,它确实有音频。所以你可能会想,好吧,用 wave speed,我没有音频。是的,但当我运行这个的时候,对吧?完成整个过程的成本不到 3 美分用于音频和视频的组合。所以整个东西大约是 93 美分,对吧?总价是 720p 选项的三分之一。所以仍然非常便宜。现在,如果你想要模板,你不想费力地让我告诉你如何做,你可以去 AI Automation Hub,这是我的免费 AI 社区。在这里,我们总是有模板之类的东西。进入教室,任何模板,然后它们都会在这里。例如,我们有 Google V3 的。你可以像这样进去,然后点击这里,或者你也可以去顶部搜索。现在,我也有一个付费社区,叫做 AI Automation Pro。加入这里后,我会给你一个初步的咨询表,让你快速上手 AI。我会告诉你该怎么做。我甚至会为你制定一个蓝图。然后如果你需要任何帮助,我们提供帮助。我们还有很多课程。然后我们社区里有活跃的人,他们总是在寻求提升,你也能获得最新的新闻等等。你甚至可以通过发帖、评论和点赞别人的东西来赚钱。所以,让我们开始这个教程。现在,这是来自 RoboNuggets 的,他最先分享的,对吧?所以,非常感谢他,但我认为这值得分享,谈论它的优点,谈论它的缺点,但也谈论如何改进它,对吧?首先,我将谈论总体架构。然后我们将逐个节点进行。所以,你有了想法。你如何获得它?嗯,计划,你知道,每隔一段时间,每天。然后你有一个想法代理,它会产生想法。然后它会被记录在 Google 表格中。然后从那个 Google 表格中,一个提示代理会获取它并将其转化为提示,因为有一个想法是一回事。获得这些真实的提示是另一回事,然后你可以去生成剪辑。之后,你在这里使用 HTTP 请求生成剪辑。基本上是在互联网上发送消息给 wave speed,告诉它为我创建这些。它会创建它们,然后你可以下载它们。然后你想生成声音,我们将使用 file AI。所以,file AI 和 wave speed 基本上它们只是这些大型语言模型的 API 提供商。所以,如果我们去这里,比如 V3,这是 V3 和 FI,这是因为你无法从谷歌获得谷歌 V3。你必须通过 FI 和 wave speed 来获得。同样,你无法从 bite dance 获得 bite dance C dance pro。你也不能从 foul 获得 pro 版本。曾经有一个小插曲,你可以使用 URL,但事实证明那是一个 bug。他们不打算发布它。所以,这是第一个发布的地方,这就是为什么我们使用它们。然后在这里,你只需生成声音。然后之后,我们将其发送到 F,然后它将视频打包在一起。所以,它获取剪辑,获取声音,将它们混合在一起,缝合视频,然后,你的输出。你会在 Google 表格中得到一个 URL。所以,你会得到一个像这样的 Google 表格。这是你的 URL,当你点击它时,它会下载视频,然后你会得到一个像这样的视频,完全由 AI 生成。让我们逐个节点地讲解,这样你就可以实际构建它了。所以,我们这里有一个计划触发器,在午夜和零点之间运行一天。基本上每天午夜运行。直接开始。但你也可以在这里点击执行步骤,它也会运行。现在,想法代理这里我们有一个提示和一个系统提示。所以,系统提示或系统消息是你告诉代理的东西,在这里你给代理一个角色。你给它一些规则。做这个,做那个,不要做那个,不要做那个。然后你还给它一个输出格式,因为代理,它们确实很棒,但你需要给它们非常明确的指令,以尽量减少不确定性。尽量多引入确定性,因为本质上它们就像,它们会做任何它们想做的事情。你想尽量缩小这些限制。这就是为什么我使用系统消息。然后你有提示,这里的提示是给我一个关于……的想法,然后你在这里插入一些东西。所以你可以进来并更改它。我们还给它工具。所以,使用思考工具来审查你的输出,这就是这里,它是一个思考工具,基本上将你的模型变成一个推理模型。之所以酷,是因为推理模型非常昂贵,而 4.1 以其最便宜或 4.1 mini 我认为是最便宜的,但它性价比最高,而推理模型非常昂贵。所以你可以使用思考工具将其变成一个推理模型。然后我们有解析器。所以,这是输出解析器,你会在这里看到一个例子。所以,从 JSON 示例生成模式。模式基本上就是我想要的我的数据看起来的框架,你想要它看起来像这样。所以,标题,等等,想法,等等,环境,等等,声音,然后状态,对吧?而这里,你会注意到我们在输出 pa 中,所以附加在这里,但我们也在代理系统消息中,这里有一个我们想要的输出示例。这是因为你想要……在系统消息中,你就像,听着,我总是想要你输出这个,而输出解析器就像双重检查,这就是输出,因为如果你没有解析器,它可能会输出任何它想要的东西,即使是偶然的。现在,之后它会将其记录到这个 Google 表格中。所以,首先,我想在你需要设置凭据之前,你只需点击笔或铅笔,然后从这里获取 API 密钥,你可以去 platform.openai.com/api openai.com/appi keys。注册,添加你的账单信息,创建一个新的秘密密钥。但如果你担心花太多钱,你可以做的是,如果你去 studio.google.com,然后你可以来这里,虽然它现在看起来有点疯狂,但实际上相当简单。别担心,去获取 API 密钥。从获取 API 密钥,然后你想点击创建,然后你想选择一个项目。然后点击创建,然后你可以复制这个 API 密钥。如果你没有项目,你可以去 console.cloud.google.com,在这里你可以创建一个 Gemini 项目或一个用于你的 Gemini API 密钥的项目。所以,在这里你可以点击新项目,创建一个,然后你可以使用该项目来创建你的 API 密钥。现在,你会注意到这实际上是 Google Gemini。但我们使用 Google Gemini 而不是 ChatGPT 的原因,如果你担心钱的话,是因为在这里,例如,对于这个闪光预览,或者闪光预览灯,无论什么……你可以看到,免费的,我们每天有 500 个,这很酷。所以,你可以每天运行 500 个提示,你可以像这样更改它,而不是 OpenAI,你可以点击加号,然后更改为 Gemini。所以,你可以在这里看到我有 Gemini,然后点击那个,然后就这样做。所以,这就是你可以用更少的钱做到这一点的方法。但请注意,对于代理,因为代理可以运行多次。所以,就像我在这里让它思考一样。所以,基本上这个代理会运行,它会创建这个东西,这可能是一个提示,然后它可以思考,这可能是两个提示,然后它可能有另一个响应,这可能是三个提示。所以,这实际上是你的 500 个中的三个。然后它记录想法。现在,我在这里使用的是 um N cloud,正如你在这里看到的,而不是自托管版本,因为那样的话,连接到你的 Google 帐户非常容易,再次按下笔,然后你只需点击使用 Google 登录,这非常简单,资源,所以它是一个文档中的工作表,我只是创建了这个简单的表,再次,这将在学校社区中,你只需要这些标题,对吧?只是标准的标题,所以从这里,我们有文档,然后列表,然后我选择了这个 C dance,这是这个工作表的名称,或者工作表的名称,他们称之为文档,然后实际的工作表名称是 sheet one,指的是下面的这个,然后如果我们回到这里,手动映射每个列,所以我们正在映射这些列,所以从想法代理,所以输出,你可以看到已经正确解析,然后我们拉过来,标题,在这里拖动,放在那里,然后它就会弹出,对吧?它会像这样出现。这是因为你有这些花括号来表示它是动态的,在这个表达式下。然后我们有它是 JSON。所以,我们去 JSON,因为它实际上看起来就是这样。JSON.output zero。所以,这是如果我们回到模式,你可以看到这是 output zero。所以,它是第一个。它是唯一的,但它是第一个。点标题,这是它的名称。然后你填写所有这些,除了最终输出。很酷。所以,我们把它记录下来了。我们现在有另一个代理,它获取这个并创建视频提示。这样我们就可以有三个视频,这样我们就可以将它们链接在一起。一个视频,两个视频,三个视频。所以,要做到这一点,我们再次有一个系统消息。让我们打开它。再次,你给它一个角色,你给它规则等等。描述应该看起来像这样。这里有一个我想要的语气。这里是长度。嗯,这里是输入。所以,想法,环境,声音,然后格式。这就是你想要的它看起来的样子。所以,从这里,我们有提示,它就是给我三个基于之前想法的提示。也使用思考工具,因为再次,它有这个思考工具。然后这次的解析器看起来像这样。想法,环境,声音,场景一,场景二,场景三。并且作为参考,你也可以在这里删除它,匹配到这里,只使用一个。你的 AI 也是如此。你可以只使用一个。嗯,但我喜欢保留它们。所以,如果我们像这样移动它,它们共享工具,我们共享这个凭据。但我喜欢将它们全部分开,因为我认为这样感觉更干净。嗯,就像它更好一样。所以,我们有这个提示代理,现在我们有这个输入和输出。我实际上还没有谈过。对于任何正在观看的初学者,基本上这里中间的句子是输入,左边是输出,右边是输出。所以,再次,我们在这里看到的是,那里很好,输入记录想法,然后我们有这个作为设置。所以,它通过代理,这是输出想法,环境,声音,场景一,场景二,场景三,就像我们预期的那样,这很完美。很酷。所以,现在进入这个的主要内容。所以,我们现在 OpenAI 在这个实例中已经创建了想法,生成了想法,将其记录在 Google 表格中,然后又生成了视频提示。很酷。那么我们现在做什么呢?嗯,我们这里有一点代码,它只是获取……让我打开它作为一个 JSON。看到这里,基本上是从这里获取三个场景。所以,我们这里有描述,然后描述,然后描述,这就是这三个场景,这样我们就可以把它们放在一起。现在,我们想创建剪辑。所以,从这里,我们使用一个 HTTP 请求节点。这就是这个小地球仪的东西。这是用来创建剪辑的。所以,我们将使用 wavepeed API。所以,让我们去 wavepeed,我将向你展示如何获取你的凭据等。所以,首先,你还会注意到 API wave speed AI bite dance C dance V1 Pro 480p。现在,你可以更改这个部分,因为我之前说过,你可以更改为你实际想使用的任何一个。但基本上,在这里注册,你会得到一美元的免费额度。所以,你实际上可以运行整个东西,花费大约三美分,因为第一次运行,你可以以 720p 的价格获得三个视频,价格为 90 美分。所以,无论如何,来这里,注册。然后你只需去访问密钥,然后从这里,你只需给它一个名字,然后创建密钥,然后你只需复制那个密钥。过来,头部关闭。点击笔。然后我们有授权作为名称,而值在这里。它不会显示给你,但来这里查看 waves 认证文档。看到获取 API 密钥等。一个示例用法。所以,curl,我们将使用它,因为 curl 基本上就像一个 HTTP 请求 POST,你看到它是 authorization: bearer 你的 API 密钥。所以,在这里你会删除所有这些,然后在下面你会有一个 bearer,然后你粘贴你的 API 密钥。所以,就像这样,然后你把它放在里面,然后保存,这样你的 API 密钥就设置好了,这基本上是你的唯一标识符,这样 wave speed 才知道是你,因为每个人都有自己的。如果你和别人分享,他们可以使用它,他们可能会用完你的免费积分,然后即使你添加了账单信息,他们也可以使用它,基本上就是用你的钱。所以,注意这一点。然后下面,我们正在发送原始 JSON 作为正文。所以,基本上这是我们正在发送头部。所以,我们正在发送一个 POST 请求。所以,我们将一些东西推送到这个 URL。我们提供我们的认证,告诉它这是我们。然后这是我们想让它做的事情。所以,如果我们在这里打开它,你可以看到我们正在提供宽高比。所以,你可以更改它,但这是短视频内容。时长,然后是提示。所以,我们有视频主题,发生了什么,以及视频拍摄的地点。所以,这就是你要发送给它的所有内容,然后它就会开始创建它。然后我们有一个等待。我只是把它设置为两秒钟,因为我们一次测试一个节点,但它真的应该是 60 秒,甚至更长。甚至几分钟。然后之后,一旦你等待它完成,比如说最多三分钟。之后,我们得到一个 GET 方法的 HTTP 请求,这意味着我们现在正在获取信息。所以,第一次我们发送 POST,说去做。现在,我们正在获取它实际创建的内容。所以,我们去 API blah blah blah 斜杠,它们通常称之为预测,当它们生成某物时。所以,我们有 JSON 数据。ID,而这里,我们来自,如果我去,是这个吗?所以,数据 ID,而你正在传入它,因为这是这个预测,这个生成的 ID。我们传入我们的头部,就这样。然后它会下载这个。正如你从输出中看到的,那里。这就是预测。所以,这是视频输出。所以,现在我们有了这个视频。现在,让我们为视频生成声音。所以,我们要在这里使用 file。现在,file 的设置也非常简单,你只需登录,对吧?添加你的账单信息。对我来说,我认为我添加了,可能是 10 美元,但你可以添加,不多。一定是我添加了 20 美元。但是的,我相信你可以一次添加 5 美元,它不会用太多。正如我之前所说,如果我去看使用情况,我做了 23 秒的视频,花费了 1725。但实际的音频,生成声音只花了 3 美分。而将音频与 Cance 的视频放在一起只花了多少?那是多少?一美分?所以,那是百分之二美分。所以,几乎是免费的。嗯,所以,3 美分。所以,我的意思是,如果允许的话,添加一美元。如果允许的话,添加三美分,它就会起作用。也许四美分。但无论如何,注册,然后要获取你的 API 密钥,只需去 API 密钥,然后添加密钥。给它一个名字。搞定。所以,你复制那个 API 密钥,然后你来到这里,再次头部关闭,头部关闭,文件笔,然后要更改它,你只需在这里更改它,作为参考,授权,但这次你不使用 beer,而是。所以,如果我们去任何模型,比如 v3,去 API,你可以向下滚动到认证。现在,我们可以看到认证,你可以看到提交请求 curl 授权密钥 file key。所以,这次不是 beta,而是 key。这就是你如何在这里放入这个,键空格,然后粘贴你的 API 密钥。就这样。让我们关闭它。而我们再次发送 POST。所以,说去创建这个。而这次是到 Q for file。所以,file.run。嗯,这是 mm audio v2。所以,只是为我们生成一些音频。而我们再次传入一个正文。而这次的提示是 ASMR 舒缓的音效,然后是 prompt AI agent JSON.output.sound。所以,如果我们过来这里,所以这就像再次映射。我们去 prompts AI agent 这个。我们去 item,这将是第一个。json。这是 JSON.output。这是输出。点声音是这个。然后视频 URL。我们将传入 JSON 数据。output zero,如果我们去这里,所以这是上一个。所以,这是 JSON.data。所以,这里,如果不是上一个,如果它是几个节点之前的另一个节点,那么这就是为什么你按名称引用它的原因。但无论如何,所以你可以看到 JSON.data。所以,上一个节点 output zero,就是这个。所以,data output zero,就是这个。所以,我们将其推上去,它就会创建我们的声音。所以,一旦我们完成了,我们又必须等待。所以,这次等待一分钟左右,让它创建它。然后我们只是获取它。基本上是同样的事情。这里我们有这个 Q file run blah blah blah requests,然后我们得到 request ID。所以,就像上次一样。然后传入我们的头部认证,file,就这样。搞定,我们现在有了声音,我们有了视频。现在,我们需要把它放在一起。所以,在这个例子中,对吧?我看到人们在谈论为什么你不应该这样做。相反,应该有一个更简单的方法来组合剪辑。如果你是自托管的,有一个编程方法可以做到,我们可以通过使用 execute code 命令来运行代码,而不是进行 HTTP 请求,你可以基本上将文件放在一起,对吧?我以前在一个项目中做过,用 Python 生成视频中的镜头,对吧?但问题是,我们不能在云端这样做。而且它实际上是资源密集型的。所以,它会消耗你的资源。所以,我们也在外包这个,因为你已经看到了它有多便宜。它就像一小部分。我甚至不需要找到它。但你知道,你以前见过。一小部分美分。2% 的美分左右。所以,我们将缝合视频。所以,我们要做的第一件事是列出元素。所以,我们要将什么添加到一起?所以,我们将要添加的视频 URL。然后对于序列视频,我们再次使用相同的认证,因为对于 file 来说,我们仍然是我们。我们只是这次访问不同的 URL 来进行 POST。我们访问 FFmpeg API compose。现在,ffmpeg 是你可能会遇到的东西,当你改变视频设置或移动将视频片段放在一起时,就像这样。嗯,这是通过使用这个 ffmpeg 进行编程的方法。所以,我们有和往常一样的认证。然后这次在正文中,如果我们打开它,我们有视频类型,ID,基本上是不同的关键帧。所以,我们有第一个视频的 URL,第二个,以及第三个,这三个不同的视频。然后从那里,我们只需等待它完成。再次,一分钟。然后获取最终视频,只是为了获取那个 D FFmpeg API 请求斜杠 request ID,它来自这里,再次传入我们的认证。然后之后,我们将它推送到 Google Sheets。现在,在这里,我们正在连接到 Google Sheets。所有这些东西都一样,C dance 工作表,但这次的操作是更新单行。所以,它必须首先找到我要更新哪一行。所以,你手动映射每一列,我们匹配 ID。所以,匹配 ID 到我们实际给它的 ID。所以,这个 ID,然后我们正在更改最终输出,即 JSON.vide URL。然后它会给你那个 URL。然后,如果我们现在去这里,我们可以点击最终输出,然后它就会自动下载,就像这样。现在,当你打开它时,它在另一个屏幕上,但我会把它移过来。它基本上是相同的。嗯,这就是视频。搞定。所以,设置这些类型的流程就是这么简单直接。所以,我之前谈到的增强功能,我将再次简要介绍一下,是一个配音节点。所以,我认为,例如,那个视频可能会更好,如果有一个小故事时间的东西。所以,就像有人在告诉你有趣的知识或故事,你可以在这里用配音节点做到,而不是生成声音。所以,如果我们进来这里,我们有生成声音。所以,这是提示,对吧?而不是这个提示,你可以更改提示代理和想法代理,最终在这里,从获取剪辑到生成这个音频,然后你可以使用这个而不是这三个来生成故事配音,并将它们添加进去,这可能很酷。另一个是假设循环验证,你可以添加它,基本上我认为可能在想法生成之后,以确保它有效,然后在提示生成之后,甚至在剪辑生成之后。所以,有很多地方可以这样做,但本质上是你想确保它看起来不错。如果你愿意,你知道,浪费一美元来运行整个过程,因为你认为它会没问题,那么你可能把它放在,你知道,在最后,就在你尝试上传它之前,或者之类的。或者你可以,你知道,在这里切断它。所以,这可以是两个不同的。所以,你可以像这样创建想法,然后只有当你喜欢这里的想法时,你才能触发这个。这样的事情可能也很酷。所以,有很多不同的想法,但本质上,下一步是实际上传这个视频。所以,目前在 NA10 上,我正在构建这个终极社交媒体发布器,它基本上获取一个单一的视频 URL,就像上一个视频的结尾一样。爱你。再见。然后它会获取视频,然后它会发布到所有这些平台上,对吧?所以,它是 TikTok,Instagram,所有这些。然后我们有 YouTube,LinkedIn,Twitter,和 Facebook。所以,目前我正在努力确保所有这些都完美运行,对吧?所以,如果它真的不起作用,我不想把它发布出去。嗯,但如果你想在别人之前得到它,来加入 AI Automation Pro,因为我将在这里首先发布它,这样人们就可以尝试一下,看看效果如何。嗯,然后如果你只是想要这个视频的模板,来 AI Automation Hub,并在这里与人们交谈。这也是,你知道,一个大型社区。我们有 700 多名成员,这很酷,因为我只有几周或一个月的时间。嗯,但是的,非常酷。所以,我希望你喜欢。如果你喜欢,请点赞,评论,订阅,我期待在 EI Automation Pro 见到你。