📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

ChatGPT vs Claude vs Gemini: The Best AI for Each Use Case in 2025

Peter Yang21:18

Transcription

大家好。今天我想分享一个超级实用的指南,介绍按用例划分的最佳人工智能模型。在这段视频中,我将对 ChatGPT、Claude 和 Gemini 进行正面较量,测试它们在编码、写作、深度研究、多模态和其他用例方面的表现。正如您在此表格中看到的,这三个模型在不同方面都表现出色。但不要只听我的一面之词。现在让我们快速演示一下。

好的,让我们开始编码。所以,我要求每个模型创建一个功能齐全的俄罗斯方块游戏,并带有精美的图形和控件。让我们来看看每个模型都做了什么。

让我们从 Claude 开始。这是 Claude,我们打开俄罗斯方块游戏。您可以看到 Claude 构建了一个功能齐全、精美的游戏,包含分数、预览和出色的控件。让我们确保一切正常。让我们尝试完成一行。好吧,我需要提高我的俄罗斯方块技能。看起来很棒。

这就是 Claude,它几乎是一次性完成的。再说一遍,我只是要求它创建一个功能齐全的俄罗斯方块版本,并带有精美的图形和控件。

现在让我们来看看 ChatGPT。好的,我使用的是 chat03,这是 ChatGPT 中最好的推理模型。让我们打开画布看看这个游戏是什么样的。我打开画布。您需要点击预览才能看到它运行。您可以看到游戏可以运行,但它远不如 Claude 的版本功能齐全。

最后但同样重要的是,让我们来看看 Gemini。我使用了完全相同的提示。使用 Gemini 2.5 Pro。这是 Gemini 制作的游戏。让我们按开始。是的,游戏运行得很好。虽然视觉效果不如 Claude 精致,但也很接近了。

所以,我认为根据这次测试,Claude 在编码方面是最好的。在这种情况下,我想使用 Claude Sonnet 而不是 Opus,后者更好。

好了,因为编码很有趣,让我们再做一个测试,对吧?这次我要求每个模型创建一个 3D 交互式太阳系,让我们看看每个模型都做了什么。

让我们再次从 Claude 开始。好的,再次提示是构建一个精美的 3D 太阳系模拟器,使其尽可能逼真和交互。您可以看到 Claude 创建了一个相当出色的模拟器。行星有点暗,但我可以控制速度。我可以控制比例。更重要的是,如果我点击太阳或不同的行星,它会告诉我关于每个太阳或每个行星的信息。对吧?这是一个相当出色的教育工具,我可以和我的孩子一起探索,了解太阳系。

好了。现在,让我们来看看 ChatGPT。不幸的是,对于 ChatGPT,我无法让它真正运行。即使要求它修复错误。让我们尝试打开画布。并预览,不幸的是它不起作用。所以,在这种情况下,ChatGPT 似乎并没有真正构建太阳系。

现在让我们试试 Gemini。Gemini 成功构建了一个太阳系,像土星这样的行星看起来确实很棒,有光环,但行星太小了。我几乎看不到它们。也许这是太阳系实际样子的真实视图。行星分布得很开,但对于教育来说并不好。有点太小了。而且有些行星没有任何信息面板之类的东西。

所以,再次,在这种情况下,我认为 Claude 是赢家。

让我们继续,对吧?我真的想看看 Claude,特别是 Claude Opus 的能力。所以我要求它构建原始超级马里奥游戏的第一个关卡。不确定您是否够老,能在原始任天堂系统上玩过这款游戏,但这是我童年最美好的回忆之一。

所以,让我们打开这个。我所做的是创建了 2D 横向卷轴马里奥风格平台游戏的第一关。给它一些指示。我还附上了一张我在谷歌搜索中找到的关于超级马里奥第一关地图的图片。

所以,这需要几次来回。我不得不要求它让马里奥和 Goombas 看起来更好,因为一开始它只是一堆方块。我要求它改变地板并给出一些指示,例如,它制作了一个我只能看到马里奥一半而不是整个角色的东西。我还要求它根据这张图片移动旗帜的位置,甚至添加一个蘑菇。

好了,现在让我们继续玩游戏。这次来回可能花了大约 10 到 15 分钟。但令人难以置信的是,正如您在这里看到的,它实际上制作了一个相当令人难以置信的超级马里奥第一关的复制品。我刚吃了蘑菇。我变大了。有 Goombas 在四处走动。我可以继续前进。我可以跳到 Goombas 上。我甚至可以打破方块。虽然它一次性打破了整个方块。我可以继续前进。是的,如果我的记忆没错,这是马里奥第一关的相当准确的表示。让我们继续。让我们一直走到旗帜。

好了,我们到了旗帜。好了。关卡完成。我还无法让旗帜动画化,但我相信再多一些提示,我就可以让它全部正常工作。这真是太令人印象深刻了,对吧?我甚至没有使用光标或任何那些快速编码工具。我只是在 Claude 本身中构建这个。

所以,Claude 构建了一个实际可玩的关卡,包含蘑菇、Goombas 和工作的物理效果,这真是太不可思议了。所以,如果您有 Claude 4,一定要尝试制作这样的东西。也许制作 2D 塞尔达,或者制作像 F-Zero 这样的复古游戏。玩得开心。

好的,但让我们回到我们的幻灯片。我们已经证明 Claude 是目前最好的编码模型。但这里有一个问题。Claude 的价格几乎是 Gemini 2.5 Flash 的 20 倍,对吧?所以您可以看到 Claude 的价格是 3 美元,而 Gemini 2.5 Flash 只需 15 美元。所以,如果成本是您构建 AI 产品时的考虑因素,我个人认为您选择 Gemini 不会错。它不如 Claude 好,但在很多情况下已经足够了。此外,Gemini 的上下文窗口比 Claude 或 ChatGPT 都大。

好了,我想我猜如果您想要最好的编码模型,就选择 Claude;如果您想要最好的价格/性能比来编码,就选择 Gemini。

好了。我还想向您展示一些 Google 最近在做的事情。我对我最近的 IO 大会印象深刻,他们推出了似乎是 100 种不同的 AI 功能。我提前获得早期访问权限的最令人印象深刻的功能之一是 Gemini Fusion。令人印象深刻的是,它让快速编码感觉几乎是即时的。所以,让我现在给您一个快速演示。

好的,Gemini Fusion 基本上可以让您闪电般地编码并闪电般地创建应用程序。所以,让我们快速运行一下。对吧?我将要求它创建一个打砖块游戏。让图形看起来很棒,并在完成时让砖块碎成粒子。

好了。您可以看到在几秒钟内,它就制作了打砖块游戏,而且似乎运行得很好。您将无法让这个模型构建超级马里奥。但对于简单的应用程序和简单的游戏来说,以惊人的闪电般的速度构建这些东西并快速迭代,这是一种很棒的感觉。

好的,编码就到这里。所以,TRDR(太长不读):选择 Claude 4 作为最好的编码模型,如果成本是考虑因素,则选择 Gemini 2.5。

好了,让我们继续讨论写作,这实际上是我最常见的 AI 用例。我有一个提示,我用它来要求 AI 编辑我的新闻通讯文章。让我向您展示这个提示。它基本上有一堆预先的说明,最重要的是,它包含了我过去写过的最好的新闻通讯文章的示例。这样 AI 就可以理解我的写作风格,并用它来编辑草稿文章。

这是我创建的一篇草稿文章。它基本上是一大段文字。另一个技巧是,如今我经常通过语音听写来创建写作的初稿,因为说出您的想法比盯着空白页面要快得多。但基本上,这是一篇草稿文章,然后让我们使用我的提示来看看三个不同模型的输出。

对吧?让我们再次从 Claude 开始。好的。我所做的是粘贴了我的提示,首先我要求 Claude 分析我的写作风格,这是我的一些风格总结,然后我粘贴了我的大段文字草稿文章,这是 Claude 的编辑,您可以看到它在保持我喜欢的风格方面做得相当出色。我总是以“亲爱的订阅者”开头我的文章,今天我们将讨论这个,Claude 做得很好。它添加了章节标题。它保持了我喜欢的简短段落和简洁的风格。

这就是 Claude,这相当不错,对吧?

现在让我们来看看 ChatGPT。所以,我再次做了同样的事情。我给了它我的提示,然后给了它我的草稿文章。ChatGPT 做得还不错。例如,对于介绍,它基本上将所有内容缩减为两句话,对吧?两三句话。我几乎从不写那么短的介绍。它肯定比那长得多。是的,我认为总的来说,这篇文章感觉有点太短了。它不像我最初的草稿那样有分量。

现在,让我们来看看 Gemini。同样的流程。这是 Gemini 的文章。我认为 Gemini 有与 ChatGPT 相反的问题。文章有点太长了。我认为它深入了很多细节,而且其中一些写作并不一定接近我的风格。例如,我真的不说,“大家好,您的名字在这里或 Peter 在这里。”这很奇怪,对吧?

所以对我来说,Claude 仍然是我的日常主力,因为它比任何其他模型都能更一致地捕捉我的写作风格。写作和编辑是我迄今为止最常见的 AI 用例。无论是编辑新闻通讯文章、编辑 PRD,还是只是编辑一个简短的段落,对吧?所以,对我来说,尤其是如果您给 Claude 提供示例,它最擅长密切遵循您的风格。

好了。到目前为止,我们一直在对 Claude 和 Gemini 大加赞赏。但让我们给 ChatGPT 应得的赞誉。所有三个模型都能够回答日常问题。但 ChatGPT 有一个其他模型没有的功能。记忆。记忆是一种神奇的体验。它带来魔法。例如,ChatGPT 实际上会建议我应该问什么。例如,我即将去法国旅行,ChatGPT 实际上建议我询问法国南部最好的旅游地点。它在帮助您进行内省、发现隐藏的才能和盲点方面也非常出色。

所以,尝试这样的提示。告诉我一些关于我的特别或独特之处,但我自己还没有意识到。不一定是积极的。不一定要好听。只要真实。尝试在 ChatGPT 中输入类似内容,特别是如果您经常使用 ChatGPT。它给出的答案可能会非常惊人。

如果您想更进一步,可以尝试给 ChatGPT 这个提示,让它成为一个极其诚实的顾问。基本上,就像,我想让你扮演我极其诚实的顾问。以一个拥有巨大潜力但也有很多盲点的人的身份与我交谈。对我来说,超级诚实和直率。当我将这个提示输入 ChatGPT 时,它告诉我我在优先排序方面很糟糕,并且试图一次做太多事情,从而限制了我在任何事情上的潜力。它可能会告诉你完全不同的东西。我曾收到过人们的信息,告诉我这个提示对他们来说是一个警钟。我在视频描述中提供了一个链接,其中包含完整的提示,您可以复制粘贴。所以,一定要看看,看看 ChatGPT 是否能给您一些痛苦的觉醒或极其诚实的建议。

好了,现在让我们继续讨论深度研究。现在每个提供商都提供深度研究功能。我用这个提示测试了每个模型。研究 AI 编码市场并分享 Bolt 的竞争策略。Bolt 是我非常喜欢的 AI 原型工具。

让我们先打开 Claude。我认为 Claude 的深度研究仍然只对支付 100 美元以上高级套餐的人可用。但基本上,这是我的提示。为 Bolt 在 AI 编码领域竞争制定策略。这里有一些需要注意的事项,让我们来看看。

它花了七分钟研究了 427 个来源。我认为这是迄今为止任何深度研究查看过的最多来源。让我们来看看报告。

好了。Claude 的有趣之处在于,尽管它查看了 427 个来源,但报告却出奇地短。也许有七页左右,对吧?但让我们读一下。它说 Bolt 独特的易于使用的界面、强大的技术和早期市场地位为成功奠定了基础,成功需要超越在几分钟内构建应用程序,成为 AI 增强开发的值得信赖的平台。所以这相当模糊。我真的不知道那是什么意思,对吧?Claude 建议的实际策略是什么?

通过 Web 容器实现技术优势。通过透明度和教育建立信任。通过生态系统开发和企业功能创造网络效应。我认为这三个建议中,最后一个可能是我认为最具战略意义的。Bolt 在非技术快速编码领域非常强大,但它需要解决企业化问题,在我看来。这里关于 Bolt 如何做到这一点的内容不多。也许这里有一些东西,总的来说,我觉得这份报告可能有点太短了,对吧?当我进行深度研究时,我想要所有信息。我想要一个观点,但我想要的不仅仅是七页的内容。

现在让我们来看看 Gemini 的报告。Gemini 写了一份长得多的报告。您看,这是一份极其冗长的报告。它还查看了大量不同的来源。我喜欢 Gemini 的地方在于它包含了一些关于市场规模的表格。我认为它在这里有一个关于不同参与者的表格。就在这里。所以,这是一个很好的表格,可以快速浏览所有 Bolt 的竞争对手,他们的策略是什么,他们的主要目标受众是谁,他们在这方面做得相当好,对吧?但让我们看看它是否真的能提供一些关于策略的建议。

所以,我将跳到底部。结论,对吧?Bolt 拥有出色的技术,强大的初步吸引力,尤其是在非开发者和快速编码者群体中。像这样的东西太模糊了,我不知道它对我来说有什么意义。我认为 Gemini 的报告虽然非常全面、非常长。我认为一些结论可以改进,而且对我来说有点过于冗长。

所以,让我们来看看 ChatGPT。再次,相同的提示,它查看了 25 个来源,这是较少的来源,但它进行了一系列搜索。让我们看看,它有主要参与者表格以及他们的关键优势和劣势。让我们看看结论,看看 ChatGPT 得出了什么。

我喜欢 ChatGPT 如何用粗体字和项目符号总结优势,这样易于浏览。所以,速度和结果的魔力,针对产品经理和设计师,非工程师,浏览器技术具有成本优势和集成,如追求集成,我真的很喜欢这个结论,虽然缺少企业战略或安全性方面的内容,但我认为这个结论实际上非常强大,因为速度、针对非技术人员、成本优势和集成正是 Bolt 所做的。我认为这三份深度研究报告中,虽然它们都相当不错,但我的偏好可能是 ChatGPT。

现实情况是,当我得到一份深度研究报告时,我通常会浏览它以了解一些要点和结论。然后,我将整个报告上传到一个 AI 项目中,以便我可以提问。这样,如果我要求 AI 生成另一份文档,它就可以将深度研究作为参考。我认为再次,在我看来,ChatGPT 是最好的折中方案。Claude 有点太短,Gemini 有点太长,而 ChatGPT 实际上根据其研究提出了具体的战略建议。我认为 ChatGPT 是这里的赢家。

我们在这一点上有点超长了,但深度研究实际上非常重要。它可能是 AI 中除了编码之外最通用的东西了,我强烈鼓励大家尝试一下。

好了,现在让我们来谈谈一些 AI 多模态功能。对于图像生成,我的首选仍然是 ChatGPT。它非常适合生成营销素材、家庭照片等。特别是如果您给它您想要的风格示例,对吧?所以,粘贴一些营销素材风格的示例,并要求它调整文本或替换图像,它在这方面做得相当出色。

对于语音,我认为 ChatGPT 是这里的赢家。再次,它最具个性,也最完善。您知道大多数人没有意识到的是,ChatGPT 的语音现在可以唱歌了。但有趣的是,它唱得很糟糕。

对于视频,我认为 Gemini 是迄今为止的赢家,V3。能够从文本生成带有声音的视频真是令人难以置信。而且每个拥有 Gemini Pro 的人每月至少有 10 次视频生成机会。所以我强烈建议您尝试一下。如果您付费,您可以生成一些相当令人惊叹的短片和片段。

最后但同样重要的是,实时摄像头和计算机使用仍然是 AI 模型早期功能。实时摄像头基本上意味着 AI 可以看到您计算机上发生的事情。我更喜欢 Gemini。您必须访问 Gemini AI Studio 才能使用它。但例如,您可以打开实时摄像头进行快速编码,然后您可以要求 AI 查看是否有任何错误或问题,对吧?

计算机使用意味着 AI 可以通过导航键盘和鼠标为您在计算机上执行操作。在这方面,我更喜欢 OpenAI 的 Operator,因为它使用了 03,我认为这是最好的推理模型。所以您可以使用它来查找旅行信息,您可以使用它来预订餐厅。再次,这些功能都还处于早期阶段,但对于实时摄像头,我更喜欢 Gemini;对于计算机使用,我更喜欢 ChatGPT。

好了,就是这样。所以,让我们总结一下。所以,在我看来,Claude 在编辑、写作和编码方面是最好的,这就是为什么它仍然是我的日常主力模型。ChatGPT 因其记忆功能而非常擅长提供个性化答案。它还在深度研究、推理、图像生成和语音聊天方面表现出色。Gemini 在过去几个月里有了很大的改进。我认为如果您看重成本,它是一个很棒的编码模型,而且它的视频生成功能令人惊叹,是同类产品中的佼佼者。

我在这段视频中根本没有提到 Grok。它们有很多功能,但在我看来,它们在任何方面都不是顶级的。但也许它们会在下一次更新中给我们带来惊喜。就个人而言,我仍然为 Claude 和 ChatGPT 付费,偶尔也会尝试 Gemini。但老实说,这里的所有三个模型,ChatGPT、Claude 和 Gemini 都很棒。您选择哪个都不会错。

好了,就是这样。这就是我对目前每个实用用例的最佳模型的分析。如果您觉得这段视频有用,请点赞并订阅,我会制作更多这样的内容。很快再见。