📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Never Hit Your Claude Usage Limit Again (save money)

AI Edge17:04

Transcription

让我们坦诚相待。Claude 的使用限制实在太糟糕了。我相信你也有同感。你正沉浸在一次 Claude 的提示词会话中,突然之间,“砰”的一声,你达到了使用上限。而且,无论你是使用 20 美元的套餐、100 美元的套餐,甚至是 200 美元的套餐(我就是用的这个),似乎都存在这个问题。直到 3 周前,我还在使用 200 美元的套餐时遇到速率限制。而且这仅仅是在进行了大约一小时的 Claude 代码会话之后发生的。于是,我开始质疑,这到底是怎么回事?我开始深入研究 Claude 的实际工作原理。我发现我使用 Claude 的方式是错误的。从那时起,在过去的 3 周里,我没有遇到过一次 Claude 的使用限制。而我实际上每天使用 Claude 6 小时。所以,在今天的视频中,我将向你展示我的完整框架,让你再也不会达到 Claude 的使用限制。观看完这个视频后,你将能够从你的 Claude 订阅中提取最大价值。而且,我还没有听到任何其他创作者谈论过其中的一些技巧。如果你不知道我是谁,我是 Mars Deutsche。我今年 25 岁,自从三年前 ChachiBT 首次推出以来,我就一直在使用它。从那时起,我一直在深入研究人工智能领域,并利用人工智能帮助我的代理业务实现了超过 2000 万美元的收入,以及我的数字产品业务实现了超过 500 万美元的利润。作为一名人工智能爱好者,我创建了这个频道,希望能与你分享我的学习心得。所以,希望你也能利用人工智能来实现你的目标。

好了,要避免再次达到 Claude 限制的第一步,完全在于你的工作流程。一个非常简单的改进方法是,在提示 Claude 时要有明确的意图。大多数人是在与 Claude 交谈时才弄清楚自己想要什么。虽然它是一个很棒的头脑风暴伙伴,但不要用最强大的模型,比如 Opus 4.7,来进行头脑风暴。在使用 Claude 之前,请务必先认真思考你的提示词。或者,如果你必须与 Claude 进行头脑风暴,只需使用一个更便宜的模型,我们稍后会在视频中介绍。模型选择是一个大多数人忽略的巨大技巧。如果你只是使用默认模型,那很可能就是你最大的问题之一。

接下来你需要了解 Claude 的实际工作原理。某些任务会消耗更多的 token。例如,如果我只是和 Claude 聊天,“嘿 Claude,你好吗?”并问它一些问题,来回交流。这实际上并没有消耗多少 token。当你开始遇到 token 问题时,是因为 Claude 需要构建某些东西。所以,如果你在创建一幅画,如果你在编写代码,如果你在创建一个仪表板,那就会消耗大量 token。所以,在构建任何东西之前,进行更多的规划会更好。这样可以来回确认构建是否正确。假设你在构建一个财务仪表板。在实际构建之前,来回确认书面架构是否完全正确,因为重新构建仪表板会比仅仅谈论构建仪表板消耗更多的 token。这对我来说是一个重大的学习。所以,每当我构建东西时,我总是会提前规划。如果你是一名程序员,你实际上可以专门进入 Claude 代码,然后点击“计划模式”。默认情况下,这将不生成任何代码,只专注于计划。所以,如果你在 Claude 代码上构建东西,先进入计划模式,在你实际编写代码之前完成所有计划,这将为你节省大量 token。所以,仅仅是理解 token 是如何被消耗的,这种简单的思维转变就会带来很大的不同。

好了,现在让我们来谈谈一个主要的“游戏规则改变者”。聊天长度。冗长的聊天是一个隐形的杀手。如果你使用一个聊天,并一直与它交谈,你必须了解 Claude 的工作原理。它需要不断地去抓取数千条之前的消息,以理解提供响应所需的上下文。所以,我更喜欢做的是设置项目。例如,我有一个用于这个 YouTube 频道“AI Edge”的项目。每次我开始一项新任务,比如视频分析或新的视频脚本,我都会打开一个全新的聊天。这样,Claude 在理解上下文时消耗的 token 就更少。你在这里可以做的另一个非常强大的事情是,在你的项目文件夹中,放入你的记忆和指令。所以,明确告诉 Claude 这些聊天的目的。例如,对于 AI Edge,它有关于 AI Edge 是什么、我的业务目标、我的频道目标的记忆。然后,在指令中,我确切地告诉 Claude 我想要什么,以及我希望它如何格式化其回答。这里有一个技巧。如果你真的想从每个套餐中提取最大价值,你可以在指令中写下类似“注意响应长度”。尝试以简洁的方式说话。尝试以高效的方式行事。如果你只是将这些写进你的指令中,你在该项目中的响应默认情况下会更短,从而节省 token。哦,对了,为了让你记住所有这些信息,在下面的描述中有一个免费链接,其中包含此视频中的所有技巧,并以单个 PDF 的形式提供,然后你可以将其放入 Claude 以帮助它配置你的聊天。所以,你只需通过描述中的链接领取,注册 AI 邮件列表,即可解锁其中包含 Google Drive 中资源的 Instagram。

所以,总结一下聊天设置,我会这样说。三个高度集中的聊天胜过一个长聊天,每天都是如此,如果你正确设置了记忆。我已经谈论了项目文件夹本身的记忆系统,如果你只是使用聊天。你可能想考虑的一个事情,我在我的“第二大脑”视频中已经详细介绍过,那就是设置自定义记忆,因为你必须明白,如果你只是使用聊天,你对 Claude 保存的记忆没有完全的控制权。它本质上是一个黑箱。是的,它确实在更新记忆,但你不知道它具体更新了什么以及如何更新。所以,最好的解决方法是,在你的电脑上创建一个本地文件夹,比如你的“AI 大脑”文件夹,它存储你所有的本地记忆。所以,在一个文件夹里,你想这样配置它。有一个 instructions.md 文件,其中包含 Claude 需要遵循的指令。你会注意到这里有一行非常重要的内容。每当在会话中出现新信息时,必须更新相关的 md 文件。不要让事实溜走。这一点非常重要,因为指令实际上让记忆自动更新,因为没有这一点,Claude 在实际添加到记忆文件中的内容方面非常随机。如果你在指令中有这样一行,就意味着记忆在不断更新。不用担心,因为在下面的免费指南中,我将为你提供一个精确的提示,以正确的方式设置你的记忆和文件夹系统。如果你想稍后观看关于此的专门视频,我有一个关于我的“第二大脑”指南的视频,它也将此与 Obsidian 连接起来。但就目前而言,你只需要知道你需要一个指令文件和一个记忆 md 文件。然后,如果你回到 Claude 并利用 co-work,co-work 的好处是你可以在一个特定的文件夹内工作。所以,我可以选择我的“AI 大脑”文件夹,每次我在 co-work 中输入与该文件夹相关的提示词时,它都会利用该文件夹的指令和所有特定记忆。它的好处是你实际上拥有自己的记忆文件夹,它不在 Claude 的黑箱里。所以,如果你将来想切换模型,或者想将其插入另一个工具,你实际上拥有自己的记忆。我个人认为记忆主权,即拥有自己的记忆,是人工智能中最重要的事情,因为记忆是可移植的。如果你拥有你的记忆,你将成为一个非常有效的人工智能用户。我发现那些在人工智能方面效率不高的人,他们不拥有自己的记忆,也没有建立相应的系统来更新记忆。好处是它非常简单,而且我实际上开发了一个提示来为你节省时间。

好了,这是第一层,你的工作流程。让我们来谈谈第二层,这一点非常重要,而且我看到足够多的人这样做。这是模型堆叠。如果你使用 Opus 4.7,也就是最昂贵的模型来提问、进行基本抓取和基本研究,你只是在浪费 token。还有其他模型在这些基本任务上具有 90% 的能力,你可以默认使用它们,然后只在真正需要智能模型发挥作用的工作中使用 Opus 4.7。我来给你演示一下。所以,如果你在 Claude 上创建一个新聊天,你可以选择你的模型。所以,Opus 4.7 显然是最智能的。所以,如果我要做一个重大的商业决策,如果我要编写一个财务仪表板,如果我要分析非常重要的数据,当然,是的,我仍然会使用我第一步展示的框架。然而,其他模型仍然相当不错,特别是 Sonnet。Sonnet 对于大多数实际工作来说都很棒。如果你在分析 PDF,如果你想更新一些文本,如果你想写点东西,在我看来,Sonnet 非常棒。而 Haiku 对于快速任务,比如提取数据、抓取,仍然相当有能力。可能有一些使用 OpenClaw 的人正在观看这个视频。我也用。对于某些工作流程,Haiku 是一个非常快速便捷的数据抓取方式。我的做法是,我使用更便宜的模型来进行抓取,进行重复性任务。然后,我将 Opus 4.7 作为我的策展人。它是整合这些其他模型研究的模型。如果你不使用 OpenClaw,你仍然可以通过在 Claude 本身的桌面应用程序中实现这一策略,只需注意你正在使用的模型,如果你认为任务不那么重要或稍微简单,就使用 Sonnet 4.6,然后在任务稍微复杂时手动切换到 Opus 4.7。在 Claude 代码上也是如此。如果你是一名程序员,这一点需要非常注意。实际上有一个你可以选择的“努力程度”。如果你选择“极高”或“最大”,你将消耗大量 token。是的,你会得到更好的结果,但假设你只使用 Claude 代码来更新本地文件夹。你不需要“最大努力”。在某些情况下,你可以使用“中等”甚至“低”。我只会在你真的需要精确度和输出的任务中使用“极高”或“最大”努力。在 Claude 代码中,就像聊天一样,它允许你选择模型。现在,我不会撒谎,Opus 4.7 比其他模型好得多,但如果你需要快速构建一些东西,比如一个小型仪表板或一个界面或一个网站门户或一些相对容易的东西,你不需要使用它。我只会优先将其用于更高级的用例。而且现实情况是,你不需要只使用 Claude。我在我的 OpenClaw 上使用 Quen 和 Kimmy。我使用 Grock 进行实时新闻,它内置于我的 X 订阅中。我也使用 Gemini,它内置于我的 Google 订阅中。你不需要只使用 Claude。所以,只需注意你何时使用模型。如果你真的遇到问题,并且假设你使用的是较低的套餐,请确保你将 Claude 用于你需要它的工作。了解 Claude 的优势所在。它在交互式仪表板和编码方面确实表现出色。但如果你只需要一点新闻,你可以使用 Grock。你可以使用另一个更便宜的模型。你甚至可以使用 GPT 进行语音提示和头脑风暴。我一直这样做。然后,我将 Claude 作为我的策展人,因为我知道它的优势。所以,只需了解每个模型的优势,并在你的工作流程中结合使用多个模型。我实际上制作了一个关于工具的视频,其中我分解了我对我的七个顶级 AI 模型的使用情况,并在该视频中分解了每个模型的优势。我认为这也是我能够减少 token 支出的一些原因,因为我开始在某些方面依赖其他模型,而这些模型确实表现出色。因为虽然 Claude 很棒,但其他模型在某些方面做得更好。所以,下次你执行任务时,请记住这一点。

好了,现在你已经了解了第二步,即为你的用例选择正确的模型。让我们来谈谈一个被低估的东西,工具拆分。重要的是要理解,虽然 Claude 是一个应用程序,但它不仅仅是一个产品。你有聊天、你有 co-work 和 Claude 代码。你需要分别对待它们。你甚至还有像 Claude design 这样的额外产品,它有自己单独的使用限制。现在,Claude 将 Claude 代码和 Claude 聊天的 token 限制视为相同,而设计是分开的。但在这里,你需要了解你是一个什么样的用户,因为如果你是一个重度的 Claude 代码用户,并且你通过 Claude 代码消耗了你的整体套餐,那么你可以做的是将 API 连接到 Claude 代码。它将通过 API 单独运行。你需要去 Anthropic 的网站的 API 部分创建一个。然后,这现在将与你的聊天分开。如果你是一个普通用户,只偶尔使用 Claude 代码,那么你可以将其包含在你的主套餐中。我唯一要敦促的是,你去 claude.ai/settings/usage 看看你的使用情况。所以,只是意识到你的限制在哪里。例如,我现在已经使用了所有模型的 12%,它将在周五上午 9 点重置。所以我一切都好。但我已经用完了 Claude design,因为我昨天在上面疯狂使用,这是一个完全不同的主题,因为 Claude design 的使用量非常大。现在,如果我想要更多的 Claude design token,我实际上需要进去购买按使用量付费的积分,他们称之为 Claude design 的积分。这也是一种策略,而不是让你不得不升级你的整个套餐,如果你注意到你将在 24 小时内达到你的限制,而你只需要再进行几次提示,你就可以购买更多的使用积分,而不是升级并花费额外的 100 美元,从 100 美元升级到 200 美元。你可能只需要,你知道,5 到 10 美元额外的积分来让你度过难关。所以,claw.ai/upgrade。这将允许你管理你的套餐。所以,只是意识到这一点我认为很重要,并且实际上检查你的限制,这样你就不会在事情发生时措手不及,这也可以改变你的行为。如果你注意到你已经使用了 75%,并且明天工作需要该模型,那么也许你知道,你不会在前一天晚上疯狂地编码应用程序。我认为这种意识是关键,虽然这很烦人,但我认为很多人都忽略了这一点。

不幸的是,Claude 在限制方面实际上变得越来越吝啬。这是一个留待以后讨论的话题,但能源和计算对他们来说是一个真正的问题。这就是为什么我们在过去一个月左右的时间里看到 Claude 的性能有所下降。你可能已经注意到,在某些情况下,Claude 变得更笨了。虽然新模型很棒,比如 4.7,但它也非常消耗资源。他们甚至采取了进一步的措施。现在,正如你在专业套餐中看到的,你不再能访问 Claude 代码。你只能从每月 100 美元的套餐或每月 200 美元的套餐中获得 Claude 代码套餐。所以,17 美元的订阅用户不再能访问 Claude 代码。我有点理解他们为什么这样做。他们显然是在赌,那些想使用 Claude 代码的认真用户愿意支付 100 美元或更多,并且他们需要在某个地方节省能源。所以,他们宁愿,你知道,将专业用户排除在外。但这仍然很糟糕。这只是我们必须接受的关于人工智能现状的事情。价格不会变好。只会变得更糟。所以,我认为像这样的视频实际上可能是今年最重要的视频之一。这样你就可以长期省钱,因为这个问题只会变得更糟。你现在需要调整你的使用习惯,除非你有很多钱可以烧,因为这些功能只会变得更加受限。我的意思是,我们已经看到了像 Claude design 这样令人惊叹的功能。普通人负担不起。我在一个 12 小时的会话中用完了我整个套餐。如果我现在想继续使用它,如果我想认真使用它,我可能每天要花费 50 到 100 美元。所以,这是一个问题。如果你预算有限,你可能需要重新考虑,正如我在上一步提到的,你实际使用的工具。如果你确实使用像 Hermes agent 或 OpenClaw 这样的界面,你可能甚至会考虑运行本地源代码模型。如果你想预先投资硬件,比如一台可以实际运行本地模型的坚固的 Mac Studio,那么你就是在你的电脑上运行一个开源模型,然后你实际上没有支付订阅费,但你必须承担前期的硬件成本。所以,你的架构将取决于你想从人工智能中获得什么。但我认为现在我们确实需要意识到我们的订阅钱花在了哪里。我仍然认为 Claude 是总体上最好的订阅,但我认为由于我们正在经历的巨额成本问题,它不再适用于所有事情。我认为拥有其他订阅,甚至利用其他免费工具来分摊负载是很好的。

现在,我想给你一个我最大的技巧之一。如果你真的想节省使用成本,如果你有重复性的任务,如果你每天或每周都会做一些事情,只需为它们创建 Claude 技能。前期需要一些工作,但这样你就可以输入斜杠,然后选择一个技能,例如,“创意会话”,它现在会加载我每天遵循的“晨报”技能。所以,我预先完成了工作。我训练了 Claude 做某事,成为我的晨报助手。现在,每当我想要进行晨报会话时,我只需输入技能。你也可以为脚本写作做同样的事情。你可以训练一个 Claude 技能来像你一样写作。你也可以为投资组合分析做同样的事情。你可以训练 Claude 按照你想要的方式,使用你想要的精确参数来分析投资组合。这之所以能随着时间的推移节省 token,是因为 Claude 确切地知道该做什么。你不会不断地纠正它和重新提示,而这正是消耗 token 的原因。所以我实际上有一个关于 Claude 技能的完整指南,如何从头开始开发技能。如果你想查看,我会将其放在顶部角落。这是 Claude 的另一个功能,你可以利用它来显著减少你的 token 消耗。

现在,假设你已经做了我今天视频中告诉你的所有事情,但仍然遇到使用限制。让我们坦诚相待。也许这意味着你需要升级你的订阅。现在,如果你还没有实施我今天讲过的任何内容,我认为你不需要直接升级到 200 美元的套餐。但如果你已经实施了,并且仍然遇到问题,你可能只是一个人工智能的重度用户,而这正是目前使用人工智能的成本。所以,如果你真的想使用 Claude,如果你喜欢 Claude 代码,如果你喜欢 Claude Co-work,并且你仍然在 17 美元的套餐上遇到问题,你可能需要升级到 100 美元的套餐。如果你仍然遇到问题,就像我在 100 美元的套餐上一样,你可能需要升级到 200 美元的套餐。这只是目前的游戏规则,不幸的是。当然,正如我所说,你可以使用其他模型来减轻一些负担。但如果你是 Claude 的重度用户,这只是目前使用世界上最好的前沿模型的成本。不过,我想说的是,如果你还没有优化,不要直接跳到最高套餐。先优化,然后再考虑升级套餐。这显然是最好的方法。如果你想将我今天视频中的所有技巧浓缩成一个框架,请务必使用下面的描述中的链接来领取你的免费 PDF。它将包含所有技巧和窍门,包括用于高效指令和记忆系统的设置提示。感谢大家今天的时间。希望我能够帮助你,为你节省一些钱,并帮助你从你的 Claude 中提取更多价值。我将在下一期视频中见到你。祝你度过愉快的一天。再见。