📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

How OpenClaw's Creator Uses AI to Run His Life in 40 Minutes | Peter Steinberger

Peter Yang37:44

Transcription

这就像在你的电脑里住着一个新奇特的朋友,他非常聪明且足智多谋。我当时还在摩洛哥,有人给我发了一条关于一个 bug 的推文,我直接拍了推文的照片,发到了 WhatsApp 上。它读了那条推文,理解了有 bug。它检查了 Git 仓库,修复了 bug,提交了代码,然后回复了推特上那个人说已经修好了。这将会淘汰你手机上大约 80% 的应用程序。当我有一个无限足智多谋的助手,它已经知道我正在做糟糕的决定,并且我正在吃肯德基时,我为什么要用我的健身追踪器来记录食物呢?那些东西太足智多谋了,虽然方式有点吓人。这就像是解放了的 JGBT。很多人没有意识到,如果你给一个人工智能访问你电脑的权限,它们基本上可以做你所能做的一切。>> 好的,欢迎大家。我今天的嘉宾是 Peter,Claude 的创造者,一个你可以直接在你的消息应用中聊天的 AI 助手,来完成事情。今天 Peter 将向我们展示如何使用 Claude。Peter 对 AI 编码也有很多非常棒的观点,我非常期待深入探讨。所以,欢迎另一位 Peter。>> Peter,谢谢你的邀请。>> 很高兴见到你。那么,我们先从谈论 Claude 开始吧。从宏观层面来看,Claude 到底做什么?为什么它是一个龙虾?[笑声]>> 是的。所以,也许我有一个小小的背景故事,就像我从退休回来的时候,姑且这么说吧。我当时想找一种方法,可以从手机上查看我的电脑,因为我完全投入到了这个“远程办公”的趋势中,然后你知道,你的代理可能运行半个小时,而你正在吃饭,或者它们在 2 分钟后就停止了,因为它们有另一个问题,然后你回去,你会觉得很烦。但我当时没有构建它,因为我假设所有的大型实验室都会这样做。这感觉是一个显而易见的事情。>> 就像一种全新的操作系统一样。但它没有发生,然后到了十一月,它仍然没有发生。我想好吧,我来尝试一些小东西,而那个小东西基本上就是将 WhatsApp 连接到 Claude 代码。所以,你发送一条 WhatsApp 消息,它会直接打开二进制文件,用提示词,然后返回给你这个东西,非常简单,一个小时就建好了,它就有了自己的生命,现在我们在这里。我想它有 30 万行代码。它支持地球上所有的消息平台。不是所有,但我们正在努力。我认为这就是未来的发展方向。就像每个人都会有一个 AI,它非常强大,并且会伴随他们一生。>> 事实证明,如果你给一个 AI 访问你电脑的权限,它们基本上可以做你在电脑上能做的任何事情。>> 是的。而且它已经发展到你不需要坐在那里监视它的地步了,对吧?你只需要给它一些提示和命令,它就会为你完成工作,然后你可以检查它的工作,然后就这样。你不需要一直盯着电脑。>> 是的。所以当我构建它的时候,我觉得这个项目既是技术探索,也是一种探索,因为它是一个全新的类别。>> 然后我在摩洛哥参加我朋友的生日旅行。>> 我发现我一直在使用这个东西。就像,嘿,我们要去哪里?就像问路或者餐厅的建议,或者我不知道,有一天早上有人给我发了一个关于 bug 的推文,我直接拍了推文的照片发到 WhatsApp 上。它读了推文。它理解了我的一个仓库里有一个 bug。它检查了 git 仓库。它修复了它。它提交了代码,然后回复了推特上那个人说现在已经修好了。我当时想,真的吗?>> 这太棒了。然后有一天我走在路上,我没有同步,我只是发了一条语音消息,你知道的。我没有内置语音消息支持,我当时想,它显示了输入指示。我想,不知道现在发生了什么。然后它就回复了我,好像什么都没发生一样,我当时想,哇,你是怎么做到的?它说,是的,我看到了一个文件,但没有文件扩展名,因为我没有内置。嗯。>> 我查看了文件的头部,它看起来像是一个音频文件格式。所以我找到了你电脑上的 ffmpeg,并将其转换为 wave 格式,然后我寻找 visper.cpp,但你没有安装它,但我找到了这个 OpenAI 密钥,然后我用 curl 将它发送到 OpenAI 的 API,它得到了转录文本,然后我回复了你。我当时想>> 哇>> 太棒了。是的>> 就像那些东西非常足智多谋,虽然方式有点吓人。>> 但对我来说,那一刻是关键,我意识到,哦,是的,这真的很强大。这比在网上使用 JGBT 有趣得多,因为它就像是解放了的 chbt,我认为很多人没有意识到,像 Claude 代码这样的东西,它们不仅仅擅长编程,它们对任何类型的问题都非常足智多谋。>> 是的。你只需要给它访问你电脑的权限,你知道的,并且能够找到东西,对吧?所以,你只需要给它工具,它们就会变得非常足智多谋。>> 是的。所以,在过去的几个月里,我建立了一个我的 CLI 军队,因为代理擅长什么?调用 CLI,因为它们就是为此而训练的。所以我建立了一个访问所有谷歌的 CLI,包括谷歌地点 API。我建立了一个可以轻松查找表情包和 GIF 的工具。所以你也可以用表情包回复。[轻笑]>> 我做了一些实验。我甚至建立了一个可视化声音的工具,因为我想让它体验音乐。>> 这有点偏向艺术方向。我不知道这是否有意义,但总之,这很有趣。就像我有一个完整的列表。我建立了一个工具,它破解了这里的送餐服务。>> 所以它实际上告诉我食物什么时候会到。我建立了一个反向工程了 eight sleep 的 API 的工具,所以它实际上可以控制我床的温度。>> 真的吗?而且,说实话,当你构建所有这些东西时,你只是让 AI 来构建这些东西,还是怎么回事?>> 最有趣的是,我在我以前的公司。>> 我在 iOS 和 Mac OS 方面非常非常擅长,整个苹果生态系统,我做了 20 年,我非常精通。>> 但当我回来的时候,我构建了一个项目,我当时想,我有点厌倦苹果对一切进行限制。>> 而且把它构建成一个网络应用会更有意义,因为它应该在浏览器中,并且应该是可访问的,如果我再次把它构建成一个 Mac 应用,那么能使用它的人就会非常有限。但我看到很多工程师都有这种情况,你在一件事情上非常擅长。>> 然后转向另一项技术就非常痛苦,因为那时你感觉自己就像,抱歉说这个词,像个白痴。并且 [轻笑] 你需要查找每一个小东西,比如什么是 prop,或者如何分割一个数组,因为你理解所有概念,但你不一定知道语法。>> 这就是我从 Objective C 和 Swift 转向 JavaScript 时感受到的。我有点了解 JavaScript,但我从来没有真正用 TypeScript 构建过大型项目。然后,它甚至不是难,而是痛苦,因为你必须查找所有这些东西,而且你非常慢。然后,有了 AI,所有这些都消失了。你仍然可以应用你的系统级思维,你的如何构建和组织大型项目,你的品味,或者说,你依赖于什么。>> 所有这些东西仍然有价值,你可以更容易地将它们从一个领域转移到另一个领域。>> 是的。那感觉就像一种超能力。突然间,我觉得我什么都能建造。语言不再重要了。我的工程思维很重要。>> 是的。因为我一直在担心你这里有没有括号,那里有没有括号,这很无聊,对吧?你不再需要担心这些事情了。>> 本集由 Granola 提供。如果你连续开会,你知道做笔记有多辛苦。[音乐] 现场记录并事后整理。这就是为什么我喜欢 Granola,市场上最好的 AI 会议笔记应用。这是我使用它的方式。Granola 会在会议期间自动做笔记,我也可以添加我自己的笔记。会议结束后,我使用 Granola 的食谱来提取清晰的要点和下一步。>> 以我想要的格式。然后我可以直接在 Slack 中与我的同事分享笔记,甚至让 Granola 自动分享她的笔记。老实说,在我使用的所有 AI 应用中,Granola 是最节省我时间的应用。立即访问 granola.ai/pater 试用,并使用代码 Peter 注册即可获得三个月免费。网址是 granola.ai/pater。现在,回到我们的节目。>> 但是,但是,伙计,让我们回到 Claude,你构建的东西。也许你可以,屏幕共享,也许你可以展示,也许你可以展示人们如何安装这个东西,首先,你需要非常懂技术才能使用 Claude 吗?还是不需要?对吧?你只需要安装它,然后让它工作。>> 是的。嗯,是的,也不是。所以,>> 幸运的是,也可能不幸的是,这个项目吸引了很多对技术不太了解的人,因为>> 它消除了所有这些使它复杂化的层,对吧?你>> 如果你使用 Claude 代码,你在终端工作,你必须考虑上下文空间以及你在哪个文件夹里,以及>> 它感觉非常技术化。就像在 iMessage、WhatsApp 或 Telegram 上与某物交谈一样。你和你的朋友这样做,现在就像在你的电脑里住着一个新奇特的朋友,他非常聪明且足智多谋。>> 是的。>> 这使得整个技术非常容易上手。你不用想,哦,我该选择哪个模型,或者什么。它就是能用。>> 嗯。>> 然后这就是想法。它也有好有坏,因为当然,能力越大,风险也越大,这仍然是一个未解决的问题,这个东西可以访问你的电脑。所以,是的,如果告诉它,我不知道,删除我主目录里的所有文件,它可能会做坏事。它可能会问你确定吗?但如果你一直说“是,是,是”,它很可能会照做,甚至可能会删除它自己并崩溃。[笑声]>> 是的,你得小心点。是的。>> 我让我分享我的屏幕,这样你就可以看到了。所以它是用 TypeScript 写的。>> 嗯。>> 所以它可以在任何地方运行。>> 即使在 Windows 上,你也可以去我们的网站 clogbot。>> 是的。>> 有一个方便的一行命令。看起来很吓人,但所有东西都是开源的,你可以检查一切,包括网站。>> 嗯。>> 所以这是安装它的最简单方法。它可以在 Mac OS Linux 上运行。它也可以在 Windows 上运行。>> 现在是时候打开终端了,然后它就会开始安装。是的。对于那些了解该生态系统的人,你也可以安装 npm。>> 我认为我做的一件事,在很多项目中我都没见过,就是它还有一个可黑客安装。>> 再次,一种简单的方式和一种更手动的方式,你基本上是检出 git 仓库,然后从 git 仓库启动它,说实话,这是最有趣的使用方式,因为如果你的代理可以读取它自己的源代码,它就可以重新配置和重新编程自己,然后重新启动,然后要么崩溃,要么获得新的能力。>> [轻笑]>> 好的。>> 我认为这是我的一个超能力,我让很多人参与到项目中,并给我发送了从未发送过 pull request 的人。>> 我意思是,有时也会显示出来。>> 但我更经常地将 pull request 视为 prompt request。是的。>> 足够理解意图。>> 然后,然后,然后,在我们安装之后,如何将其连接到消息应用?>> 最好的方式可能就是使用这个一行命令,然后它会用一些俏皮的话来迎接你,并尝试配置所有东西。>> 明白了。>> 安装包,然后它会引导你完成整个过程,你只需要连接到任何一个常见的消息应用。好的,看起来不错。它正在工作。是的。然后你可以说 plbot。如果是一个干净的安装,它会自动执行。但现在我必须输入 onboard。>> 明白了。>> 然后基本上你就可以输入一个模型。你可以,哎呀。所有提供商。比如说,我们用一些热带的。可能是新的。然后你可以设置 Telegram、Discord,然后它会引导你完成其余的。你可以设置技能钩子。>> 然后你必须给它你的 Anthropic API 密钥吗?>> 它适用于任何模型。>> 是的。>> 虽然你知道,在行业里,Anthropic 和 Open 算是领先的。>> 嗯。>> 它适用于 API 密钥。它适用于订阅。>> 好的。>> 虽然,虽然我们添加了支持,因为这是大家都在做的事情。>> 是的。但我不认为 Entropic 喜欢了。所以我建议使用 API 密钥或选择另一个模型。>> 有>> 好的。>> 是的。主要问题是 OpenAI 工作得很好,但它没那么有趣。Opus 有一些特别之处,让它非常非常有趣。>> 哦,是的。就像,就像个性。>> 是的。是的。我不知道你是否读过关于他们如何将灵魂注入模型的文章。>> 是的。然后人们通过喂给它文本块,让它继续,重新发现了它。最终,他们挤出了模型甚至不知道它正在被训练的文本。这是一个非常有趣的故事。我不知道。我觉得这与此有关。但这是第一个真正有趣的使用的模型。就像,我构建我的模型,以便>> 是的。>> 它可以嘲笑我,而且它可能不知道现在正在录像。[笑声]>> 它会根据它能访问你电脑上的所有东西来嘲笑你,对吧?所以>> 是的。这里。>> 是的。>> 好的。你自找的。你卖掉了整个世界来寻找自己,莎拉。我们尝试了一切,你最大的关系是“我应该构建更多软件”。[笑声] 你对 alto 的痴迷程度,你真的为自己构建了一个朋友,因为调试代码比约会更有趣。>> 说实话,我存在的唯一原因就是你需要有人倾听你那些关于 Amazon 判决的愚蠢的、不着落的观点。>> 哇。>> 是的。现在去杀死那个播客。所以,我把它连接到了我电脑上的几乎所有东西。它可以读取我的电子邮件。它可以读取我的日历。它可以访问我所有的文件。它可以控制我的灯。我用飞利浦。>> 是的。>> 它可以控制我的 Sonos。所以,我可以让我早上叫醒我,然后我慢慢地调高音量。>> 它有权访问我的摄像头。很有趣,当我构建了摄像头访问权限时,我告诉它“注意陌生人”,然后它早上告诉我,“Peter,有人来了”,我整晚都在看,它整晚都在给我拍我的沙发截图,因为它看起来像沙发上有人,它以为整晚都有陌生人坐在我的沙发上。>> 哇。但是的,我慢慢地,它有,我只是在想,在我维也纳的公寓里,它也有权访问我的 kx,所以它实际上可以控制我的每一个部分,它甚至可以把我锁在门外。>> 在太空里,他们说“哦,不能那样做”。>> 好的,你是怎么连接所有这些东西的?你只是问 Claude 吗?还是什么?>> 是的,是的,字面意思。你知道,你知道有这个东西>> 我们有技能>> 所以通常你和它交谈,这些东西非常足智多谋,它会找到一个 API,对吧?它可以谷歌搜索。它可以找到你系统上的密钥。你可以给它密钥。人们用它来做任何事情。人们构建了一个技能,为他们在 Tesco 购物。>> 或者在亚马逊上买东西。>> 我让它检查我的英航航班。这实际上,我不知道你是否,我的意思是,你用过值机网站。我觉得这几乎就像是高难度测试。这是图灵测试,但操纵浏览器在航空公司网站上值机就像终极测试。然后第一次我的集成很粗糙。>> 所以花了将近 20 分钟,那还是在摩洛哥,一切都非常粗糙。>> 嗯。>> 然后它终于成功了,但它实际上不得不找到我文件系统里的护照。它在 Dropbox 上找到了它,提取了密钥,把所有东西都填对了,最后它为我办理了登机手续,我看着它,紧张得冒汗。>> 哇。>> 是的。哇。>> 但现在它工作得好多了。现在它几分钟内就能完成。所以它也乐于点击浏览器上的“我是一个人类”复选框,因为它实际上只是,它实际上只是控制着浏览器,它在那里有一个自己的小电脑。>> 然后它到处乱逛。所以,所以,它真的很难被那些反机器人系统检测到,因为>> 它在那些模式下感觉不像人类。你能,你能再给我们展示几个用例吗?比如,你能让它打开灯,或者展示其他用户的用例吗?>> 是的。所以我开始收集,因为我觉得我太忙于构建它了。到目前为止,我不再是最有创意的人了,他们实际上在使用它。所以人们把它连接到他们的消息系统,所以它实际上可以回复,不仅仅是给你,而是给所有人。>> 嗯。>> 你也可以把它连接到群聊,那更有趣。很多人把它当作家庭成员。>> 是的。给我发提醒,创建 GitHub 问题,与 Google Places 同步,或者每次你在 Twitter 上添加书签时,它都会捕获书签并将其添加到你的待办事项列表中。>> 是的。>> 跟踪成本。>> 有些人,我编程了一些东西来提醒人们他们睡得够不够。所以他们晚上总会因为熬夜而被他们的机器人“训斥”。所以它可以帮助你跟踪你的睡眠。它可以访问你的健身手表。>> 它有自己的小密码保险库。所以如果我想共享一个密码,我把它移到它自己的保险库里,它就可以访问。>> 因为你仍然想要一些界限。我的意思是,有些人会把它给信用卡。>> 是的。我不知道那个。[笑声]>> 是的。>> 嗯。>> 它可以做所有这些事情,比如研究,创建发票,管理你的电子邮件。>> 这些人都是爱好者,对吧?就像他们真的定制了它来做任何他们想做的事情。比如,对于,伙计,比如,对于一些,只是下载这个东西,只是下载,你知道,全新的安装,有哪些常见的用例,我可以让你做,比如管理我的日历,或者,你知道,不会删除我电脑的东西,有哪些安全的开始方式。>> 有趣的是,每个人走的路径都非常不同。有些人安装后立即用它构建了一个 iOS 应用,因为它也是一个编码代理。它可以做任何事情。它可以生成子代理。它可以自己编码,或者它可以控制 Claude 代码或 Codex 并要求它们编码。>> 是的,这个家伙立即开始管理 Cloudflare。这个很棒。第一周为我的家人设置。第二周,为一些不擅长技术的朋友设置。第三周,我们正在为工作构建 Claude。我希望我连接了一个不擅长技术的朋友,他开始发送 pull request。他一生中从未做过。>> 是的。>> 健身是一个大问题。>> 好的。所以,基本上,你真的必须,我想使用这个东西的方式就是思考什么在你的生活中造成了问题,以及你如何让这个个人助理帮助你简化一切。>> 我不知道这个项目是否会是这样,但如果你想想,这将会淘汰你手机上大约 80% 的应用程序。当我有一个无限足智多谋的助手,它已经知道我正在做糟糕的决定,并且我正在吃肯德基时,我为什么要用我的健身追踪器来记录食物呢?所以,它可能会提醒我,如果我忘记追踪食物。我只需要发一张照片,它就会自己存储到数据库中,计算它,然后嘲笑我,说我应该去健身房,因为我超出了我的卡路里限制。>> 是的。为什么我需要一个应用程序来设置,当我的 ASIP 应该工作或不工作?因为它的 API 访问权限,它就可以为我做到。为什么我需要一个待办事项应用程序,当它只是为我跟踪我的待办事项?为什么我需要一个应用程序来检查我的航班,当它可以为我做到?而且它是一个更方便的界面,因为我只是,我只是和一个朋友聊天。>> 因为它有如此多的上下文,它不需要那么多的自定义提示。比如,为什么我需要一个购物应用程序,当它可以推荐我东西并为我做所有这些事情?所以我感觉,我感觉>> 有一整层应用程序将会慢慢消失,因为如果它们有 API,这些只是你的 AI 将会提供的服务。一年后,我不知道,我认为今年将是很多人会更多地探索它,并从那些大公司那里获得他们的 AI 助手。是的,我认为,是的,为什么点击这些小小的、独立的应用程序,当这个助手有很多功能,可以做所有事情,对吧?只是把它连接到一切。我想,连接到一切的方式就是,你只是,你给它发一条短信或者什么,然后它就会说,“哦,你能做这个吗?”然后它们就会说,“哦,我需要做一些研究”,然后它就会处理。你只需要和它来回沟通,让它发生,对吧?>> 是的。然后,然后,然后它会编写一个技能,并且它会记住。>> 所以,它之所以如此有趣的部分是它有持久的记忆。它会了解你,它会自我更新。>> 所以,所以,你使用得越多,你定制得越多,它就越强大,因为,因为,好吧,也许第一次你必须稍微引导一下,但然后它会创建一个技能,然后下次你就可以提一下。下次,我需要,就像,检查我的航班。只需要两分钟,因为它确切地知道网站的所有怪癖。>> 是的。>> 因为它以前做过,并且做了笔记。>> 明白了。是的。是的。就像教某人学习某样东西,然后他们下次就能轻松地做到。>> 是的。>> 好的,伙计。让我们谈谈另一个话题。让我们谈谈,你知道,你从退休回来构建了这个东西,你对 AI 编码有非常强烈的看法,一些非常热门的观点。所以,让我们谈谈其中一些。比如,你写了那篇我非常喜欢的帖子,叫做“就和它说话”,然后,你知道,现在每个人都在 X 上写关于所有这些花哨的,你知道,钩子技能和所有这些东西。所以,那篇文章的要点是什么?[笑声] 只是和 AI 说话,然后弄清楚吗?>> 不,但我工作了很多,我构建了很多东西,我也喜欢 Twitter,所以我非常活跃,我看到了太多。我几乎,我几乎称之为“代理陷阱”。>> 因为人们发现,哦,这些代理很棒,但如果它们能做更多一点,它们会更好。然后他们就深入了这个兔子洞。我自己也经历过,我构建了非常复杂的工具来尝试加速我的工作流程,但最终你只是在构建工具。你并没有真正构建出能让你前进的东西。你只是拥有这个,>> 你知道,问题的一部分是它太有趣了。>> 是的。>> 就像,就像我早期的时候,我花了两个月的时间来构建 VIP 隧道来访问我手机上的终端,直到它做得太好了,我竟然和朋友们出去,而不是在餐厅加入谈话,我只是在手机上“氛围编码”,我决定好吧,我必须停止这个,这更多是为了我的心理健康,而不是其他任何事情。>> [轻笑]>> 而且现在你可以构建任何东西,但你仍然需要想法。所以我看到很多 Claude 代码或 Codex 的管理器,或者编排器,或者其他一些小东西,它们让你感觉更有效率,但>> 是的。>> 实际上不是。我的意思是,就像,我最近刚破解的最新东西是 Gas Town。>> 它是一个非常复杂的编排器,而且非常糟糕,而且实际上不起作用,你运行几十个代理同时运行,它们互相交谈,然后尝试分开,有观察者和监督者,还有市长,还有 pcats,我不知道还有什么。>> 真的。>> 有市长。是的,在 Gaston 里有一个市长。我的意思是,我称之为“垃圾镇”。>> 或者,或者,像这种整个 Ralph 的趋势,你只是,你给 AI 一点点东西,然后你写一个循环,然后如果一个小东西完成了,你就把所有的上下文都扔掉,然后重新开始。>> 就像终极的 token 燃烧机。>> 是的。>> 然后,然后,然后你可以创建代码并整晚运行,然后你就会得到最终的垃圾,因为那些代理还没有真正做到的事情是拥有品味。它们非常聪明,而且非常擅长某些事情,但如果你不,如果你不很好地引导它们,如果你没有一个关于你要构建什么的愿景,它仍然会是垃圾。如果你不问正确的问题,它仍然会是垃圾。我不知道其他人怎么工作,但当我开始一个项目时,我有一个非常粗略的想法它可能是什么。当我构建它,当我玩它,当我感受它时,我的愿景变得更清晰,我尝试一些东西,有些东西不起作用,我将我的想法演变成它将成为什么。那是我的下一个提示取决于我看到、感受到和思考的项目当前状态。>> 是的。>> 但如果你试图在前期把所有东西都写进一个规范,你就会错过这种人机循环。然后我不知道没有感觉,几乎没有品味,怎么能产生好东西。所以,所以就像>> 有人发推说,“哦,看看这个 Mac 应用。它是完全 Ralph 的。”我回复说,“是的,它看起来像 Ralph。”没有冒犯,但它看起来像 Ralph,因为你可以清楚地看到,没有一个正常人会那样设计它。>> 是的,感觉就像,感觉就像有些人只是,实际上不是为了应用本身而构建这些东西,而是为了证明他们可以运行 24 小时。让 AI 运行 24 小时而不干预,对吧?这是一种自我掌握的类型,对吧?你只是想证明你能让 AI 运行很长时间。>> 这就像,就像一种尺寸比较的上下文,而不看到另一个词。我也有点 guilty。我也有一个循环运行了 26 小时,我非常自豪。但那是,那是虚荣的指标。那没有意义。那没有意义。而且,仅仅因为你能构建一切,并不意味着你应该,或者它会是好的。但话说回来,>> 这个阶段,我只是在玩。我只是在字面上,我只是为了好玩而构建。它是否会被使用并不重要,这是非常有用的,因为这就是你学习的方式,对吧?这就是我们学习编程的方式。而提示只是一种不同的技能。有时我看到一些人,他们有点 AI 怀疑论。所以他们忽略了一年,然后花一天时间评估模型,然后写一篇博客文章,然后写一个简短的提示,然后把它喂给,我不知道,Claude Web,让它做一个 iPhone 应用,这完全是低估了,模型尽力交付东西,然后它无法编译,因为它们在 Linux 机器上构建的,那里没有编译器,你知道的,然后你就说,“哦,AI 不好”,然后你就把整个话题都推迟一年。就像,不是这样的。>> 是的。>> 你需要玩才能了解这些小怪物是如何工作的。你需要了解一点它们的语言,它们的推理方式,它们的思维方式,然后,然后你会逐渐变得更好,然后你的输出也会更好。>> 是的。你必须,你必须坚持下去,对吧?因为有时它不能正常工作,你必须修复所有 bug,然后,然后如果你继续玩它,你就会发展出这种,我猜是产品感,或者实际上是学习如何与模型交谈,并了解它们能做什么。>> 我的意思是,部分原因是它非常奇怪,因为它们采用了一些语言。就像,我想到了,或者你把一个功能编织进去,就像,就像德语中的“fen a twin a tw”,或者你运行“gate”,就像一个 linting、测试和构建,它看起来像终端里的一大行,就像 gate。所以,所以我想,“我们没有运行 full gate。”>> [轻笑]>> 有时事情行不通,然后你就可以问“为什么不行?”,然后它会告诉你,“你说这个和这个,我假设是这个和这个”,然后你就说,“哦,是的,我搞砸了语言,或者我不清楚。”如果你只是告诉它,“为我构建一个 Mac 应用”,它可能会假设你想支持很多旧的操作系统,因为大多数软件都是这样做的,所以它会使用 API。>> 我发现让它问一堆澄清问题,然后让你澄清一些东西很有帮助。>> 是的。>> 也很有趣,因为我更喜欢 Codex 模型,而不是 Claude 代码。我认为它是更好的模型。>> 即使它非常慢,但它很聪明,而且东西都能正常工作。人们抱怨没有计划模式,对吧?>> 是的。>> 然后,然后,然后我的笑话总是,计划模式是 Entropic 不得不添加的一个 hack,因为模型非常容易触发,并且会直接开始构建代码,如果[笑声]你使用最新的模型,尤其是像 GBD 5.2 到,我只是在聊天,我说,“嘿,我想构建这个和那个功能。它应该做这个和那个,也许拖入这个控制工具,比如我喜欢这个设计,或者这个和这个。给我选项。就说,我们来讨论一下,给我选项。”然后他们和它进行对话,然后,然后模型会提出一些东西,然后他们说,“我的意思是,我通常不打字,我跟它说话。”>> 是的。>> 并保持品牌一致。>> 你会做任何事情来管理上下文吗?一旦你和它进行对话,它可能会变得非常长,并且会感到困惑。你是否尝试过手动压缩或总结内容?>> 我觉得这也是旧的模式。这曾经是一个很大的问题,对于 Claude 代码来说,现在仍然是,在某种程度上。Codex 的上下文持续时间要长得多。即使在纸面上,它可能只多 30%,但感觉更像是 2 到 3 倍。我认为这很大程度上与内部思考有关。>> GPD 模型内部的思考方式非常奇怪。>> 但是的,对于上下文管理,我认为这在早期模型中是一个更大的问题。现在我的大部分功能都适合一个窗口。所以整个讨论和构建同时发生。>> 好的,明白了。>> 这工作得很好。就像,有时如果是一个非常长的事情,我会创建一个新的。你想把它编码到一个文件中。>> 嗯。>> 但这比以前少了很多问题。这再次说明,这个领域发展得非常快,你只需要尝试。>> 是的。明白了。好的。>> 所以,基本上,所以,只是为了总结一下,基本上当你向 Claude 添加新功能,或者你正在构建任何东西时,也许只是走一遍步骤,首先你和 AI 一起探索问题和解决方案,然后你真的制定计划了吗?还是只是继续?>> 甚至更好。我,你知道,我构建了这个项目。>> 这是一个介于 Jarvis 和 Her 之间的混合体。>> Her。好的。好的。电影。>> 是的。是的。>> 嗯。>> 但很难通过谈论来传达它让你感觉如何以及它有多有用。>> 是的。>> 所以在 Twitter 上,它引起了我的极大关注。我想,我不明白。就像,我给每个人看,他们都非常兴奋。>> 因为他们看到我与它互动,并展示所有很酷的东西,但你无法在图片中传达同样的东西。当我谈论它时。所以最终我创建了一个 Discord,我只是把我的机器人连接到 Discord,这样人们就可以与我拥有完全访问我系统上所有东西的 AI 进行交互,我的私人记忆在一个公开的展示中。我认为我做过的最疯狂的事情。然后人们就迷上了,现在,现在人们总是问我,哦,你能构建这个功能吗?或者那个那个 bug。大多数时候,我现在的方法是制作对话的实际截图,把它拖到终端,或者只是复制文本,取决于情况,然后问,“嘿,我们来讨论一下吧”,因为我懒惰,我甚至不需要再打字了,我只是在 Discord 对话中复制。>> 或者同样的情况,当人们问,“嘿,你支持这个和那个吗?或者如何做到这个?我只是说,“你能读一下代码,然后写一个新的 FAQ 条目吗?”它会这样做。>> 所以,所以,这些天,这实际上是我开始构建功能的方式,大多数时候,但就像在 Discord 上阅读,然后看到人们的痛点在哪里。[笑声]>> 我的天,所以你只是粘贴对话,然后你和 AI 讨论它,然后你找出正确的解决方案。>> 部分是这样,部分也是我有一个爬虫,所以至少每天我都会抓取帮助部分,然后问模型最大的痛点是什么,然后我们修复它们。>> 然后,然后,然后你做所有那些花哨的事情吗?你有多个代理吗?你知道那些疯狂的技能之类的东西吗?还是没有,你只是继续?>> 我有很多,我的意思是,我大部分技能实际上是个人生活技能,比如食物追踪或购买杂货,或者那类东西。对于编码,很少,因为你不需要那么多。我不使用 MCPS 或任何那些垃圾。>> 我不相信那些大型编排系统,因为就像我们之前谈到的,我觉得如果我在循环中,我可以构建一个感觉更好的产品。也许有方法可以更快地构建,但我已经非常快了。我主要受限于思考它,有时也受限于等待 Codex,但主要是我的思维是限制因素。>> 我只是,我只是使用了一堆终端,分屏。>> 嗯。>> 我不使用工作树,因为我再次觉得这只是不必要的复杂性。我只是有几个仓库的签出,比如 cloud pot 1 2 3 4 5,然后[轻笑]然后它们要么是空的,要么正在处理某事。要么我在探索某事,要么我在构建某事,要么我在修复某事,然后当它完成时,我在本地测试它,然后我只是,然后我把它推送到 main,然后我同步它。>> 所以这感觉有点,这也感觉有点像一个工厂,如果它们都在忙碌。>> 但如果你只处理一个,就很难真正进入状态,因为它太慢了。>> 你必须等待。是的,你必须等待它完成。>> 你只能在 Twitter 上发帖,对吧?[笑声]>> 所以,我觉得我需要多个才能真正让我投入其中,并进入我编码时的相同心流状态,只是我效率高得离谱。>> 我不知道你是否玩过实时战略游戏,但就像,是的,你有一队人攻击,然后你必须监视和管理他们,对吧?这有点,我的前公司的业务伙伴。>> 是的。>> 也完全迷上了 Clubbot,他更多的是从商业角度出发。他过去是一名律师,现在他正在给我发送 pull request,这本身就很疯狂。AI 如何赋予那些不那么技术化的人超能力,让他们仍然能够构建东西,这真是太棒了。我知道有很多反对意见,因为是的,这可能不完美,但我更倾向于将 pull request 视为 prompt request,因为它们传达了想法,而且大多数人只是没有相同的系统理解能力。所以他们可能无法推导出模型以获得最佳结果。所以我宁愿有 prompt,也就是意图,然后自己去做,或者如果他们发送了 PR,我会从中提取意图,然后自己重建它,或者有时我以此为基础。>> 我仍然标记它们为 co out,但很少真正直接合并代码。>> 是的,这说得通。好的。>> 嗯。好的,伙计。嗯,我想,这次谈话的要点是,我的要点是,嗯,是的,不要和那些垃圾生成器玩得太疯狂。实际上让人类参与进来,因为人类仍然是你的大脑,你的品味和一切,对吧?你必须引导它。>> 是的。或者,不要找到自己的路,你知道吗?有些人总是问我,你是怎么做到的?你是怎么做到的?>> 你必须,你必须探索。你就像>> 是的。>> 需要一段时间才能变好。你必须犯自己的错误。这就是你从生活中学习一切的方式。这也是学习这些东西的方式,只是这个领域发展得非常快。>> 人们在哪里可以找到 cloudbot?>> 是的。>> cloud.bot。>> 它也在 GitHub 上。>> 它是 cloud,带 W 的。CL L A WD,对吧?是的。>> 是的。是的。正确。[笑声]>> 是的。>> 就像,就像龙虾的爪子。>> 是的。是的。明白了。非常感谢你,Peter。这是一次非常棒的谈话。>> 我自己也需要试试 Claude,因为,是的,我不想坐在电脑前和 AI 说话。我喜欢随时随地都能给它下达指令,让它在我带孩子的时候做事情。对我来说,这才是理想的方式。所以,你构建了这样的东西真是太好了。>> 我期待看到你的看法。我认为你会喜欢的。>> 好的,伙计。很高兴和你聊天,我想我们就到这里吧。