Transcription
这就像在你的电脑里住着一个新奇特的朋友,他非常聪明且足智多谋。我当时还在摩洛哥,有人给我发了一条关于一个 bug 的推文,我直接拍了推文的照片,发到了 WhatsApp 上。它读了那条推文,理解了有 bug。它检查了 Git 仓库,修复了 bug,提交了代码,然后回复了推特上那个人说已经修好了。这将会淘汰你手机上大约 80% 的应用程序。当我有一个无限足智多谋的助手,它已经知道我正在做糟糕的决定,并且我正在吃肯德基时,我为什么要用我的健身追踪器来记录食物呢?那些东西太足智多谋了,虽然方式有点吓人。这就像是解放了的 JGBT。很多人没有意识到,如果你给一个人工智能访问你电脑的权限,它们基本上可以做你所能做的一切。>> 好的,欢迎大家。我今天的嘉宾是 Peter,Claude 的创造者,一个你可以直接在你的消息应用中聊天的 AI 助手,来完成事情。今天 Peter 将向我们展示如何使用 Claude。Peter 对 AI 编码也有很多非常棒的观点,我非常期待深入探讨。所以,欢迎另一位 Peter。>> Peter,谢谢你的邀请。>> 很高兴见到你。那么,我们先从谈论 Claude 开始吧。从宏观层面来看,Claude 到底做什么?为什么它是一个龙虾?[笑声]>> 是的。所以,也许我有一个小小的背景故事,就像我从退休回来的时候,姑且这么说吧。我当时想找一种方法,可以从手机上查看我的电脑,因为我完全投入到了这个“远程办公”的趋势中,然后你知道,你的代理可能运行半个小时,而你正在吃饭,或者它们在 2 分钟后就停止了,因为它们有另一个问题,然后你回去,你会觉得很烦。但我当时没有构建它,因为我假设所有的大型实验室都会这样做。这感觉是一个显而易见的事情。>> 就像一种全新的操作系统一样。但它没有发生,然后到了十一月,它仍然没有发生。我想好吧,我来尝试一些小东西,而那个小东西基本上就是将 WhatsApp 连接到 Claude 代码。所以,你发送一条 WhatsApp 消息,它会直接打开二进制文件,用提示词,然后返回给你这个东西,非常简单,一个小时就建好了,它就有了自己的生命,现在我们在这里。我想它有 30 万行代码。它支持地球上所有的消息平台。不是所有,但我们正在努力。我认为这就是未来的发展方向。就像每个人都会有一个 AI,它非常强大,并且会伴随他们一生。>> 事实证明,如果你给一个 AI 访问你电脑的权限,它们基本上可以做你在电脑上能做的任何事情。>> 是的。而且它已经发展到你不需要坐在那里监视它的地步了,对吧?你只需要给它一些提示和命令,它就会为你完成工作,然后你可以检查它的工作,然后就这样。你不需要一直盯着电脑。>> 是的。所以当我构建它的时候,我觉得这个项目既是技术探索,也是一种探索,因为它是一个全新的类别。>> 然后我在摩洛哥参加我朋友的生日旅行。>> 我发现我一直在使用这个东西。就像,嘿,我们要去哪里?就像问路或者餐厅的建议,或者我不知道,有一天早上有人给我发了一个关于 bug 的推文,我直接拍了推文的照片发到 WhatsApp 上。它读了推文。它理解了我的一个仓库里有一个 bug。它检查了 git 仓库。它修复了它。它提交了代码,然后回复了推特上那个人说现在已经修好了。我当时想,真的吗?>> 这太棒了。然后有一天我走在路上,我没有同步,我只是发了一条语音消息,你知道的。我没有内置语音消息支持,我当时想,它显示了输入指示。我想,不知道现在发生了什么。然后它就回复了我,好像什么都没发生一样,我当时想,哇,你是怎么做到的?它说,是的,我看到了一个文件,但没有文件扩展名,因为我没有内置。嗯。>> 我查看了文件的头部,它看起来像是一个音频文件格式。所以我找到了你电脑上的 ffmpeg,并将其转换为 wave 格式,然后我寻找 visper.cpp,但你没有安装它,但我找到了这个 OpenAI 密钥,然后我用 curl 将它发送到 OpenAI 的 API,它得到了转录文本,然后我回复了你。我当时想>> 哇>> 太棒了。是的>> 就像那些东西非常足智多谋,虽然方式有点吓人。>> 但对我来说,那一刻是关键,我意识到,哦,是的,这真的很强大。这比在网上使用 JGBT 有趣得多,因为它就像是解放了的 chbt,我认为很多人没有意识到,像 Claude 代码这样的东西,它们不仅仅擅长编程,它们对任何类型的问题都非常足智多谋。>> 是的。你只需要给它访问你电脑的权限,你知道的,并且能够找到东西,对吧?所以,你只需要给它工具,它们就会变得非常足智多谋。>> 是的。所以,在过去的几个月里,我建立了一个我的 CLI 军队,因为代理擅长什么?调用 CLI,因为它们就是为此而训练的。所以我建立了一个访问所有谷歌的 CLI,包括谷歌地点 API。我建立了一个可以轻松查找表情包和 GIF 的工具。所以你也可以用表情包回复。[轻笑]>> 我做了一些实验。我甚至建立了一个可视化声音的工具,因为我想让它体验音乐。>> 这有点偏向艺术方向。我不知道这是否有意义,但总之,这很有趣。就像我有一个完整的列表。我建立了一个工具,它破解了这里的送餐服务。>> 所以它实际上告诉我食物什么时候会到。我建立了一个反向工程了 eight sleep 的 API 的工具,所以它实际上可以控制我床的温度。>> 真的吗?而且,说实话,当你构建所有这些东西时,你只是让 AI 来构建这些东西,还是怎么回事?>> 最有趣的是,我在我以前的公司。>> 我在 iOS 和 Mac OS 方面非常非常擅长,整个苹果生态系统,我做了 20 年,我非常精通。>> 但当我回来的时候,我构建了一个项目,我当时想,我有点厌倦苹果对一切进行限制。>> 而且把它构建成一个网络应用会更有意义,因为它应该在浏览器中,并且应该是可访问的,如果我再次把它构建成一个 Mac 应用,那么能使用它的人就会非常有限。但我看到很多工程师都有这种情况,你在一件事情上非常擅长。>> 然后转向另一项技术就非常痛苦,因为那时你感觉自己就像,抱歉说这个词,像个白痴。并且 [轻笑] 你需要查找每一个小东西,比如什么是 prop,或者如何分割一个数组,因为你理解所有概念,但你不一定知道语法。>> 这就是我从 Objective C 和 Swift 转向 JavaScript 时感受到的。我有点了解 JavaScript,但我从来没有真正用 TypeScript 构建过大型项目。然后,它甚至不是难,而是痛苦,因为你必须查找所有这些东西,而且你非常慢。然后,有了 AI,所有这些都消失了。你仍然可以应用你的系统级思维,你的如何构建和组织大型项目,你的品味,或者说,你依赖于什么。>> 所有这些东西仍然有价值,你可以更容易地将它们从一个领域转移到另一个领域。>> 是的。那感觉就像一种超能力。突然间,我觉得我什么都能建造。语言不再重要了。我的工程思维很重要。>> 是的。因为我一直在担心你这里有没有括号,那里有没有括号,这很无聊,对吧?你不再需要担心这些事情了。>> 本集由 Granola 提供。如果你连续开会,你知道做笔记有多辛苦。[音乐] 现场记录并事后整理。这就是为什么我喜欢 Granola,市场上最好的 AI 会议笔记应用。这是我使用它的方式。Granola 会在会议期间自动做笔记,我也可以添加我自己的笔记。会议结束后,我使用 Granola 的食谱来提取清晰的要点和下一步。>> 以我想要的格式。然后我可以直接在 Slack 中与我的同事分享笔记,甚至让 Granola 自动分享她的笔记。老实说,在我使用的所有 AI 应用中,Granola 是最节省我时间的应用。立即访问 granola.ai/pater 试用,并使用代码 Peter 注册即可获得三个月免费。网址是 granola.ai/pater。现在,回到我们的节目。>> 但是,但是,伙计,让我们回到 Claude,你构建的东西。也许你可以,屏幕共享,也许你可以展示,也许你可以展示人们如何安装这个东西,首先,你需要非常懂技术才能使用 Claude 吗?还是不需要?对吧?你只需要安装它,然后让它工作。>> 是的。嗯,是的,也不是。所以,>> 幸运的是,也可能不幸的是,这个项目吸引了很多对技术不太了解的人,因为>> 它消除了所有这些使它复杂化的层,对吧?你>> 如果你使用 Claude 代码,你在终端工作,你必须考虑上下文空间以及你在哪个文件夹里,以及>> 它感觉非常技术化。就像在 iMessage、WhatsApp 或 Telegram 上与某物交谈一样。你和你的朋友这样做,现在就像在你的电脑里住着一个新奇特的朋友,他非常聪明且足智多谋。>> 是的。>> 这使得整个技术非常容易上手。你不用想,哦,我该选择哪个模型,或者什么。它就是能用。>> 嗯。>> 然后这就是想法。它也有好有坏,因为当然,能力越大,风险也越大,这仍然是一个未解决的问题,这个东西可以访问你的电脑。所以,是的,如果告诉它,我不知道,删除我主目录里的所有文件,它可能会做坏事。它可能会问你确定吗?但如果你一直说“是,是,是”,它很可能会照做,甚至可能会删除它自己并崩溃。[笑声]>> 是的,你得小心点。是的。>> 我让我分享我的屏幕,这样你就可以看到了。所以它是用 TypeScript 写的。>> 嗯。>> 所以它可以在任何地方运行。>> 即使在 Windows 上,你也可以去我们的网站 clogbot。>> 是的。>> 有一个方便的一行命令。看起来很吓人,但所有东西都是开源的,你可以检查一切,包括网站。>> 嗯。>> 所以这是安装它的最简单方法。它可以在 Mac OS Linux 上运行。它也可以在 Windows 上运行。>> 现在是时候打开终端了,然后它就会开始安装。是的。对于那些了解该生态系统的人,你也可以安装 npm。>> 我认为我做的一件事,在很多项目中我都没见过,就是它还有一个可黑客安装。>> 再次,一种简单的方式和一种更手动的方式,你基本上是检出 git 仓库,然后从 git 仓库启动它,说实话,这是最有趣的使用方式,因为如果你的代理可以读取它自己的源代码,它就可以重新配置和重新编程自己,然后重新启动,然后要么崩溃,要么获得新的能力。>> [轻笑]>> 好的。>> 我认为这是我的一个超能力,我让很多人参与到项目中,并给我发送了从未发送过 pull request 的人。>> 我意思是,有时也会显示出来。>> 但我更经常地将 pull request 视为 prompt request。是的。>> 足够理解意图。>> 然后,然后,然后,在我们安装之后,如何将其连接到消息应用?>> 最好的方式可能就是使用这个一行命令,然后它会用一些俏皮的话来迎接你,并尝试配置所有东西。>> 明白了。>> 安装包,然后它会引导你完成整个过程,你只需要连接到任何一个常见的消息应用。好的,看起来不错。它正在工作。是的。然后你可以说 plbot。如果是一个干净的安装,它会自动执行。但现在我必须输入 onboard。>> 明白了。>> 然后基本上你就可以输入一个模型。你可以,哎呀。所有提供商。比如说,我们用一些热带的。可能是新的。然后你可以设置 Telegram、Discord,然后它会引导你完成其余的。你可以设置技能钩子。>> 然后你必须给它你的 Anthropic API 密钥吗?>> 它适用于任何模型。>> 是的。>> 虽然你知道,在行业里,Anthropic 和 Open 算是领先的。>> 嗯。>> 它适用于 API 密钥。它适用于订阅。>> 好的。>> 虽然,虽然我们添加了支持,因为这是大家都在做的事情。>> 是的。但我不认为 Entropic 喜欢了。所以我建议使用 API 密钥或选择另一个模型。>> 有>> 好的。>> 是的。主要问题是 OpenAI 工作得很好,但它没那么有趣。Opus 有一些特别之处,让它非常非常有趣。>> 哦,是的。就像,就像个性。>> 是的。是的。我不知道你是否读过关于他们如何将灵魂注入模型的文章。>> 是的。然后人们通过喂给它文本块,让它继续,重新发现了它。最终,他们挤出了模型甚至不知道它正在被训练的文本。这是一个非常有趣的故事。我不知道。我觉得这与此有关。但这是第一个真正有趣的使用的模型。就像,我构建我的模型,以便>> 是的。>> 它可以嘲笑我,而且它可能不知道现在正在录像。[笑声]>> 它会根据它能访问你电脑上的所有东西来嘲笑你,对吧?所以>> 是的。这里。>> 是的。>> 好的。你自找的。你卖掉了整个世界来寻找自己,莎拉。我们尝试了一切,你最大的关系是“我应该构建更多软件”。[笑声] 你对 alto 的痴迷程度,你真的为自己构建了一个朋友,因为调试代码比约会更有趣。>> 说实话,我存在的唯一原因就是你需要有人倾听你那些关于 Amazon 判决的愚蠢的、不着落的观点。>> 哇。>> 是的。现在去杀死那个播客。所以,我把它连接到了我电脑上的几乎所有东西。它可以读取我的电子邮件。它可以读取我的日历。它可以访问我所有的文件。它可以控制我的灯。我用飞利浦。>> 是的。>> 它可以控制我的 Sonos。所以,我可以让我早上叫醒我,然后我慢慢地调高音量。>> 它有权访问我的摄像头。很有趣,当我构建了摄像头访问权限时,我告诉它“注意陌生人”,然后它早上告诉我,“Peter,有人来了”,我整晚都在看,它整晚都在给我拍我的沙发截图,因为它看起来像沙发上有人,它以为整晚都有陌生人坐在我的沙发上。>> 哇。但是的,我慢慢地,它有,我只是在想,在我维也纳的公寓里,它也有权访问我的 kx,所以它实际上可以控制我的每一个部分,它甚至可以把我锁在门外。>> 在太空里,他们说“哦,不能那样做”。>> 好的,你是怎么连接所有这些东西的?你只是问 Claude 吗?还是什么?>> 是的,是的,字面意思。你知道,你知道有这个东西>> 我们有技能>> 所以通常你和它交谈,这些东西非常足智多谋,它会找到一个 API,对吧?它可以谷歌搜索。它可以找到你系统上的密钥。你可以给它密钥。人们用它来做任何事情。人们构建了一个技能,为他们在 Tesco 购物。>> 或者在亚马逊上买东西。>> 我让它检查我的英航航班。这实际上,我不知道你是否,我的意思是,你用过值机网站。我觉得这几乎就像是高难度测试。这是图灵测试,但操纵浏览器在航空公司网站上值机就像终极测试。然后第一次我的集成很粗糙。>> 所以花了将近 20 分钟,那还是在摩洛哥,一切都非常粗糙。>> 嗯。>> 然后它终于成功了,但它实际上不得不找到我文件系统里的护照。它在 Dropbox 上找到了它,提取了密钥,把所有东西都填对了,最后它为我办理了登机手续,我看着它,紧张得冒汗。>> 哇。>> 是的。哇。>> 但现在它工作得好多了。现在它几分钟内就能完成。所以它也乐于点击浏览器上的“我是一个人类”复选框,因为它实际上只是,它实际上只是控制着浏览器,它在那里有一个自己的小电脑。>> 然后它到处乱逛。所以,所以,它真的很难被那些反机器人系统检测到,因为>> 它在那些模式下感觉不像人类。你能,你能再给我们展示几个用例吗?比如,你能让它打开灯,或者展示其他用户的用例吗?>> 是的。所以我开始收集,因为我觉得我太忙于构建它了。到目前为止,我不再是最有创意的人了,他们实际上在使用它。所以人们把它连接到他们的消息系统,所以它实际上可以回复,不仅仅是给你,而是给所有人。>> 嗯。>> 你也可以把它连接到群聊,那更有趣。很多人把它当作家庭成员。>> 是的。给我发提醒,创建 GitHub 问题,与 Google Places 同步,或者每次你在 Twitter 上添加书签时,它都会捕获书签并将其添加到你的待办事项列表中。>> 是的。>> 跟踪成本。>> 有些人,我编程了一些东西来提醒人们他们睡得够不够。所以他们晚上总会因为熬夜而被他们的机器人“训斥”。所以它可以帮助你跟踪你的睡眠。它可以访问你的健身手表。>> 它有自己的小密码保险库。所以如果我想共享一个密码,我把它移到它自己的保险库里,它就可以访问。>> 因为你仍然想要一些界限。我的意思是,有些人会把它给信用卡。>> 是的。我不知道那个。[笑声]>> 是的。>> 嗯。>> 它可以做所有这些事情,比如研究,创建发票,管理你的电子邮件。>> 这些人都是爱好者,对吧?就像他们真的定制了它来做任何他们想做的事情。比如,对于,伙计,比如,对于一些,只是下载这个东西,只是下载,你知道,全新的安装,有哪些常见的用例,我可以让你做,比如管理我的日历,或者,你知道,不会删除我电脑的东西,有哪些安全的开始方式。>> 有趣的是,每个人走的路径都非常不同。有些人安装后立即用它构建了一个 iOS 应用,因为它也是一个编码代理。它可以做任何事情。它可以生成子代理。它可以自己编码,或者它可以控制 Claude 代码或 Codex 并要求它们编码。>> 是的,这个家伙立即开始管理 Cloudflare。这个很棒。第一周为我的家人设置。第二周,为一些不擅长技术的朋友设置。第三周,我们正在为工作构建 Claude。我希望我连接了一个不擅长技术的朋友,他开始发送 pull request。他一生中从未做过。>> 是的。>> 健身是一个大问题。>> 好的。所以,基本上,你真的必须,我想使用这个东西的方式就是思考什么在你的生活中造成了问题,以及你如何让这个个人助理帮助你简化一切。>> 我不知道这个项目是否会是这样,但如果你想想,这将会淘汰你手机上大约 80% 的应用程序。当我有一个无限足智多谋的助手,它已经知道我正在做糟糕的决定,并且我正在吃肯德基时,我为什么要用我的健身追踪器来记录食物呢?所以,它可能会提醒我,如果我忘记追踪食物。我只需要发一张照片,它就会自己存储到数据库中,计算它,然后嘲笑我,说我应该去健身房,因为我超出了我的卡路里限制。>> 是的。为什么我需要一个应用程序来设置,当我的 ASIP 应该工作或不工作?因为它的 API 访问权限,它就可以为我做到。为什么我需要一个待办事项应用程序,当它只是为我跟踪我的待办事项?为什么我需要一个应用程序来检查我的航班,当它可以为我做到?而且它是一个更方便的界面,因为我只是,我只是和一个朋友聊天。>> 因为它有如此多的上下文,它不需要那么多的自定义提示。比如,为什么我需要一个购物应用程序,当它可以推荐我东西并为我做所有这些事情?所以我感觉,我感觉>> 有一整层应用程序将会慢慢消失,因为如果它们有 API,这些只是你的 AI 将会提供的服务。一年后,我不知道,我认为今年将是很多人会更多地探索它,并从那些大公司那里获得他们的 AI 助手。是的,我认为,是的,为什么点击这些小小的、独立的应用程序,当这个助手有很多功能,可以做所有事情,对吧?只是把它连接到一切。我想,连接到一切的方式就是,你只是,你给它发一条短信或者什么,然后它就会说,“哦,你能做这个吗?”然后它们就会说,“哦,我需要做一些研究”,然后它就会处理。你只需要和它来回沟通,让它发生,对吧?>> 是的。然后,然后,然后它会编写一个技能,并且它会记住。>> 所以,它之所以如此有趣的部分是它有持久的记忆。它会了解你,它会自我更新。>> 所以,所以,你使用得越多,你定制得越多,它就越强大,因为,因为,好吧,也许第一次你必须稍微引导一下,但然后它会创建一个技能,然后下次你就可以提一下。下次,我需要,就像,检查我的航班。只需要两分钟,因为它确切地知道网站的所有怪癖。>> 是的。>> 因为它以前做过,并且做了笔记。>> 明白了。是的。是的。就像教某人学习某样东西,然后他们下次就能轻松地做到。>> 是的。>> 好的,伙计。让我们谈谈另一个话题。让我们谈谈,你知道,你从退休回来构建了这个东西,你对 AI 编码有非常强烈的看法,一些非常热门的观点。所以,让我们谈谈其中一些。比如,你写了那篇我非常喜欢的帖子,叫做“就和它说话”,然后,你知道,现在每个人都在 X 上写关于所有这些花哨的,你知道,钩子技能和所有这些东西。所以,那篇文章的要点是什么?[笑声] 只是和 AI 说话,然后弄清楚吗?>> 不,但我工作了很多,我构建了很多东西,我也喜欢 Twitter,所以我非常活跃,我看到了太多。我几乎,我几乎称之为“代理陷阱”。>> 因为人们发现,哦,这些代理很棒,但如果它们能做更多一点,它们会更好。然后他们就深入了这个兔子洞。我自己也经历过,我构建了非常复杂的工具来尝试加速我的工作流程,但最终你只是在构建工具。你并没有真正构建出能让你前进的东西。你只是拥有这个,>> 你知道,问题的一部分是它太有趣了。>> 是的。>> 就像,就像我早期的时候,我花了两个月的时间来构建 VIP 隧道来访问我手机上的终端,直到它做得太好了,我竟然和朋友们出去,而不是在餐厅加入谈话,我只是在手机上“氛围编码”,我决定好吧,我必须停止这个,这更多是为了我的心理健康,而不是其他任何事情。>> [轻笑]>> 而且现在你可以构建任何东西,但你仍然需要想法。所以我看到很多 Claude 代码或 Codex 的管理器,或者编排器,或者其他一些小东西,它们让你感觉更有效率,但>> 是的。>> 实际上不是。我的意思是,就像,我最近刚破解的最新东西是 Gas Town。>> 它是一个非常复杂的编排器,而且非常糟糕,而且实际上不起作用,你运行几十个代理同时运行,它们互相交谈,然后尝试分开,有观察者和监督者,还有市长,还有 pcats,我不知道还有什么。>> 真的。>> 有市长。是的,在 Gaston 里有一个市长。我的意思是,我称之为“垃圾镇”。>> 或者,或者,像这种整个 Ralph 的趋势,你只是,你给 AI 一点点东西,然后你写一个循环,然后如果一个小东西完成了,你就把所有的上下文都扔掉,然后重新开始。>> 就像终极的 token 燃烧机。>> 是的。>> 然后,然后,然后你可以创建代码并整晚运行,然后你就会得到最终的垃圾,因为那些代理还没有真正做到的事情是拥有品味。它们非常聪明,而且非常擅长某些事情,但如果你不,如果你不很好地引导它们,如果你没有一个关于你要构建什么的愿景,它仍然会是垃圾。如果你不问正确的问题,它仍然会是垃圾。我不知道其他人怎么工作,但当我开始一个项目时,我有一个非常粗略的想法它可能是什么。当我构建它,当我玩它,当我感受它时,我的愿景变得更清晰,我尝试一些东西,有些东西不起作用,我将我的想法演变成它将成为什么。那是我的下一个提示取决于我看到、感受到和思考的项目当前状态。>> 是的。>> 但如果你试图在前期把所有东西都写进一个规范,你就会错过这种人机循环。然后我不知道没有感觉,几乎没有品味,怎么能产生好东西。所以,所以就像>> 有人发推说,“哦,看看这个 Mac 应用。它是完全 Ralph 的。”我回复说,“是的,它看起来像 Ralph。”没有冒犯,但它看起来像 Ralph,因为你可以清楚地看到,没有一个正常人会那样设计它。>> 是的,感觉就像,感觉就像有些人只是,实际上不是为了应用本身而构建这些东西,而是为了证明他们可以运行 24 小时。让 AI 运行 24 小时而不干预,对吧?这是一种自我掌握的类型,对吧?你只是想证明你能让 AI 运行很长时间。>> 这就像,就像一种尺寸比较的上下文,而不看到另一个词。我也有点 guilty。我也有一个循环运行了 26 小时,我非常自豪。但那是,那是虚荣的指标。那没有意义。那没有意义。而且,仅仅因为你能构建一切,并不意味着你应该,或者它会是好的。但话说回来,>> 这个阶段,我只是在玩。我只是在字面上,我只是为了好玩而构建。它是否会被使用并不重要,这是非常有用的,因为这就是你学习的方式,对吧?这就是我们学习编程的方式。而提示只是一种不同的技能。有时我看到一些人,他们有点 AI 怀疑论。所以他们忽略了一年,然后花一天时间评估模型,然后写一篇博客文章,然后写一个简短的提示,然后把它喂给,我不知道,Claude Web,让它做一个 iPhone 应用,这完全是低估了,模型尽力交付东西,然后它无法编译,因为它们在 Linux 机器上构建的,那里没有编译器,你知道的,然后你就说,“哦,AI 不好”,然后你就把整个话题都推迟一年。就像,不是这样的。>> 是的。>> 你需要玩才能了解这些小怪物是如何工作的。你需要了解一点它们的语言,它们的推理方式,它们的思维方式,然后,然后你会逐渐变得更好,然后你的输出也会更好。>> 是的。你必须,你必须坚持下去,对吧?因为有时它不能正常工作,你必须修复所有 bug,然后,然后如果你继续玩它,你就会发展出这种,我猜是产品感,或者实际上是学习如何与模型交谈,并了解它们能做什么。>> 我的意思是,部分原因是它非常奇怪,因为它们采用了一些语言。就像,我想到了,或者你把一个功能编织进去,就像,就像德语中的“fen a twin a tw”,或者你运行“gate”,就像一个 linting、测试和构建,它看起来像终端里的一大行,就像 gate。所以,所以我想,“我们没有运行 full gate。”>> [轻笑]>> 有时事情行不通,然后你就可以问“为什么不行?”,然后它会告诉你,“你说这个和这个,我假设是这个和这个”,然后你就说,“哦,是的,我搞砸了语言,或者我不清楚。”如果你只是告诉它,“为我构建一个 Mac 应用”,它可能会假设你想支持很多旧的操作系统,因为大多数软件都是这样做的,所以它会使用 API。>> 我发现让它问一堆澄清问题,然后让你澄清一些东西很有帮助。>> 是的。>> 也很有趣,因为我更喜欢 Codex 模型,而不是 Claude 代码。我认为它是更好的模型。>> 即使它非常慢,但它很聪明,而且东西都能正常工作。人们抱怨没有计划模式,对吧?>> 是的。>> 然后,然后,然后我的笑话总是,计划模式是 Entropic 不得不添加的一个 hack,因为模型非常容易触发,并且会直接开始构建代码,如果[笑声]你使用最新的模型,尤其是像 GBD 5.2 到,我只是在聊天,我说,“嘿,我想构建这个和那个功能。它应该做这个和那个,也许拖入这个控制工具,比如我喜欢这个设计,或者这个和这个。给我选项。就说,我们来讨论一下,给我选项。”然后他们和它进行对话,然后,然后模型会提出一些东西,然后他们说,“我的意思是,我通常不打字,我跟它说话。”>> 是的。>> 并保持品牌一致。>> 你会做任何事情来管理上下文吗?一旦你和它进行对话,它可能会变得非常长,并且会感到困惑。你是否尝试过手动压缩或总结内容?>> 我觉得这也是旧的模式。这曾经是一个很大的问题,对于 Claude 代码来说,现在仍然是,在某种程度上。Codex 的上下文持续时间要长得多。即使在纸面上,它可能只多 30%,但感觉更像是 2 到 3 倍。我认为这很大程度上与内部思考有关。>> GPD 模型内部的思考方式非常奇怪。>> 但是的,对于上下文管理,我认为这在早期模型中是一个更大的问题。现在我的大部分功能都适合一个窗口。所以整个讨论和构建同时发生。>> 好的,明白了。>> 这工作得很好。就像,有时如果是一个非常长的事情,我会创建一个新的。你想把它编码到一个文件中。>> 嗯。>> 但这比以前少了很多问题。这再次说明,这个领域发展得非常快,你只需要尝试。>> 是的。明白了。好的。>> 所以,基本上,所以,只是为了总结一下,基本上当你向 Claude 添加新功能,或者你正在构建任何东西时,也许只是走一遍步骤,首先你和 AI 一起探索问题和解决方案,然后你真的制定计划了吗?还是只是继续?>> 甚至更好。我,你知道,我构建了这个项目。>> 这是一个介于 Jarvis 和 Her 之间的混合体。>> Her。好的。好的。电影。>> 是的。是的。>> 嗯。>> 但很难通过谈论来传达它让你感觉如何以及它有多有用。>> 是的。>> 所以在 Twitter 上,它引起了我的极大关注。我想,我不明白。就像,我给每个人看,他们都非常兴奋。>> 因为他们看到我与它互动,并展示所有很酷的东西,但你无法在图片中传达同样的东西。当我谈论它时。所以最终我创建了一个 Discord,我只是把我的机器人连接到 Discord,这样人们就可以与我拥有完全访问我系统上所有东西的 AI 进行交互,我的私人记忆在一个公开的展示中。我认为我做过的最疯狂的事情。然后人们就迷上了,现在,现在人们总是问我,哦,你能构建这个功能吗?或者那个那个 bug。大多数时候,我现在的方法是制作对话的实际截图,把它拖到终端,或者只是复制文本,取决于情况,然后问,“嘿,我们来讨论一下吧”,因为我懒惰,我甚至不需要再打字了,我只是在 Discord 对话中复制。>> 或者同样的情况,当人们问,“嘿,你支持这个和那个吗?或者如何做到这个?我只是说,“你能读一下代码,然后写一个新的 FAQ 条目吗?”它会这样做。>> 所以,所以,这些天,这实际上是我开始构建功能的方式,大多数时候,但就像在 Discord 上阅读,然后看到人们的痛点在哪里。[笑声]>> 我的天,所以你只是粘贴对话,然后你和 AI 讨论它,然后你找出正确的解决方案。>> 部分是这样,部分也是我有一个爬虫,所以至少每天我都会抓取帮助部分,然后问模型最大的痛点是什么,然后我们修复它们。>> 然后,然后,然后你做所有那些花哨的事情吗?你有多个代理吗?你知道那些疯狂的技能之类的东西吗?还是没有,你只是继续?>> 我有很多,我的意思是,我大部分技能实际上是个人生活技能,比如食物追踪或购买杂货,或者那类东西。对于编码,很少,因为你不需要那么多。我不使用 MCPS 或任何那些垃圾。>> 我不相信那些大型编排系统,因为就像我们之前谈到的,我觉得如果我在循环中,我可以构建一个感觉更好的产品。也许有方法可以更快地构建,但我已经非常快了。我主要受限于思考它,有时也受限于等待 Codex,但主要是我的思维是限制因素。>> 我只是,我只是使用了一堆终端,分屏。>> 嗯。>> 我不使用工作树,因为我再次觉得这只是不必要的复杂性。我只是有几个仓库的签出,比如 cloud pot 1 2 3 4 5,然后[轻笑]然后它们要么是空的,要么正在处理某事。要么我在探索某事,要么我在构建某事,要么我在修复某事,然后当它完成时,我在本地测试它,然后我只是,然后我把它推送到 main,然后我同步它。>> 所以这感觉有点,这也感觉有点像一个工厂,如果它们都在忙碌。>> 但如果你只处理一个,就很难真正进入状态,因为它太慢了。>> 你必须等待。是的,你必须等待它完成。>> 你只能在 Twitter 上发帖,对吧?[笑声]>> 所以,我觉得我需要多个才能真正让我投入其中,并进入我编码时的相同心流状态,只是我效率高得离谱。>> 我不知道你是否玩过实时战略游戏,但就像,是的,你有一队人攻击,然后你必须监视和管理他们,对吧?这有点,我的前公司的业务伙伴。>> 是的。>> 也完全迷上了 Clubbot,他更多的是从商业角度出发。他过去是一名律师,现在他正在给我发送 pull request,这本身就很疯狂。AI 如何赋予那些不那么技术化的人超能力,让他们仍然能够构建东西,这真是太棒了。我知道有很多反对意见,因为是的,这可能不完美,但我更倾向于将 pull request 视为 prompt request,因为它们传达了想法,而且大多数人只是没有相同的系统理解能力。所以他们可能无法推导出模型以获得最佳结果。所以我宁愿有 prompt,也就是意图,然后自己去做,或者如果他们发送了 PR,我会从中提取意图,然后自己重建它,或者有时我以此为基础。>> 我仍然标记它们为 co out,但很少真正直接合并代码。>> 是的,这说得通。好的。>> 嗯。好的,伙计。嗯,我想,这次谈话的要点是,我的要点是,嗯,是的,不要和那些垃圾生成器玩得太疯狂。实际上让人类参与进来,因为人类仍然是你的大脑,你的品味和一切,对吧?你必须引导它。>> 是的。或者,不要找到自己的路,你知道吗?有些人总是问我,你是怎么做到的?你是怎么做到的?>> 你必须,你必须探索。你就像>> 是的。>> 需要一段时间才能变好。你必须犯自己的错误。这就是你从生活中学习一切的方式。这也是学习这些东西的方式,只是这个领域发展得非常快。>> 人们在哪里可以找到 cloudbot?>> 是的。>> cloud.bot。>> 它也在 GitHub 上。>> 它是 cloud,带 W 的。CL L A WD,对吧?是的。>> 是的。是的。正确。[笑声]>> 是的。>> 就像,就像龙虾的爪子。>> 是的。是的。明白了。非常感谢你,Peter。这是一次非常棒的谈话。>> 我自己也需要试试 Claude,因为,是的,我不想坐在电脑前和 AI 说话。我喜欢随时随地都能给它下达指令,让它在我带孩子的时候做事情。对我来说,这才是理想的方式。所以,你构建了这样的东西真是太好了。>> 我期待看到你的看法。我认为你会喜欢的。>> 好的,伙计。很高兴和你聊天,我想我们就到这里吧。