Transcription
国家银行。我们在这里与 Alpen Yukalolu 一起。他是 Paradigm 的投资和研究合伙人。也是一篇题为 EVM bench 的论文的合著者,这是一项用于智能合约安全代理的开放基准测试,与 OpenAI 合作撰写,旨在衡量 AI 代理检测、修补或利用智能合约漏洞的能力。我们将讨论 AI 和 AI 能力将如何影响我们的加密生态系统,以及我们的智能合约。Alpin,欢迎来到 Bank list。>> 你好,谢谢你邀请我。我想用一个非常大的问题开始这个播客。我们面临多大的风险?>> 来自 AI?AI 智能合约能力对我们行业构成多大的威胁?是的,我的意思是,从长远来看,越来越清楚的是,AI 对加密货币将非常有益,尤其是在安全方面,因为我们将进入一个世界,在那里一切都更加安全,行业的上限也更高。所以我们的合伙人 Matt 谈到,如果你有一个由父母经营的杂货店,因为他们看不到店里的所有东西,所以他们能做多大是有限的。但一旦你增加了安全摄像头,安全就会产生增加行业容量、承载能力的效果。我认为在短期内,这取决于我们,因为模型正变得非常出色,非常出色。当我们大约 6 个月前开始研究 EVM bench 时,这是一个完全由吸金关键漏洞组成的基准测试,模型能够找到不到 20% 的漏洞,大约 12% 到 13%。在我们研究基准测试期间,这个数字上升到 50% 以上。在我起草发布推文和实际点击发送之间,随着 G 5.3 codeex 的发布,这个数字跃升至 70% 以上。所以这些东西正在以惊人的速度增长,我们必须以一种能够防御攻击的方式来定位行业,这一点非常重要。但从长远来看,我认为它极大地增加了加密货币的承载能力。>> 是的。我认为你说的意思是,从长远来看,我们将获得接近完美的安全。>> 是的。现在我们还没有完美的安全。让我以一种稍微不同的方式问你同一个问题。假设只有坏人,只有黑客才能获得 AI 能力。在这种情况下,我们的行业面临多大的风险?考虑到 AI 能力的提高,我们的智能合约有多容易被利用?>> 是的,我的意思是,我认为当我们接近超智能水平时,很难说。我认为直到我们达到目前的水平,模型都相当不错,但它们不如最优秀的人类审计员。所以我们已经在加密货币领域存在这种威胁模型,即极其智能的对抗性行为者,他们不断试图破坏我们所有的软件,以及其中所有的金钱。所以从这个意义上说,加密货币已经相当坚固了。但当我们谈论技术发展到超智能时,这真的很难说。这与过去几年编码能力主要呈线性增长,去年 12 月份它们跨过了一个门槛,变得比普通工程师更好,然后一切都变得清晰起来,这就像一个顿悟时刻,也是一个“糟糕”时刻。我认为安全方面可能会发生非常类似的事情,现在它正在以相当快的速度增长,仍然是线性的,但它还没有像最优秀的人类审计员那样好。所以,我们还没有感觉到。它还没有打破我们的任何假设。但一旦我们达到,也许在 6 到 8 个月内,我对此很有信心,到年底,超人类 AI 审计员,这将完全打破我们所有的假设,我们将需要回去确保我们正在加固所有持有加密货币近千亿美元资产的合约。Galaxy 在数字资产和下一代基础设施的交汇处运营,为机构提供端到端服务。在市场方面,Galaxy 是一个领先的机构平台,提供现货、衍生品、结构化产品、DeFi 借贷、投资银行和融资。Galaxy 拥有超过 1600 个交易对手方,帮助机构驾驭市场周期的每个阶段。该平台还通过主动管理策略和机构级质押和区块链基础设施支持长期配置者。这种规模是真实的。Galaxy 在平台上拥有超过 120 亿美元的资产,并在 2025 年末平均拥有 18 亿美元的贷款账簿,这反映了整个生态系统的深度信任。除了数字资产,Galaxy 还在为 AI 驱动的未来构建基础设施。其 Helios 数据中心园区是专为 AI 和高性能计算而建的。拥有超过 1.6 吉瓦的批准电力容量,使其成为同类中最大的站点之一,从全球市场到面向 AI 的数据中心,Galaxy 为数字资产生态系统提供端到端服务。访问 galaxy.com/banklist 探索 Galaxy,或点击节目说明中的链接。Euphoria 将一键交易带到你的手中。Euphoria 基于 Mega ETH 构建,它获取实时价格图表,并将其投影到网格上。你点击你认为价格将在未来 5 到 30 秒内进入的方格。如果价格进入该象限,你可以赚取 2 到 100 倍的交易额。没有其他应用程序能帮助你在 FOMC 会议、总统演讲或全球宏观事件等市场驱动事件上进行更快、更具杠杆性的交易。得益于 Mega ETH 的实时区块链,Euphoria 是实现与市场实时价格互动的方式。在 Euphoria 上,你将能够通过 Euphoria 的实时社交交易体验与朋友竞争,让你与朋友进行正面较量。如果将应用程序投影到电视上,这将是一个很棒的派对技巧。它将是衍生品的马里奥派对。要在 Euphoria 上进行交易,人们可以从任何链上存入稳定币,或进行直接的法定货币转账,所有这些都会在后台转换为 Mega 的原生稳定币 USDM。访问 euphoria.inance 查看,下载应用程序或在 Telegram 中找到它作为一个小程序。2024 年,新兴市场为投资者创造了超过 1150 亿美元的年化收益,收益率在 10% 到 40% 之间。这些是地球上最高、最持久的收益率。问题是,DeFi 无法访问它们。Bricks 改变了这一点。Bricks 基于 Mega ETH 构建,将新兴市场货币市场和溶剂套利转化为可组合的基元,你可以直接从钱包访问。当 DeFi 投资者从稳定币和国库券中赚取 3% 到 6% 的收益时,机构已经通过主权货币政策获得了 10% 到 50% 的收益。BRICS 通过机构级代币化、本地银行渠道、跨司法管辖区的合规性以及实时稳定币结算连接了这些世界。BRICS 承担了繁重的工作,以便 DeFi 最终能够获得真实世界的收益之上的机构级代币化、本地银行渠道、跨司法管辖区的合规性以及实时稳定币结算。即使是最好的套利交易也可以触手可及。Bricks 将 DeFi 的承诺带到新兴世界,并将新兴市场的收益带到你的钱包。让收益随着 Bricks 流动。>> Alpin,如果我们在这里放大来看,并考虑到 AI 智能及其安全能力和其漏洞检测能力呈指数级增长,并考虑到超智能 AI。我甚至不知道如何思考安全问题,因为它能够设想超越人类理解的场景。例如,如果它想出一种方法来破解我们的某些密码学,使用我们甚至不知道存在的数学?>> 对吗?我最近在播客上听 Justin Drake 谈论过这个。这不仅仅是量子计算机的威胁,这是一种真实的已知威胁,我们的一些加密算法由于量子计算机而受到威胁。但如果我们有超智能 AI,我不知道它能破解和解密什么。我的问题是,当涉及到超智能 AI 时,安全是否根本无法准备?我们该如何思考它?>> 我认为安全。我将这样思考:我认为目前这个前沿非常难以捉摸,如果你试图在极限思维中这样做,你最终会走向一些非常奇怪的地方,这些地方可能会让你非常精神错乱。我认为其中一项技能是,我认为面对奇点并保持理智是一项非常重要的技能。我认为我们目前能做的最好的事情是,我们可以让自己进入前沿,进入这种实验性的未来,在那里我们自己运行实验,并在这些拐点发生时做好反应。因为我认为“世界上只有坏人,他们将获得这项技术,他们将破坏我们所有的系统”这种模式。我认为这会导致一种精神错乱,即“我们是不是都完蛋了?”但事实并非如此,对吧?我们将一起在那里,当我们处于这个前沿,当我们能够访问这些前沿模型时,那些能够运行这些漏洞利用的代理工具,那些能够发现未知的数学或能够破解现有密码学的工具。双方都会存在。目前还不清楚这是否会是一种有利于进攻还是防御的技术。我得说,世界上仍然存在基本限制,你不能打破物理定律。存在一些混乱的系统,例如三体问题,即使你拥有超智能,你也无法预测太多未来的时间点,因为它本质上是一个混乱的系统。所以,我认为存在着,世界是一个复杂的地方,仍然存在物理定律和限制会抓住这些东西。而且,实际上,我们能做的最好的就是我们必须一起推动这个前沿,而不是让它发生在我们身上。我认为这是一个公平的观点。这里存在物理限制,超智能 AI 并不意味着它会像神一样出现在人类面前,但它并没有赋予它打破宇宙物理定律的神一般的能力。当然。但实际上,我想深入探讨一下,因为我感觉到你可能有一些见解,因为我一直在盯着奇点的深渊,并试图保持理智,但我不太擅长。有时我觉得我盯着,我感觉自己有点疯了。我就是不,我对它感到不安。你能分享一些智慧吗?就像一个模式或者什么东西?我从你刚才说的话中开始得到一些东西。也许关键是循序渐进,不要考虑遥远的未来和极限。也许想想明天,下个月,下一年。当你凝视奇点时,你如何保持理智?我认为核心是能动性,对吧?所以,Peter Teal 有一个框架,他认为接受和否认,大多数人将它们视为对立面,但在许多方面它们是相同的,因为两者都意味着你似乎一切都失控了。如果你完全接受某事会发生,那么你就不会采取任何行动。如果你完全否认某事会发生,你也不会采取任何行动。从这个意义上说,我认为末日论者和加速论者都是错的。真正的答案是我们对这些结果有能动性,你自己可以弯曲未来的弧线。我认为这很有安慰,很稳定,因为如果你相信你对结果有能动性,那么你就仍然在控制之中。现在我要说的是,目前的前沿,我想你可以争辩说,前沿一直是实验性的,这意味着我们不知道,我们不能坐下来理论化会发生什么。通常,我们将弄清楚会发生什么的方式是通过实验,然后通过看到结果。你知道这些 AI 模型以及当前的技术前沿正在增长。它不是制造的,它更多地是有机演变的,以一种我们今天无法真正预测的方式。所以,即使是那些试图理论化会发生什么的人,也会让你发疯,因为你无法知道。它不取决于你算法化地找出未来的能力。所以你必须深入其中,尝试。是的,有一些斯多葛式的接受,你无法知道一切,所以你必须放下它。然后也有对能动性的信念,以及一种应用的信念。我的意思是,是的。>> 是的。能动性有多少只是盲目的信仰,而不是实际的信仰?对于一个听众来说,他们看着奇点,感到麻木,因为不知道该做什么,并且觉得他们没有多少控制和能动性。这是他们可以培养的东西吗?还是你的建议是?你只需要有信心。你只需要相信你拥有更多的能动性,然后它就会自我实现,你就会拥有更多的能动性。>> 我认为信心是好的,但它不是一个特别能动性的心态。我的意思是,例如,当我们开始想到代理人可以非常擅长利用智能合约时,我们显然对此非常关注,大约 8 个月前,我们可以坐下来想,天哪,我们完蛋了吗?我们完蛋了吗?然后事实证明,还有另一条路,那就是你可以去弄清楚这些东西有多大的风险,然后也开始进入那些推动这个前沿的实验室,也许开始将加密货币整合到其中,这样我们就可以处于一个位置,当战争迷雾散去,当我们开始看到,例如,现在我们可以采取防御措施,我们就可以行使这些途径。我认为关于奇点和超智能的末日论和极限思维只是抓住人们,因为你可以坐下来,你可以长时间地思考它,它会让你产生强烈的情感,但最终,那不会是真正的东西。你可以去建造东西,你可以与那些推动前沿的人合作,你可以深入其中,你可以开始贡献。你从中获得的信息将比任何人在脑海中想到的都要扎实得多。而且,我认为我们加密货币领域的许多人对此都很熟悉,因为加密货币在历史上大部分时间都是这样的。它非常难以捉摸。很难确定用例将是什么。现在我们开始看到,我们有了价值储存的用例。我们有了稳定币,它们每年都在以惊人的速度增长。该行业催生了整个预测市场,现在它与加密货币相邻,但它正在以惊人的速度增长。而且,五年前很难说会发生什么,这需要一定程度的信心和一定程度的能动性才能去建造这些东西。而且,我认为在文化上,这对 Paradigm 来说是一个非常重要的锚点,因为我们整个公司都围绕着投资和研究而建立。所以,如果你和 Paradigm 团队的任何人或我们周围的人交谈,你得到的稳固感就锚定在我们与前沿保持持续接触的事实上。而且,从中可以获得安慰,稳定性和能动性。我认为值得理解和反思的是,奇点盯着虚空之所以令人畏惧,唯一的原因是,所有这些技术都在为其他人提供能力,从而首先产生奇点。所以,如果奇点让你感到畏惧,那就去拿个拖把吧,做点什么,有工作要做。我认为,最好的前进道路就是这样。如果你因为这些工具让别人拥有了能动性而感到畏惧,你也可以拥有自己的能动性。>> 嗯,这是一种两极分化的技术,对吧?就像代理人执行某项任务所需的门槛正在降低。所以,如果你处于观望状态,你就会被挤压到零,或者你可以做很多事情。>> 是的。而且,我认为从这个意义上说,如果一个人直觉上认为自己可能处于被挤压到零的那一边,那可能会非常可怕。实际上,解决方案是更加开放,更快地采用技术,更加灵活地改变和适应环境。我认为我们团队的某个人曾经提到过,有时速度比凝聚力更重要,我认为我们目前所处的环境,因为前沿是如此未知,在某种程度上是不可知的,所以快速移动和快速适应比坐下来弄清楚会发生什么并找到正确的位置更重要。这有点矛盾,因为你拥有的能动性越多,你似乎就越需要做出正确的游戏选择,选择正确的游戏来玩等等。但实际上,经验上发生的是,快速行动并在 24 小时内完成比坐两周来弄清楚正确的方法然后尝试完成要好。而且,我认为这可能一直延伸到一个人生活的许多方面,我们正处于一个速度优先于凝聚力的时代。>> 是的。是的。我们正处于“就是去做”的时代。我没想到会是这样一集哲学性的开场,但现在我认为我们可以调整自己,将我们的能动性指向我们手头的议题,那就是当人们对 AI 拥有高度能动性时,这对我们的智能合约安全意味着什么?是否值得谈论哪些类型的合约风险最高或最低?是否存在某种我们可以理解的类别或知识领域,当 AI 拥有非常高的智能合约能动性时,我们应该关注某些类型的智能合约而不是其他类型?那里有对话吗?>> 我认为,不是在市场方面。很难说,你知道,DEX 合约与借贷市场。我认为,简单的合约,存在已久,我认为它们可能比例如部署在 Binance Smart Chain 上的第 200 个合约要好,因为在过去,由于在一个小市场中存在一种庇护。所以,如果你部署的东西,如果完全利用它可能赚到的最大金额是几千美元,那么你就被庇护了,因为有更大的鱼,坏人和好人,交易者等等,都不在他们的视野范围内。但随着模型越来越好,并且由于推理成本远低于才华横溢的安全研究员的成本,这种长尾可能会很快被淘汰。所以,我认为风险最高的是小型股,或者在长尾链上的低 TVL 协议,它们仍然建立在易于理解的堆栈上,如 EVM 和 Solidity。然后,我认为对于主要的合约,那些经过实战检验但仍然非常复杂的 OG DeFi 合约,存在着一种不可知的安全风险。而且,在未来一两年内,我们将看到这些合约在多大程度上暴露出来。那些经过大量 Lindy 和大量价值锁定,并经过市场检验的 OG 合约,在短期内更安全。但尽管如此,管理这些合约的人仍然需要有能动性来保持防御姿态,以确保他们赢得与进攻型对手的军备竞赛。>> 嗯,嗯,利用这些合约的奖金要大得多。所以,我认为它会有这种,你知道,可能会有一种金丝雀效应,即较小或不太安全的协议,但拥有大量资产的协议会先倒下。而且,我认为,我们将不得不留意第一次完全由 AI 造成的漏洞利用,然后从那里开始,我们将开始采取必要的防御措施。然后,就像你说的长尾,合约在生产中的测试将不再是问题,因为利用一个 1000 美元的合约的成本是,你知道,10 到 50 美元的代币,那么这些合约根本就不存在了。有人会写一个机器人说,“嘿 Claude,Openclaw,去帮我黑掉一些合约,”然后它就会有能力做到这一点,因为那些没有认真考虑过他们的安全的人,因为他们不需要认真考虑他们的安全,那些人将不会有好日子。>> 是的,我认为这是一个普遍趋势,长尾将被能够很好地使用 AI 的人收集。例如,你可以看看预测市场,有些市场如果你完美地交易它们,你能赚到的最大金额可能是 50 到 100 美元。而且,对于 Jane Street 来说,不值得在这些市场上投入量化分析师,因为成本太高了。而且它受到智力和注意力的成本的限制。但如果你能以每秒 10 美分的推理成本近乎完美地交易这些市场,那么你就会去做。总的来说,长尾可能非常有价值。所以,现在我们生活在一个长尾被其规模所庇护的世界里。随着 AI 在所有这些不同领域变得越来越好,我们应该假设所有这些都将被能够使用这些工具的人收集。>> 让我们谈谈 EVM bench。这是论文,工具。你们称之为工具。对吗?>> 是的,它是一个基准测试,也是一个代理工具。所以,我们可能同时发布了两个版本。第一个评估代理利用智能合约的能力,第二个是类似审计代理的代理工具。所以,它实际上可以找到漏洞。而且,我们发布的代理工具显然不是最先进的,因为我们不希望它被黑帽使用。但我们有一个 UI,你可以上传任何智能合约,它会进行一个基线检查漏洞。>> 你能定义一下 harness 吗?我几乎可以肯定这是一个技术术语,我认为编码人员会知道,但我不知道。>> 是的,核心思想是模型实验室会发布这些 LLM,对吧?所以你会有 GPT 5.3 等等。你可以进行基线测试,就像只是提示模型,只是问 ChatGPT,这个合约里有漏洞吗?然后,除了这个之外,你还可以,比如说,这让你在基准测试中达到 x%,你可以围绕模型添加很多脚手架,说,嘿,例如,这里有一个你可以测试的 EVM。你可以部署一个合约并实际运行一个漏洞利用,看看你是否能够耗尽资金。而且,事实证明,如果你给代理这些工具,这种脚手架,它们会表现得更好。所以,harness 就像基本上它持有代理,模型,并赋予它专门用于任务的超能力。现在,AI 当前弧线上的有趣之处在于,我们添加的这些工具大部分会随着时间的推移而脱落,因为随着模型变得更好,它会吸收 harness。核心例子是,在特斯拉完全自动驾驶开发的早期,Cardi 谈到大部分代码是硬编码的,手写的,很快它就达到了现在我认为超过 50% 是模型本身。他们删除了所有 C++ 代码,这些代码说的是“如果 x 则 y”,模型只是找到了一个方法来做到这一点。所以,现在我们,所谓的代理 harness,在“如果 x 则 y”的硬编码工具中,我们正在添加这些工具来赋予它这些能力。但是,很可能随着时间的推移,它会被代理吸收。>> 我明白了。我明白了。所以,harness 就像一个引导加载程序来启动它,但最终数据将接管数据和经验将接管机器的实际内部操作。>> 是的。没错。是的。我的意思是,现在 harness 在非常违反直觉的方式中非常有价值。例如,事实证明,仅仅赋予代理一个测试环境的能力,即使它几乎不使用它,也会让代理思考更长时间,更努力地尝试,从而获得更好的结果。所以,仍然有如此多的低垂的果实,因为代理本身还没有完全参数化和校准好。但是,是的,我的意思是,我们肯定会达到一个时间点,届时下一版的 codeex 或 opus 将能够自己启动一个 EVM,我们就不需要我们的 harness 了。>> 好的。那么这个工具实际上做什么?这个工具是代理进行利用或打补丁的东西,还是仅仅是基准测试?跟我谈谈实际的效用。核心发布,我们想推向世界的核心是基准测试。模型在利用智能合约方面有多好。基准测试有三个组成部分。第一个是检测漏洞的能力。第二个是修补漏洞的能力。第三个,也是最有趣和最具创新性的贡献,是利用漏洞的能力,这是以前尝试让安全审计代理的尝试面临的最大问题之一,那就是误报问题。所以,代理会来找你,说,“我在合约中发现了 50 个漏洞。”也许这 50 个漏洞中只有一个是真正的漏洞,但你花费的时间太多了,无法找出哪些是真实的,所以它不如人类审计员好。而且,我们在基准测试的利用组件中所做的是,我们利用了加密货币是可验证的事实。我们使用了这个生产级的 EVM 环境,我们加载了一堆链状态,我们设置了一个漏洞环境,让代理尝试利用它。我们利用这一点将误报率降低到几乎为零。所以,到了一个点,如果代理告诉你它找到了一个漏洞,它就有了一个概念验证,它可以利用它,可以在生产级 EVM 环境中运行,并从合约中耗尽资金。而这正是论文的核心突破,即存在一个可验证的环境,实际上导致了非常低的误报率。>> 实际的基准测试是你们已经建立的,你们可以有效地衡量它。>> 是的。没错。因为否则,如果有人说,“哦,我们发现了所有这些漏洞,我们完成了这个基准测试的 90%。”你不知道这意味着什么,因为你无法知道其中一半是真的还是假的,对吧?>> 所以,可验证性最终非常重要。我认为这是模型将很快在加密货币领域变得非常出色的原因之一,因为基本上你可以将与 AI 相关的未来分为两类。一类是可验证的,另一类是不可验证的。可验证的东西对模型来说很容易学习,因为它们有非常清晰的训练信号,并且确切地知道何时做对了,它们可以不断地运行并改进并攀登这座山。而不可验证的东西,你不知道,没有测试。你不知道你是否做对了。所以,你擅长写诗吗?你的笑话好笑吗?这些对模型来说都很难做好。而且,如果你只是看看整个代码宇宙,看看哪个部分是最可验证的,你可能会发现几乎完全是加密货币,对吧?整个基础都基于可验证的概念。这意味着即使我们没有多少合约,也没有多少加密货币人通常在这些实验室里,或者很少,模型已经变得非常出色,因为它是如此可验证。而且,随着模型的改进,例如 Gemini 曾声称仅在上下文中就学会了一种完整的语言。所以,随着模型的改进,你需要的数量可能更少。所以我认为,普遍趋势和轨迹是,这些模型将很快在加密货币领域变得非常出色。我认为我们可以对此打赌。>> 所以,当 EVM bench 论文说“顶级模型从 20% 到 70% 以上的利用率”时,比如最新的 JPT codecs。那是什么意思?20% 到 70%,你是说它接触到的所有智能合约的 70% 都可以被利用,那在实践中意味着什么?>> 是的,在实践中,这意味着我们收集了来自开放审计竞赛(如 Code Arena)的所有历史上的吸金关键漏洞。所以,发现的漏洞不是那种“哦,你知道,你有一个小问题,也许有人可以冻结合约一天什么的。”它更多的是,如果你找到了这个漏洞,你就可以从这个合约中耗尽资金。最初的 20% 或更少意味着,如果你拿一个前沿模型,把它放在前面,所有最难的审计问题,在它的知识截止日期之后,它将无法找到其中的绝大多数。而在基准测试结束时,超过 70% 的意思是,如果你重新运行 Code Arena,而不是 GPT4,而是 GPT 5.3 codeex,5.3 codecs 将会找到人类审计员找到的 70% 以上的关键吸金漏洞。>> 所以,在我们人类审计和发现漏洞的历史中,它会找到其中 70% 的关键漏洞。有一些限制,例如,我们没有追溯到很久以前,我们从知识截止日期之后开始,因为我们想避免污染,所以这给你一个粗略的基准,基本上 ChatGPT 5.3 codeex 的能力相当于所有人类审计员的 70% 左右,差不多是这样。虽然,这些事情是非线性的,例如,有些愚蠢的漏洞会导致合同中的所有资金丢失,但实际上并不难找到。所以,这就是为什么我认为,论文中更值得注意的是,这些并不是模型只发现了一个技巧就达到了 70%。不是所有的重入攻击,对吧?它能够找到各种各样的漏洞。但是,是的,基本上模型正在变得非常接近于最优秀的人类审计员。>> 拥有基准测试的一个有趣之处在于,所有前沿实验室都喜欢竞争基准测试,赢得基准测试,这是人类的最后一次考试。事实上,他们几乎会针对这些基准测试来调整训练。所以,如果你有一个有吸引力的基准测试,它会在所有前沿实验室中传播,那么它似乎提供了一种社会激励,让他们表现更好,训练得更好,以便相互竞争,超越彼此。你觉得 EVM bench 已经启动了这种飞轮效应吗?我认为这是一个重要的,我的意思是,也许放眼大局的观点是,加密货币在其历史上一直被污名化,并且对 AI 实验室来说非常难以理解。所以,事实上,还没有出现对加密货币相关评估的大规模推动,这有点荒谬,因为实验室目前完全受限于可验证且经济上重要的评估。而加密货币同时满足这两个条件。所以,我认为 Paradigm 稍微施加了一点压力才让它在实验室中得到推广。而且,我认为是的,我们的公司希望这将启动实验室更多地关注这项技术的飞轮,我们也将继续在这方面开展工作。你对为什么这么慢有解释吗?这也很让我困惑,因为这一切都是开源的,一切都在那里,而且,我们已经有了所有数据。>> 是的,我的意思是,我们最近与他交谈过,他的解释是,在金融和加密货币方面存在很多责任,以及拥有在这些数据集上训练的 AI 模型,对吧?就像如果 AI 模型利用了漏洞怎么办?那是谁的错?所以,也许这与它有关的风险。>> 你刚才也提到了污名化。我认为,你知道,模因币赌场投机。当然,OpenClaw 的 Peter 曾有过一次负面经历,他将其与加密货币文化联系起来,一群自称是加密货币行业一部分的人试图抢先他并开发模因币,他认为这很可疑。为什么前沿实验室在训练这些极其丰富的数据集方面如此缓慢,正如你所说,它非常适合训练,因为所有这些都可以被验证。我的感觉是,这几乎完全是社会性的。我的意思是,在我这个圈子里,加密货币是仍然最特立独行的行业。我认为部分原因是它在声誉上非常不稳定。部分原因是存在这种动态,即行业内最优秀的人与普通人之间的差距比其他任何地方都要大得多。所以,如果你例如没有接触到加密货币的高质量部分,你看到的就是骗局,这会扭曲你的看法,以至于你完全不屑于这个行业。而且,历史上这方面有很多阿尔法收益,我认为我们中的许多人都受益于这种显著的声誉波动性,如果你在性情上不像其他人那样敏感,你可以在加密货币领域做得很好。但我认为这是一个社会问题,而且它只是关于可读性这一点,关于还没有一个品牌能够弥合加密货币和 AI 世界之间的鸿沟。我认为,如果某些东西触及加密货币,它在 AI 世界中历史上就被玷污了。因此,人们只是试图完全避免它。而这基本上为像 EVMbench 这样的东西在 OpenAI 内部构建和发布创造了一个机会,没有任何竞争。我认为,所有主要的模型实验室都将运行在这个基准测试上,并且可能在其未来版本上运行,而实验室内部没有显著的竞争。就像没有 50 个 30 到 50 个与加密货币相关的基准测试或人们正在发布的训练环境一样。在某种意义上,这对我们来说是具有能动性的,因为它们将完全依赖于加密货币行业来弄清楚什么对他们有价值。但我认为这根本上是一个社会问题,而且它与围绕着,你知道,你看到一个你不认为应该变得非常富有的人变得非常富有,也许是因为行业中有很大的波动性,而且有一个你不尊重的人赚了很多钱,这些都是 AI 研究人员在这些实验室中头脑中发生的事情,导致他们认为整个行业都是骗局。而且,你知道,这使得投资加密货币成为一个绝佳的环境,因为它根本不在硅谷任何人的视野范围内。但我认为这就是核心动态。有趣。有趣。我们知道机器人,这些 AI LLM,它们非常擅长编写代码。这是它们首先擅长的事情。编写 EVM 代码也是如此吗?在编写世界其他代码和 EVM 之间是否存在差距?>> 是的,我的意思是,历史上一直存在,你知道,促使我们开始这项工作的一个组成部分是认识到,这些模型在 Python 方面非常出色,在 Solidity 方面却很糟糕,而且在例如 Solana 相关的代码方面也很糟糕,老实说,任何与加密货币相关的东西。而且,我当时的一个预期是,我们将不得不从行业中众包大量数据,然后将其喂给实验室,让它们更好地掌握这些模型。但事实证明,由于基础是如此可验证,并且由于这些模型存在一定的通用性,它们最终比我们预期的要快得多地变得相当好,而且输入的输入比我们预期的要少得多。所以,存在这种动态,如果你教模型一首英文诗,然后,你知道,用西班牙语教生物学,它就会学会写西班牙语的诗,即使你从未描述过如何用西班牙语写诗,模型也是如此。而且,我认为这种动态也在这里发生,即它正在“学习”加密货币的语言,而没有那么多的直接训练数据。而且,也因为我真的很喜欢,很难低估事物的可验证性,对吧?大多数软件都很难验证。你需要人类标记员去检查,这个东西对吗?它在运行吗?你拥有的唯一可验证的阈值是程序是否编译并通过了测试?但是测试需要由人类编写,对吧?你没有这种概念,我们有一堆状态。我们可以对状态做出断言。例如,我们可以让模型在一个新的 EVM 上运行一个它从未见过的合约,并断言它是否能够“耗尽”其中的资金。这些概念本来都需要硬编码到程序中。但因为它是加密货币,而且有如此多的标准。它是可验证的,模型的能力正在迅速提高。>> 好的。那么你认为现在是加密货币数据涌入以训练这些模型的时候了吗?如果是,你期望未来模型具备哪些能力?我的意思是,是的。它们是否具备技能和我认为的个性,直接连接到核心 LLM 中的加密货币,或者你期待什么样的发展?我们从安全而不是一般的编程能力开始是有原因的。这是因为它具有非常好的形状:它具有极高的经济价值。它在很大程度上受限于智力,对吧?就像你不能,它受限于智力,而且它非常容易验证。所以,我们知道何时发生了漏洞利用。所以,安全能力预计将发展得非常快,我们已经讨论了它的所有含义。其他与加密货币相关的能力。我认为,例如,在机制设计领域或围绕市场相关领域,例如交易所的机制是什么?如何,如果你有一个。
代理商市场,对吧?他们之间协调的最佳方式是什么?嗯,我认为这些是开放的、肥沃的土壤,然后当然你可以深入到协议层,对吧?你可以说,一个模型如何在以太坊区块链上完成一笔交易?嗯,如何在以太坊客户端层面,或者协议客户端层面存在安全方面的问题,对吧?也许有价值千亿的资产存在于开源智能合约中,但以太坊和 Solana 的市值中还有更多,如果能够发现 Gath、RET 等中的关键漏洞,这些都可以被利用。所以,我认为深入到协议层将是重要的。嗯,围绕我以及提取式战术的模型能力。我认为这将产生与长尾黑客相同的效果,对吧?链上有很多东西可以收集,如果你能够完成端到端的流程,找出市场上的阿尔法,构建一笔交易并进行承销,然后提交交易并可靠地将其放到链上。这些都是模型目前并不擅长的事情。嗯,但它们会很快变得擅长。
>> 而这一切似乎对加密货币长期有利。然而,当下和短期,比如当我们阅读 Evan Bench 的论文时,发现顶级模型正在从 70% 以上的利用率。我不确定是该为此感到高兴还是难过,因为嗯,这在某种程度上取决于意图以及谁在利用它。所以,如果是白帽,那太好了。我的意思是,这提高了我们在攻击者之前发现错误和漏洞的能力。然而,如果是黑帽,那就不太好了。嗯,因为,你知道,它提高了他们在我们之前发现这些的能力。所以,这取决于。我想有了这个工具集,它取决于谁在使用这些工具以及背后的意图,才能判断它是短期看跌还是看涨。我想它确实注入了一些波动性和不确定性到市场中。我现在到处都能感受到 AI 带来的这种感觉。它可能非常好,也可能非常糟糕,但有一点是,它不会无聊。它将是 >> 高度波动的结局。>> 我想当你考虑到这里正在解锁的能力,以及 LLM 检测漏洞的能力时,这对于加密货币的短期到中期是好是坏?>> 是的。嗯,我的意思是,你提到了长期来看,加密货币对几乎所有这些发展都持积极态度,并且随着模型在安全性方面变得非常出色,这将提高整个行业的上限,因为这将是一种适者生存的模式,对吧?因为所有薄弱的东西都会被 >> 利用。这取决于我们。我认为这取决于我们,取决于我们所走的道路。嗯,我们指的是行业。嗯,这可能是适者生存。也可能是我们想办法让防御领先。嗯,我认为但核心观点是,这些网络上可以维持的资产数量与它们的安全性成正比,而长期来看,随着安全性的提高,会有更多资产能够安全地留在链上。现在,短期内,我认为我认为这是我们手中的事情之一,对吧?我认为它受行业机构如何最好地处理此事的约束。我们不知道,就像如果我们让时间自然流逝,会有很多不确定性。嗯,我们不知道攻击者,你知道,黑帽是否会在白帽之前获得能力。嗯,但我们也是这个市场的积极参与者,我们可以引导这个方向,例如,确保如果存在前沿模型或未发布的模型,或者存在与 AI 相关的安全新发展,我们将这些引入顶级协议。嗯,你知道,你可以想象的短期到中期的一种世界是,你总是让每一个合同都受到敌对行为者和防御行为者的 24/7 扫描。当出现一个漏洞时,嗯,你知道,谁先发现它,谁就会做出相应的反应。然后在这个世界里,这只是好人与坏人之间的一场比赛。嗯,嗯,我认为我们拥有相当大的优势,在确保好人在这场比赛中领先方面,一旦所有合同,就像薄弱的合同被利用,或者我们已经加强了安全性,使它们无法被利用,我想这给了我们一个极其坚固的全球金融体系,一个超 >> 几乎是完美的,对吧?就像有多少个九?我的意思是,也许是四个九,五个九。>> 嗯,它几乎为世界上的金融资产创造了一种安全性的“哑铃模型”。就像 >> 最安全的金融资产可能在这种黑暗森林环境中,就像在链上。我们怎么知道的?因为 >> 嗯,世界已经尽其所能,包括我们最聪明的 LLM,而它仍然在那里。它仍然屹立不倒,对吧?没有被利用。这将是哑铃的一侧。另一侧,老实说,是完全存在于数字世界之外的东西。你知道,就像一团金块,或者像 >> 数字黄金,>> 对吧?然后中间的一切都将是相当容易被利用的,相当不安全的。我想知道这是否就是我们世界的前景。>> 是的,直到 LLM 们学会如何合成黄金。对吧?对,然后派机器人去抢黄金。>> 对。嗯,是的,我认为我认为,我认为这似乎有道理,我认为这种“哑铃”的视角可能就是事情的发展方式。嗯,我想我与加密货币作为行业以及作为技术的关系是,如果你从第一原理的视角开始,比如说你想以光速进行支付,对吧?就像我想从美国给你发送瑞安的钱到欧洲或其他世界某个地方。嗯,我发送它的速度和我发送电子邮件一样快。你遇到的问题是,你不知道我是否也把这笔钱发送给了大卫,对吧?你有这个双重支付问题。而这就是比特币解决的问题。它将交易时间缩短到大约一个小时。从那时起,我们有了连续的发展,提高了这些交易的速度和表达能力。我认为,我认为在这个世界观中,这不仅仅是偶然发生的事情,加密货币行业以这种方式出现。嗯,而且实际上,如果你从第一原理向前推演,这就是它必须如此的方式。嗯,你最终会得出这样的结论,你知道,如果你有想要以互联网的速度移动的代理,而当前的银行系统是在汽车发明之前创建的,那么这些代理将会发现加密货币轨道是正确的交易方式。嗯,你知道,我认为也许在 6 到 8 个月前有一个担忧,对我来说绝对是这样,当时不清楚代理是否会足够擅长加密货币相关的软件,以便他们能够发现当前的轨道,也许他们不得不从头开始重新发明它们。但在过去的 6 到 8 个月里,当我们与 OpenAI 合作时,越来越清楚的是,嗯,一是加密货币内部有非常强大的网络效应,二是这些代理能够学习,它们只是想学习这些可验证的东西,而加密货币在这份列表中排名很高。所以,所以目前我认为,你知道,我对加密货币作为这些代理的底层结构变得极其极其看好。嗯,我认为这是一个开放的比赛。加密货币中谁将赢得这场比赛?但是,但是技术的形状非常适合它。>> EVM 是迄今为止加密货币中最常见的编程语言编程环境。Solidity 是最常见的语言。然后有一些长尾语言,比如 Cardano 的 Haskell。嗯,我们知道 AI 喜欢数据。AI 能够获取的数据越多,它就能做得越好。嗯,你认为围绕环境的网络效应如何影响 AI?比如,EVMS 将成为 AI 工作的主要环境吗?>> Solana 的 >> SVM,Solana 的 SVM 呢?它也跨过了门槛吗?或者也许门槛是一个错误的说明。你怎么看?>> 我认为这实际上很难说。嗯,目前球还在空中。我们不知道。嗯,我能指出我们开发 VMBBEN 时遇到的一些瓶颈,我们也确实开始着手开发 Solana 相关的组件。但例如,一个挑战是,它实际上需要大量的人才,人类人才来能够进入并构建这些评估。而这对于 Solidity 来说要容易得多,而这些东西很难构建,对吧?这些是相当沉重的基础设施。所以,所以即使是微小的摩擦增加也会导致,嗯,当你需要在某种程度上削减范围时,你不得不首先削减那些你更容易做的事情。嗯,话虽如此,我认为关于嗯,你知道,一是加密货币的可验证性是一个巨大的优势,二是这些模型在学习新编程语言方面越来越不挑剔。我认为最终的竞争可能比看起来更公平。嗯,我认为,你知道,至少我们有意愿和兴趣去跨越生态系统并深入到协议层,并使这种加密货币旗舰基准更加广泛。嗯,但是,是的,目前显然存在围绕 EVM 的网络效应。嗯,对。另一个反直觉的例子,为什么像 Solana 这样的公司能够赶上,是因为嗯,乍一看,大多数合同都是闭源的,这似乎非常糟糕,但如果你从“如果它是开源的,它就会进入训练集”的世界观来看,那么闭源的基准和用于训练的合同可能对模型的开发更有价值,因为它不在训练中。例如,我们有这些所谓的“金丝雀标签”在我们评估的各个部分,将它们从大多数模型的训练过程中过滤掉。所以,你知道,你可以做一些技巧,但仍然有可能这些 EVM Bench 中的错误会随着时间的推移泄露到模型的预训练中,而如果它是闭源的,它就不会泄露。所以,所以我的期望实际上是,你知道,一开始会有些不对称,但实际上模型将变得非常擅长所有这些,而且将是一种基于价值的,嗯,嗯,谁是最好的将脱颖而出。你是否持有 USDT 或稳定币,在获利后,并想知道下一步在哪里部署?如果你可以在不离开加密货币的情况下获得股票、黄金和 ETF,那会怎么样?这就是 BitGet 上的代币化股票所能实现的。传统市场仍然无限时交易,但资本正在 24/7 流入链上。在 Bit,你可以 24/7 交易代币化股票和 ETF,最高可达 100 倍杠杆,所有这些都直接以 USDT 或 USDC 结算。无需经纪账户,无需出金,无需平台切换。Bit 已经处理了超过 180 亿美元的代币化股票交易量,其中大部分发生在过去一个月。该平台目前占据了 Oando 代币化股票现货市场份额的近 90%。随着黄金和白银创下历史新高,链上交易也随之而来。在过去两周内,与白银相关的 SVLO 和与黄金相关的 IAU 的交易量在 Bit 上飙升。这就是 Bit 的通用交易所愿景的体现。加密股票和现实世界资产在一个地方,以加密原生速度和灵活性构建。如果你想像交易加密货币一样交易股票,请在 Bit 上探索代币化股票。通过点击节目说明中的链接了解更多。这不是投资建议。很少有人在加密货币领域公开做出顶部或底部预测时真正投入真金白银。DeFi Report 就是其中之一。在 10 月 10 日闪崩前一周,DeFi Report 的 Michael 给他的整个通讯发送了电子邮件,说他将采取激进的风险规避策略,并将他大部分的加密货币头寸卖出为现金。那时 ETH 约为 4000 美元,比特币为 110 美元。Michael 运营着 DeFi Report,这是一个基于数据周期意识、风险管理、透明度以及最重要的是真金白银的行业领先研究平台。我们喜欢 Banklist 的 Michael。我们喜欢他的分析,这就是为什么我们大约每个月都会在 Banklist 播客上听到他的声音。DeFi Report 为 Bankless 听众提供一个月免费访问 DeFi Report 的权限。所以,如果你正在寻找一些敏锐的数据驱动分析,以便在你的投资组合周围做出更明智的决定,你可以了解 Michael 是如何预测顶部以及他接下来要做什么。一切都在 DeFi Report Pro 中。查看一下。节目说明中有一个链接。以太坊的愿景是最终正式验证其整个端到端的技术栈。嗯,我们首先必须完成链的构建。我们必须克服所有困难才能实现这一目标,但最终我们希望对整个以太坊技术栈进行正式验证。嗯,基于 AI 的正式验证是真实存在的吗?AI 能力如何融入正式验证的讨论中?>> 是的。嗯,我的意思是,我认为这是真实存在的。嗯,去年我们投资了一家名为 Harmonic 的公司,这是一家由 Robin Hood 的联合创始人 Vlad Tanov 和 Tutor 创立的基金会数学模型。嗯,我认为他们的一些理论,以及世界显然正在走向的方向是,嗯,正在生成的软件比人类能够审查的要多。嗯,正式验证是快速检查软件组件是否真正按照其声称的那样工作的的一种方式。嗯,然后显然在安全性的背景下,嗯,它可以,特别是如果规范写得正确,它可以是一个阶跃式的变化。现在它不是万能的,因为你仍然必须为正式验证编写规范。所以仍然存在漏洞进入那里的可能性,但你知道,你可以说,实际上编写正式验证规范的漏洞可能性可能比一开始编写代码要低。而且,随着时间的推移,我认为所有最好的嗯,所有最好的模型,所有最好的软件,很可能最终都会经过正式验证。嗯,嗯,如果你从一个代理的角度来看,你有两个选项,一个是经过正式验证的,一个是未经正式验证的。经过正式验证的那个可能只是获得偏好,因为它具有所有这些很好的属性。>> EVM Bench 论文中有一个名为“未来方向”的部分。EVM Bench v2 看起来是什么样的?这个项目如何从这里发展?>> 我们最高层级的目标是帮助模型实验室开发其模型的加密能力。我认为安全性是其中的一个组成部分,也许是越来越紧迫的组成部分。但它还有很多 EVM Bench 没有触及的地方。所以有其他的生态系统和技术栈。有协议层,我们已经讨论过,也许从安全性的角度来看,以太坊协议比任何特定的 Solidity 合约都更重要。嗯,有协议外的组件,比如如何在链上完成一笔交易?如何处理内存池?如何处理加密货币的非确定性部分?嗯,然后显然还有一些组件,它们在可验证性和智能边界的轨迹上更进一步,比如关于密码学和零知识证明等。我认为所有这些都是未来工作的极其肥沃的土壤。嗯,所以我们目前正在开放,试图为 EVM Bench 的未来版本寻找合作者,嗯,我们显然也在努力推进我们自己的下一步。嗯,我认为这个方向是,我们终于在模型实验室有了一席之地,可以将加密能力融入前沿模型,我认为我们应该作为行业利用这一点,我们应该努力让这些模型尽可能擅长加密货币。>> Elin,你非常聪明,正如这篇论文和这次谈话所证明的。你拥有高度的能动性。显然,你正处于前沿。你选择了留在加密货币领域,而不是去 AI 领域,而且你似乎对加密货币非常看好。即使在这个时刻,你似乎也很看好,这是一种逆势而为。对你个人来说,为什么是加密货币?我个人在脑海中从未对行业有过明确的界限。嗯,我认为,你知道,我们谈论的是,我从事 X 工作,因为,为了让其他人能够理解我们在做什么,但我认为这不是正确的相处方式。嗯,我花了所有这些时间在加密货币领域,因为它一直是我,它一直非常具有智力上的趣味性,而且它具有,正如我提到的,它在我最聪明的那些朋友中仍然非常具有逆势性,以至于我能够准确地指出他们错过了什么。我认为这是一种,这是一种一个人所能要求的最好的。嗯,我认为,你知道,我们谈论过加密货币如何对 AI 的安全发展持积极态度,但是,你知道,你可以认为它对当今世界的大多数发展都持积极态度。比如,随着新的商品和智能的创造等变得商品化,稀缺资产变得更有价值。嗯,随着地缘政治不稳定性的加剧,那些超主权系统,在任何司法管辖区之外,那些相当于金融领域的端到端加密的系统,那些有更多空间蓬勃发展。我认为,你知道,我在土耳其长大,我的大部分家人还在那里。我认为在美国长大的人,以及总的来说在一个稳定的世界里的人,没有那种,当世界不稳定时会发生什么的感觉。我认为,你知道,在我长大的国家里,许多人正在开始采用加密货币轨道,并将其作为一种救生艇,我认为对我来说越来越清楚的是,这项技术正在以一种复利的方式发展,去做真正伟大的事情。所以,再加上这一点,你环顾四周,没有人甚至在谈论它,这真的很令人兴奋。>> 是的。而且你似乎确信 AI 的加速将使加密货币受益,它将是,你知道,所有船只都会一起上升。我认为,嗯,虽然有一类软件行业是 AI 在短期内似乎无法从中受益的。你知道,Anthropic 发布了一个新的安全模块,所有网络安全股票一天就下跌了 10% 到 15%。嗯,你为什么如此确信 AI 的加速将有利于加密货币?它不是,显然,现在没有什么可以保证的。嗯,我认为如果我们让一切顺其自然,它可能对加密货币不利。它可能对加密货币有利。我们不知道。我想,嗯,我所拥有的信念是,如果我们朝着我们想要的方向推动事情,我们可以让 AI 对加密货币非常有益。嗯,嗯,而且我认为这里还有一个组成部分,我确实坚信,如果你从第一原理重新推导所有这些,你会得出一个与我们目前在加密货币领域达到的地方非常相似的结论。嗯,嗯,是的,我认为我认为,因为我们已经讨论过的所有原因,因为基本原因,加密货币对 AI 非常有利,而 AI 对加密货币也非常有利。所以,我认为,我认为,你知道,没有什么可以保证的,我们仍然需要行使我们的能动性,但是,但是我认为,因为我们到目前为止讨论过的所有原因,对我来说很清楚,这些事情将以积极的方式汇聚。>> 好的,让我们以高能动性和信念结束。嗯,Alpin,非常感谢你今天加入我们。>> 好的,谢谢你邀请我。>> 银行家听众们,当然,这一切都不是财务建议。你可能会损失你投入的钱。希望有一个 LLM,一个白帽正在保护它。我们正朝着西方前进。这是前沿。它不适合所有人,但我们很高兴你在 Bankless 之旅中与我们同在。非常感谢。