📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

(26.02) 놓쳐선 안 될 미래뉴스

미래채널 MyF33:09

Transcription

是的。您好。我是未来播报员黄俊元。最近,新闻报道如潮水般涌来,声称“太疯狂了”、“太厉害了”、“不了解这个就麻烦大了”。我将收集过去一个月中最重要的消息,并于每月最后一个星期六进行播报。那么,让我们一起来看看二月份有哪些新闻吧。

是的。二月份,像Claude Co-work和Open-celo这样的AI代理服务似乎引起了一股热潮。可能感兴趣的开发者们已经体验过了,但对于非开发者来说,这非常令人困惑。我将为您整理出要点和主要内容。首先,让我们看看Claude Co-work这项服务。

这项服务的推出甚至导致了软件公司的股价暴跌。那么,Claude Co-work的优势和差异化之处究竟是什么,才引起了如此大的骚动呢?

首先,不同之处在于,它不是一项我们在云端使用的服务,而是您安装在电脑上使用的服务。因此,它有Mac版本,目前也有Windows版本。您可以认为AI代理可以控制您PC的范围扩大了。其中,不同之处在于,它可以访问您电脑上的文件夹。不像ChatGPT或Gemini那样一个一个地上传文件或图片,它可以一次性分析整个文件夹。

那么,这可以用于什么呢?例如,如果您有大约100张需要报销的收据堆积在那里。您不必像使用ChatGPT服务那样一张一张地上传,而是可以指定整个文件夹,然后让它将每张收据中的信息整理成Excel文件。例如,日期、项目、费用、分类。然后,它会制作图表,显示您在哪些方面花费最多,并以易于理解的方式呈现。如果您这样要求,代理,Co-work代理,就会制定计划,并通过Excel或Web浏览器控制等必要的技能来处理。

文件夹中已经生成了Excel文件。您可以查看分析和图表。虽然我认为它还没有达到可以在实际工作中使用的洞察图表水平,但有一点是,您不能仅仅因为看到这一点就感到惊讶。事实上,我们没有办法知道AI是否准确地记录了所有收据明细。因为我无法一一核对超过100张的收据。因此,无法信任这一点仍然是其局限性。

另外一个不同之处在于,过去,当要求AI服务进行网络搜索时,它会打开一个虚拟浏览器,或者运行一个单独的代理浏览器。但对于Claude Co-work,它会使用您正在使用的浏览器来处理工作。现在,它正在请求浏览器访问权限,因此它正在打开您的浏览器进行搜索、填写表格和收集信息。当要求它分析我的未来频道YouTube频道时,它会自动搜索并进行分析。此功能并非立即可用,而是需要安装Chrome浏览器上的Claude in Chrome扩展程序才能运行。

我最惊讶的是这个。我将2025年成为独角兽的公司整理成了一份文件。上传这份文件后,我发出了这样的指令:查找每家公司的信息,访问每家公司的网站,查找他们在网站上强调的官方信息,并将其制作成PPT文件。每家公司的主要信息整理成10项。并要求查找代表性产品图片并附在同一页面上。这里的优势就显现出来了。代理不是一个一个地查看网站,然后继续下一个,而是并行地一次性查看。由于同时查看12家公司,速度加快了。它按照我指定的指令执行了任务。但是,如果您查看结果,您会发现这是AI制作的PPT,这还是有点明显的。因此,它仍然无法达到在这个领域工作了很长时间的人的PPT质量,这也是一个局限性。尽管如此,它能够并行处理工作,这一点给我留下了深刻的印象。此外,Claude Co-work可以连接插件,连接后,您可以利用研究、客户支持、数据分析、财务、法律处理等领域的专业功能。其中,特别是法律功能,即合同审查、保密协议分类、法律简报等自动化功能引起了轰动。所有功能都可以根据组织的风险承受能力进行配置,并且是为商业法律顾问、产品法律顾问、诉讼支持团队等设计的。它可以自动处理需要处理的文件,区分律师需要仔细查看的文件,并根据条款判断风险程度并限制修改,因此在法律领域非常有用。这就是引起轰动的原因。股价,软件股价暴跌。根据路透社的报道,情况如下。

该工具是Claude代理的插件,可以执行法律、销售营销、数据分析等多种任务。投资者担心,如果这项尝试成功,可能会给从金融到法律编码的各个行业带来混乱,因此软件股价暴跌。人们担心,如果一个Claude AI代理就可以处理各种任务,而无需购买昂贵的第三方软件,那么软件公司不就完蛋了吗?

事实上,高盛等公司正在与Anthropic合作,开发用于会计合规领域的AI代理。未来,AI代理的发展可能会导致软件购买和订阅的减少。当然,该领域的员工数量也可能减少。

那么,Claude Co-work的局限性和缺点是什么呢?我经历的一个缺点非常大。每天可用的配额并不多。我购买了19美元,约合27,000韩元的套餐进行了使用,但测试了大约六次后,就提示当天配额已满,无法继续使用。您只能使用几次。如果想进一步使用,需要升级套餐,而最高套餐每月约15万韩元。因此,我认为除非您真的非常感兴趣并且一定要尝试,否则目前没有必要订阅。

此外,还有一项比Claude Co-work服务能做更多事情的AI代理服务引起了轰动,那就是Open-celo。它的名字一直在变化。它的出现让开发者们欣喜若狂,而开发公司则禁止使用它,因为它很危险,引发了各种争议。

那么,Open-celo有什么优势和差异化之处呢?我们通常使用ChatGPT或Gemini时,我们输入的数据会传输到该公司的服务器进行处理。但Open-celo的优点在于它是开源的,可以安装在您的电脑上并在本地运行。

但是,直接安装在电脑上使用可能会有风险。因此,人们购买新电脑来运行它,而据说最适合运行它的PC是Mac Mini,因此Mac Mini出现了抢购现象。另一个差异化之处在于,在向Open-celo发出指令时,您不必进入服务,而是可以将其与各种信使应用程序联动。当您在信使的聊天窗口中输入“请帮我做这个”时,它会连接到您的电脑并处理该任务。使用起来更方便了。

我将为您整理其他特点。它会在后台持续运行,AI将直接控制您的电脑24小时。AI可以发送电子邮件、移动文件、安排约会等,并生成结果。Open-celo实际上是一个行为模型,而作为大脑起作用的模型,我们可以选择使用OpenAI的模型或Google的模型。Open-celo本身不是一个大脑模型,而是一个可以连接各种工具的代理模型。

另一个特点是,它会以文本文件的形式保存与用户的对话习惯等信息,并进行长期记忆。AI服务有时会忘记您在上次对话中说过的内容,但它们可以长期记住您的习惯。此外,您还可以从市场中选择并安装100多种功能技能,或者自己创建。它可以做的事情是无穷无尽的。

ChatGPT和Gemini由于安全、成本、不稳定等原因,不提供控制您电脑的功能,但当这些限制被解除时,开发者们就开始尝试各种各样的尝试。

那么,我将为您介绍一些具体的应用案例。如果您在WhatsApp中输入“请帮我预订明天早上7点的餐厅”并发送,它会自动搜索并进行预订。通过连接加密货币交易所的权限,您可以创建一个系统,在24小时内监控市场并直接买卖比特币。每天早上分类和总结电子邮件,然后通过Telegram发送简报也是可能的。通过信使输入“关灯”,它会识别用户的位置并关闭灯光,从而实现智能家居功能,可以无限地创建。您还可以24小时监控竞争对手的产品价格变动情况,并撰写应对报告。可以做的事情是无穷无尽的。

但是,其局限性和缺点也相当大。如果没有这些缺点,OpenAI或Google可能已经完成了。由于错误的输入或执行,重要文件可能会被删除,或者存在感染恶意病毒的风险,因此人们不是在自己常用的电脑上,而是在新电脑上安装并尝试。因此,对于普通用户来说,这是非常危险的。

在可以安装功能的技能市场中,已知存在大量信息窃取等恶意技能。还存在个人信息、API密钥、密码、银行账号等泄露的风险。Open-celo本身是免费的,但与之连接的AI模型,如果使用免费模型,则只能使用几次。最终,如果使用ChatGPT模型或Gemini模型等付费模型,每次使用都会产生费用。它并非完全免费。

此外,与完全自动化的幻想不同,还需要用户确认其是否正常工作并进行干预的过程。它仍然有很多局限性。如果没有基本的开发知识,安装和运行会很困难,因此开发者们会兴奋地使用它,但对于非开发者来说,它是一个非常复杂且危险的工具。以前,也有一个名为Auto-GPT的类似概念出现,在开发者中引起了轰动,但现在已经消失了。因此,普通用户不小心使用可能会出现问题。这是彭博社的一篇报道。有人将iMessage的访问权限授予了Open-celo,然后AI向该人及其妻子发送了500多条消息,并向联系人发送了垃圾邮件。而且,即使不是您命令的,如果它们不断地进行问答并持续运行,您使用的模型就会产生持续的费用。风险相当大。

因此,除非您是渴望测试这些新技术并想尝试各种东西的开发者,否则普通用户可以忽略它。

此外,这项服务很快就会在OpenAI的ChatGPT上运行。因为开发Open-celo的Peter Steinberger加入了OpenAI。Sam Altman说:“这个人是一位天才,他对未来非常智能的代理如何协同工作以完成非常有用的事情有很多很棒的想法。这将成为我们产品提供的核心。”他这样说道,并聘请了他。

那么,这两项代理服务带来的热潮有什么启示呢?最大的启示在于,人们对从对话式AI转向行动式AI的关注度更高了。从独自工作的AI转向团队合作的AI的范式转变。代理并行处理工作,或者将工作分配给特定领域的代理并汇总内容,这些都将是未来AI代理的运行方式,许多人预测如此。我们在这里看到了人类从实务人员向AI代理管理者和指挥者的角色转变的可能性。

此外,我们还可以设想一人公司和与多个代理一起工作的人们将变得普遍。在运行这些代理时,是在云端运行,还是安装在自己的电脑上本地运行,哪种方式将普遍化,还有待观察。最重要的是,对运行AI代理所需的新安全系统的需求也引起了人们的关注。事实上,AI代理的方向已经确定。AI代理能够做得更多、更准确,并控制我们的电脑和手机,这是既定的发展方向。为了做到这一点,安全性很重要,但成本和速度的改进问题仍然存在。如果将其过程中的必要步骤称为100步,那么这次又向前迈进了一步。您可以将意义放在这一点上。我认为,对于普通用户来说,等到这些问题都解决,并正式集成到ChatGPT或Gemini中时,再使用也是可以的。

是的。中国抖音的母公司字节跳动开发的名为C-dance 2.0的视频生成AI,因其出色的性能引起了轰动。首先,物理定律和形状一致性的保持非常出色。

正如您所见,即使是如此复杂的花样滑冰动作,甚至是双人动作,也保持了相当好的一致性。物理定律似乎也得到了很好的实现。

它似乎也非常适合用于广告。这是一则可乐广告,蒙娜丽莎复活并偷喝可乐。这是字节跳动制作的。虽然中间一个人手中的杯子消失了,但它相当令人印象深刻。这个也很神奇。图像参考功能很棒。因此,如果说第一张照片中的女孩在第二张照片中做什么,在第三张照片中做什么,那么就可以将这些联系起来制作。

我最惊讶的是这个。如果您制作一个故事板,它就可以一次性制作出摄像机角度和效果。第一个场景是什么,摄像机如何移动,旁白是什么,声音是什么,所有这些都可以一次性输入。

如果您输入故事板,输入您需要的图像,然后输入提示,它就会根据故事板制作简短的视频,改变摄像机角度和效果。这又进化了一步。

因此,用户们现在正在发布评论。这很神奇。你们知道《鬼灭之刃》这部动画吗?这是用C-dance制作的《鬼灭之刃》动画。它不是动画的实际片段,而是用户命令制作的动画。我认为其动作和一致性保持都非常出色。

此外,它还擅长将著名的动画真人化。据说还可以将过去流行的《龙珠》漫画中的主角制作成真人风格,就像老武打片一样。

还有名人。布拉德·皮特和汤姆·克鲁斯正在进行动作戏,他们的面部表情非常相似。非常自然。这是以“为什么杀了艾普斯坦”为概念用C-dance制作的视频。将来,演员可能不需要亲自表演了。

我再次感到惊讶的是这个。有人成功地使用C-dance在短短20秒内将汽车变成了恐龙。即使是这样的特效,任何人都可以非常便宜且简单地通过打字来制作。

我们是如何走到这一步的呢?C-dance的宣传内容整理如下:多名人物的互动、体育、武侠动作等复杂物理动作的再现精度有所提高。空中旋转、落地、碰撞、重力反应等违反物理定律的现象有所减少。最多可以同时输入九张图像、三个视频、三个音频和文本。可以生成与视频节奏完美匹配的背景音乐和效果,并且即使是长指令或复杂的故事板也能保持逻辑性的视频流程。但是,多人唇语同步精度、精细细节稳定性、偶尔的音频失真等仍是未来的改进课题。

尽管如此,这是字节跳动发布的C-dance 2.0的基准测试数据。与Cling、Sora、B3等相比,它也表现出了非常高的性能。截至视频拍摄日期,它尚未在韩国发布,但预计很快就可以使用。但这也成了一个问题。正如您刚才看到的,出现了《鬼灭之刃》、布拉德·皮特等人的脸和角色。因此,版权问题正在发生。迪士尼、派拉蒙、日本政府等都要求暂停。但它对视频制作的影响是巨大的。一位好莱坞视频制作人曾说:“老实说,我们完了。”从事视频制作的人们可能会感到非常紧张。迄今为止的发展令人惊叹。2023年,如果说威尔斯在吃意大利面,那也只是那样。仅仅两年过去,使用C-dance就可以制作出如此自然的视频。

如果再过两三年,发展到这个程度,未来会如何发展呢?

与C-dance一样受到关注的还有中国新发布的Cling 3.0模型。这个模型也很好地实现了物理定律,保持了一致性,并且能够很好地实现摄像机角度等,因此许多人认为它的性能可以与C-dance 2.0相媲美。

我们现在可以仅凭想象来制作这样的视频了。我们是否已经进入了一个任何人都可以轻松制作自己想要的视频的时代?

您可以在Field中选择Cling 3.0作为视频生成模型来使用。您需要付费订阅才能使用。

让我们来总结一下迄今为止的发展。2023年,当Runway Gen-2或Pika出现时,它们非常糟糕。视频生成时间也只有4秒。一年后的2024年,出现了视频长度和一致性有所提高的Sora 1和Cling模型。到2025年,B3和Sora 2的出现,音频被整合到视频中。这意味着可以一次性生成对话。到2026年,将提供摄像机角度和多镜头,普通人将能够实现导演级别的控制。

您可以看到,2026年备受关注的模型是中国模型。中国在版权问题上不太敏感,视频生成AI在中国发展,这真是具有讽刺意味。

再过大约三年,视频产业将发生巨大变化。

是的。大型企业谷歌发布了新的AI服务,我将为您介绍一下。首先,其下一代版本,三维模型Geni 3已经发布。它变得太好了。首先,有一个可以输入描述背景的提示部分,还有一个描述在其中移动的角色的部分。您可以创建预览,然后如果觉得不错,就点击“创建世界”按钮,就可以让您设定的背景和角色在其中移动了。您可以控制角色,并且可以创建与之匹配的交互,例如跳跃或碰撞。还可以更改角色。这次是兔子在移动。它可以是任何角色,任何环境。一个可以创建世界模型。

如果这个发展下去,会发生什么呢?物理定律也得到了实现。您可以拍摄您自己的猫和房间的照片,然后将您的猫移动到那个空间进行探索,并将其制作成简单的游戏。

总结一下,这是一个下一代通用世界模型,可以创建具有实时交互的虚拟世界。它能够生成720p分辨率的逼真图形。虽然还不是超高分辨率。即使再次访问特定地点,它也能记住细节。它可以在几分钟内保持世界的一致性,但目前只能制作1分钟。您可以通过文本控制世界内的事件,例如天气变化、引入新对象或角色。这是一个优点。它还可以作为自动驾驶汽车、机器人和AI代理的安全虚拟训练场。因为物理定律也得到了实现。另一个优点是,它可以为学生提供历史教育、探索等学习环境。对于普通用户来说,他们可以想象自己想做的事情,创建虚拟角色,然后戴上VR或智能眼镜进行探索,这让人联想到元宇宙的发展潜力。

但是,目前其行为范围有限,交互时会出现问题。文本表达仍然是其局限性。它还有很长的路要走。

例如,它的局限性在于,当我的身影映在镜子里,我转身时,镜子里的我却走了出来。这种镜子测试显示了其局限性。它仍然没有完全理解世界。

尽管如此,用户仍然可以做很多事情。您可以放入自己的角色,放入您喜欢的动画《火影忍者》的场景,然后就可以在火影村的背景中漫步了。目前韩国尚未提供此服务。它面向美国用户。但是,它的出现引发了“那么,以后Unity或3D游戏开发引擎是不是就不需要了?”的危机感,导致这些公司的股价暴跌。

然而,韩国主要游戏公司的立场却有所不同。根据报道,主要游戏公司认为AI在短期内难以取代游戏产业。对于最高级别的AAA级游戏,AI很难完全制作。因为质量还有待提高。

它需要大量的GPU容量,并且持续时间很短,因此短期内很难完全取代游戏。然而,他们也认为这是一个机会,因为可以通过将AR融入游戏制作服务过程中来降低成本并提高竞争力。

我们应该想象一下,这个世界模型将如何融入我们的日常生活。此外,谷歌不仅发布了这样的模型,还将音乐生成模型Lyria 3集成到了Gemini中。现在,您可以在Gemini中通过打字来创作音乐。我先进行了测试。我要求制作一首重复“Make up future”歌词的电子音乐,并加入了电吉他、合成器、鼓等。请听一下音质。

[音乐]

这首歌听起来有点幼稚,不是吗?所以我用Suno发出了同样的指令。请听一下音质。

[音乐]

音质差异太大了。但是,Lyria 3的优点在于,您可以放入您想要的图片,然后要求它制作与该图片相符的歌曲。我放入了一张我滑雪的照片,然后要求它制作最适合的音乐。请听一下。

[音乐]

这太奇怪了。因此,目前看来Lyria 3无法超越Suno。此外,据宣传,生成的音轨中会嵌入隐藏的水印,可以检测是否为AI生成。

此外,谷歌还发布了其服务Pomelo的更新版本。使用它,制作广告图片似乎会变得非常容易。

这是宣传视频。放入我们的产品,然后选择模板,就可以制作出看起来不错的广告图片。这个看起来不错。如果您这样要求,就会制作出面霜的广告图片。它以非常商业化的质量制作。并宣传可以下载并用于营销。

这可能会给相关行业的人们带来失业危机。因此,谷歌拥有各种服务和AI模型,因此正在将其可能性扩展到各个领域。关注谷歌的AI将扩展到哪个领域也会很有趣。

是的。我将为您整理一下二月份中国人形机器人发展的最新情况。这太令人惊讶了。

首先,Unitree G1在中国的春节期间进行了彩排,它们集体表演了武术动作。有人和机器人,但人们的注意力更多地集中在机器人身上。

当许多机器人如此有条不紊地做出这样的动作时,没有什么比这更能吸引眼球了。作为活动用途,人形机器人似乎已经充分展现了其价值,并且像节日表演一样受欢迎。

此外,要制造更多这样的机器人,就需要降低人力成本。Unitree G1还公开了自己制造零部件的场景。从字幕中可以看出,速度是AI生成的两倍。

这是在杭州的机器人生产设施中工作的视频。这是在精密组装关节执行器。它们正在制造自己的零部件。

我认为如果将来采用这种方式,机器人制造成本肯定会降低。顺便说一句,Unitree G1目前正在韩国的Electro Mart永登浦店销售。它已经迅速进入了我们的日常生活。

此外,中国波特拉机器人能够以每秒10米的速度奔跑,引起了轰动。它正在与创始人进行比赛,速度越来越快。创始人稍微快一点就会摔倒,但机器人却能适应并奔跑。

我看了看到底能跑多快,结果创下了超过每秒10米的新纪录。但是,我不确定上面挂着的物体对速度有多大影响。

报道整理如下:这是中国美科科技公司的产品,并宣传其是目前人形机器人中速度最快的。身高175厘米,体重75公斤。该公司表示,其目标是开发接近或超越人类运动能力的机器人。

它不仅在运动能力上,还在开发与人相似的机器人。这是一个名为Moya的机器人。它与人类非常相似,但更接近于人体模型。它模仿人类的行走方式,但我感觉它有点机械化。

报道整理如下:这是中国机器人公司Droid Up开发的机器人,它声称是世界上第一个完全仿生智能机器人。虽然中国有时会夸大其词,但我认为他们在多个领域开发和推广人形机器人是积极的。身高165厘米,体重32公斤,相对较轻。它将表面温度维持在32至36度,营造出与真人接触般的真实感。它以92%的准确度再现人类的行走姿势,并自然行走,但我不同意这一点。

但是,当机器人变得越来越像人时,就会出现问题。那就是“恐怖谷”效应。当机器人越来越像人时,好感度会上升,但在某个时刻,好感度会急剧下降,产生一种奇怪的机械感,就像看到僵尸或安德罗伊德机器人一样,这就是恐怖谷。但是,如果能克服这一点,好感度就会再次像看到健康的人一样急剧上升。但刚才看到的Moya似乎就陷入了其中。我很好奇,什么时候才能制造出能够克服恐怖谷效应,引起与人类同样好感度的机器人。我认为中国可能会在这方面领先。

最后,这则新闻也很有意义。中国的一款名为“天宫”的机器人成功地通过低轨道卫星通信,而不是地面的有线通信。

详细消息整理如下:这款机器人由X-Humanoid公司开发,据说是世界上第一个成功连接到低轨道互联网卫星的机器人。那么有什么好处呢?即使在地面网络中断的极端环境下,机器人也能稳定运行。在战争情况下,网络基地被摧毁,但机器人军队仍然可以行动。在灾难情况下,即使电缆断裂,人形机器人也能帮助人类。当然,特斯拉的Optimus未来也有可能通过Starlink服务实现类似的功能,但中国率先成功尝试这一点也很有意义。

正如您所见,中国在机器人发展方面似乎真的很快。让我们想象一下,这种机器人发展将对未来产生什么影响。

是的。是的,我将二月份我认为最重要的中国新闻汇总起来进行了播报。我将在三月份的最后一个星期六再次汇总最重要的消息进行播报。如果您是希望更新未来社会变化的企事业单位,或者需要未来趋势教育的人,请联系F21이버닷컴。