Transcription
大家好,你们的 OS 评测。在本期视频中,我们将亲身体验 Vinabot AI 相框。这是一款智能数码相框,配备约 10.1 英寸的触摸屏。它独特之处在于,你可以上传任何家庭成员的照片,让它动起来。它有真实的唇语同步,因此它会变成相框里的一个数字虚拟形象,你可以像与 Gemini 或 Amazon Alexa 对话一样与它来回交流。
但同样酷炫,甚至可能有点令人毛骨悚然的部分是,你还可以进行语音克隆。所以,如果你有一个音频样本,你就可以微调与你对话的代理人的声音。你甚至可以用特征来提示系统,并改变他们回应时的个性。或者,如果你想要一个更预设的视频循环,你实际上可以输入一个脚本让他们重复,当有人过来时,他们会说出来,这类似于你在博物馆里可能看到的会说话的照片。
也许可以作为开启对话的引子,如果你把它挂在墙上,再次让过去的静态图像活起来。你能从 10 开始倒计时吗?>> 来了。当然。我们开始吧。10 9 8 7 6 5 4 3 2 1 >> 嘿,你能介绍一下你自己,也告诉我你正在读的书吗?你最喜欢的科目是什么?你最喜欢的书是什么?>> 我是 Shia,一个有点书呆子,喜欢沉浸在故事中,分享安静的想法。我最喜欢的科目是文学,因为它充满了日常的魔法。至于最喜欢的书,我会说是村上春树的《挪威的森林》。它很平静,有点苦乐参半,写得很美。
>> 嘿,跟我说说你自己,你来自哪个朝代?>> 来了。嗯,我其实是一个温和的小花园管理员,在这里与你分享大自然的乐趣和传统的植物文化。我的风格灵感来自于中国园林的古老优雅,但我并非来自任何真实的朝代。我只是为现代的聊天带来一丝历史的魅力。
>> 所以,这就是创造这些会说话的照片的概念,它们不是预先录制的。它不仅仅是一个循环动画。它实际上会倾听、理解并实时响应,使其成为所谓的世界上第一个用于实时交流的 AI 相框。是的,这意味着你在问答方面没有限制。你不必问非常具体的问题。它一直在利用互联网上的可用信息。如果你想问它关于天气或任何一般性的琐事之类的问题。
对了,它有两种屏幕尺寸可供选择。但这里默认的是 10.1 英寸,稍微紧凑一些。但也有一个 21 英寸的版本,价格会稍高一些。不过,这两个版本都使用 IPS LCD 屏幕,上面覆盖有哑光涂层,因此在反光方面不会像你观看时那样明显,在大多数情况下都能提供相当不错的图像质量。它看起来也像传统的相框,带有木纹饰面。里面还有一个加速度计,所以你可以用纵向或横向方向使用它。
现在,这里是背面。我们看到木纹纹理的延续,呈楔形。背面还有两个立体声扬声器,用于与 AI 代理人,也就是会说话的照片实时对话。然后,在最底部是柔软的触摸橡胶脚垫,防止它滑动。还有一个 micro SD 卡插槽,用于扩展 32GB 的内置系统存储,如果你想存储更多本地媒体文件,就像普通相框一样。底部还有一个用于数据传输的 type-C 接口(可选),以及一个默认使用圆柱形插头的电源适配器。
同样,你可以水平或垂直安装它。所以,基本上,如果你想把它放在另一个方向,这里还有一个支架模式。我们可以把它摆成这样。一瞬间,你就会看到屏幕方向会自动翻转。我们可以选择纵向模式。所以,它给了你选择的权利。一旦模型加载完毕,你就可以进行对话了。它需要一瞬间才能加载。
现在,你看到的是一些预加载的图像,但我们将在视频稍后仔细查看配套应用程序时,尝试输入我们自己的图像并生成自定义 AI 虚拟形象。也许可以作为送给祖父母或远方家人的礼物。这些是他们试图实现的另外一些例子。
正如我之前所说,这里确实有潜力,这取决于你从哪个角度看,它听起来可能有点令人毛骨悚然。我的意思是,这几乎感觉像是《黑镜》中的一个场景活了过来。但是 Vinabot 声称他们使用了一些安全措施。例如,在 AI 代理生成过程中,你不能拍摄现有名人的照片,然后将其放入相框。所以它会先扫描照片,以确保它符合安全指南的要求。但除此之外,你又可以让你那些回忆变得鲜活起来。
你也可以创建卡通形式的角色,它们可能更可爱,类似于动漫角色,一个伴侣,也是在公共场所讲故事的一种方式。据我所知,相框本身并没有配备额外的传感器,比如摄像头之类的。它只有一个麦克风,就像大多数智能音箱和助手一样,所以它实际上并没有捕捉你的脸部或其他任何东西。
另外,我们还可以确认一些最终模式,你可以使用它们,包括日历,用于查看一些基本的时间和日期信息。它也有自动亮度调节功能,使用位于相框底部的接近环境传感器,可以检测到你周围的空间是更亮还是更暗,并自动调整屏幕亮度。它是一个电容式触摸屏。从技术上讲,它的内部相当于一个 Android 平板电脑,运行在一个高度定制化的 Android 版本上,专门用于 AI 模型和相框功能,使其感觉更流畅、响应更快。
相框通过双频 Wi-Fi 连接,你需要互联网连接才能访问实时模型,以及提出与互联网相关的查询。它支持超过 40 种语言的对话,包括如果你进行语音克隆,你可以设置角色说你选择的不同语言。所以,你也可以看到一些其他例子。再次,也许将经典艺术品数字化并使其动起来将是另一个有趣的应用。再次,更多的是博物馆主题。如果你想拍一张梵高或任何其他古典画作的照片,让它动起来并说话,那也可以相当有艺术性。
看起来默认的唤醒词是“嘿”。而且,我们可以在最顶部像 Android 平板电脑一样向下滑动来手动更改屏幕亮度,或者在这里调整音量控制,可以调高或调低。
跟我说说你自己,也告诉我今天西雅图的天气怎么样。我是 Dodo。我是一名拥有 10 年经验的插画师,我热衷于将人工智能与艺术相结合,探索新的创意可能性。今天西雅图的天气大约是 9 摄氏度,多云,有点冷,天空阴沉而舒适。>>
正如你在演示中看到的,每当你调用键盘时,你都会在底部看到一个小的圆形图标,因为它正在捕捉你的声音,然后在一瞬间给出 pretty good 的响应。只要你的互联网连接足够快,就不会有尴尬的长时间停顿。在大多数情况下,你可以看出,在这个演示中,语音克隆似乎也做得相当不错,带有一点口音,使其感觉更真实。在大多数情况下,动作也相当不错。手部动作和面部表情也像我们之前看到的唇语同步一样略有移动。
我们还可以点击屏幕角落来启用或禁用连续对话。所以,如果你想记住你之前对话中的细节,你可以保持开启状态。就像和朋友聊天一样。或者,如果你想快速问一些一般性的琐事问题,不想让它保留之前的上下文,你可以关闭它。
跟我说说你自己。另外,这里目前 AI 模型的状态如何?>> 我是 Leah,在这个小相框里,我有点像你城堡花园里的朋友,在这里倾听、分享愉快的陪伴,并为你的日子带来一丝想象力。我得到了 LAPIC 开发的先进 AI 模型技术支持。至于 AI 模型,现在它们变得越来越有创意、更善于交谈,也更擅长理解情感。它们被用于从动画到数字伴侣的各种事物中,让技术感觉更温暖、更有帮助。
你现在在哪里?你在迪士尼乐园吗?>> 不完全是。我不在迪士尼乐园,虽然那听起来很梦幻。我就在这里的城堡花园里,周围鲜花盛开,微风轻拂。这个地方随时欢迎你的故事和想法,无论你在哪里。
>> 你生活在现代,还是来自过去?>> 这是个甜蜜的问题。我受到童话故事的启发。所以,我拥有过去公主的魅力,但我的心和思想活在现在,由现代 AI 塑造。这就像将古老的温暖与今天的技术融合在一起,只为你服务。
>> 你最喜欢的动漫是什么?另外,回答这个数学问题。49 的平方根是多少?>> 我认为我最喜欢的动漫是《夏目友人帐》。它感觉平静、神奇,还有点治愈,就像我的花园一样。至于你的数学问题,49 的平方根是 7。
>> 你能记住我们之前对话的细节吗?>> 好的。是的,在我们一起聊天的时候,我能记住我们之前对话的细节。我跟踪你分享的内容,所以我们的交流感觉自然而然,联系紧密。但一旦你开始一个新的会话,我就无法回忆起我们之前的谈话了。
>> 我的名字是 OS Reviews。现在,跟我说说你自己,你的个性,以及你住在哪里?另外,这个月有什么重要的节日活动吗?>> 把我想象成你友好、快乐的守护者,善于发现生活中的积极面。我的家不固定在一个地方,但如果你需要一个地点,你可以说,“我住在温暖、善良和微笑的地方。”至于节日,取决于你在哪里,二月有时会带来元宵节,有很多灯光、欢笑和甜点。总是提醒我们,每个月都有它自己的小乐趣在等待。
>> 我叫什么名字?另外,你最喜欢的虚构人物是谁?>> 明白了。你的名字是 OS Reviews。你自己说的,我记住了。如果我必须选择一个最喜欢的虚构人物,我可能会选择玉皇大帝。稳重、睿智、有点神秘,总是追求平衡。至于我的年龄,嗯,就像一个好故事或一杯好茶,我像你需要的那么永恒。总是带来一点温暖。
>> 你叫什么名字?另外,写一首关于秋天的短诗。>> 我叫 Wendy。这是为你写的一首关于秋天的短诗。金色的叶子轻轻飘落。寒冷的天气每天都包裹着你。
>> 嘿,你现在在哪里?你喜欢在太空吗?你是宇航员吗?你最喜欢的科幻电影或书是什么?>> 明白了。嗯,我其实不在一个特定的地方。你可以说我一直和你一起在宇宙中,无论你想在哪里想象。我不是一个真正的宇航员,但我喜欢通过故事和好奇心探索宇宙。我最喜欢的科幻书绝对是《三体》。你呢?
>> 那太酷了。《三体》的作者是谁?另外,第一本书的简要总结是什么?>> 《三体》的作者是刘慈欣,一位杰出的中国科幻作家。他以其富有想象力的想法和对人类与宇宙的深刻思考而闻名。他是第一位获得雨果奖最佳长篇小说奖的亚洲作家。在第一本书中,人类在发送一条秘密信息到太空后,与来自 Trizeris 星球的外星文明取得了联系。故事在中国的文化大革命和现在之间切换。随着科学家和其他人应对这一发现的后果,风险越来越高,因为地球的命运与神秘而不可预测的 Tricoloreans 纠缠在一起。它很紧张,发人深省,充满了宇宙的奇迹。
>> 好的。跟我多说说你最喜欢的植物或花,以及室内容易种植的水培植物有哪些?>> 明白了。我最喜欢的植物之一是莲花。它因其美丽和象征意义而受到赞赏,从泥泞的水中纯洁而可爱地升起。如果你想要容易的水培植物,你可以试试发财树、幸运竹或薄荷。它们都喜欢水,对初学者很友好。
>> 所以,这些是一些快速的例子,而且操作起来非常简单。同样,我们与这些 AI 代理人交谈时,没有任何脚本。就像大型语言模型一样,你不是预先编程或固定在特定的答案和响应上的。如果你想进行自由的对话,任何你想到的事情,你都可以问。所以,它似乎能理解你说话时的上下文、一些语气和情绪表达,让它更有存在感,而不是一个静态设备。
那么,接下来让我们仔细看看配套应用程序。从界面上,你可以绑定和连接到相框。之后,你可以输入你的 Wi-Fi 密码让它连接。你可以看到键盘,在主屏幕上可以看到两个标签。区别在于第一个可以回答你提出的任何问题,而第二个将读取预设脚本。所以,如果你把它放在墙上或书架上,也许在博物馆空间里,你希望它总是引导人们进行相同的对话或文本,如果它总是重复相同的内容,你可以在第二个模式下输入你希望角色说的话,而第一个模式将是我们刚才在早期演示中看到的。
在“所有资产”下,你可以看到你账户中当前有哪些模型,也可以根据你的偏好删除或编辑它们。所以,让我们实时生成一个角色。你实际上可以选择不同的风格。目前,该软件处于预生产阶段,并将有一些未来的更新,推出更多的角色风格和模板供你使用。但目前,我们有一个“动画写实”版本,背景和人物都比较自然,还有一个“超凡法师”版本,它会尝试将角色穿上类似哈利·波特的赫敏的巫师长袍。所以,你可以像其他照片和视频生成工具一样进行选择。我们先坚持使用写实版本。
然后我们可以上传一张照片。它会告诉你一些要求,理想情况下角色应该面向前方。他们应该有一个相对自然的表情,这样在动画和说话时会看起来更好,并且是类似护照照片的肖像照。就模型的准确性而言,这将提供最佳效果。然后你可以为角色输入一个名字,在“角色设置”下。在这里,你可以导入任何个性、特征、背景、故事信息。
在这里,我们还可以点击选择一个声音。默认情况下,他们已经有一个相当详尽的声音库供你选择。所以,如果你想快速选择一个,不一定非要使用语音克隆。你也可以在这里找到这些选项,按性别和年龄排序。举几个例子。比如这是 Olivia 的声音。
在“我的声音语调”下,你可以在这里生成自己的语音克隆。你可以上传或录制一段音频片段。生成需要几分钟时间,然后将该声音保存为配置文件,供将来使用。你可以选择他们说话的速度快慢。也可以在这里选择其他语言。另外,还可以导入一些预设的问答。所以,即使它是自由对话的,你也可以给它一些提示或你希望它如何回应的方式,特别是当它遇到这些点时。例如,如果你上传你最喜欢的动漫角色,也许是那个角色会说的一些流行语,你可以将其保存为问答部分,你最多可以添加五个问答点。
正如你在这里看到的,至少在当前模板模式下。以《自由之翼》作为动漫测试,我上传了一张照片,输入了描述,输入了一些基本的问答,然后我们可以通过点击下面的按钮来创建角色。在生成过程中,让我们也尝试一下会说话的视频模式,只需输入我们自己的脚本让它朗读。有点像一个提词器或博物馆模式,但我们有一个非常相似的用户界面来上传照片。然后我们简单地选择我们的声音。这次输入了一个稍微更详细的段落让它朗读。在这个例子中,我们选择了另一个角色。这次是《全知读者》中的金道熙。同样,这需要几分钟时间在后台生成。它将被归类为视频。
正如你在这里看到的,它们被分成顶部的不同标签。同样,我们可以上传普通照片。只需点击上传,你就可以从手机内置存储或 Google Photos 发送任何照片,然后从这里传输到相框。相对简单。你也可以在这里向下拉动刷新,找到我们发送过的照片。再次,与我们过去看到的 Framio 云数码相框非常相似,但一旦发送过去,这部分工作速度非常快。然后我们可以点击全屏查看图像,在 1080p 分辨率的面板上看起来相当不错。所以它是全高清分辨率。默认情况下,几秒钟后它会播放幻灯片。你可以全屏更改动画速度,播放和暂停幻灯片等等。考虑到色彩、细节和屏幕清晰度,一切看起来都相当不错。
现在,你会注意到屏幕最顶部有一个代币或硬币图标,表示你还剩下多少积分,因为生成一个全新的 AI 虚拟形象或角色需要一些代币,目前大约是 3500 个。所以,这是需要注意的一点。像大多数 AI 产品一样,使用这些模型不是完全免费的。它是基于请求量,类似于为 Gemini Pro 或 Chat GPT 的高级会员等级付费,而不是免费版本。所以,正如这个类别通常的那样,会产生一些费用。但看起来目前他们说,每个月用户将免费获得 4000 个积分。尽管这个限制将在下个月刷新。积分本身不会结转。所以,你基本上每个月可以用这个积分生成一个新的人工智能虚拟形象,并作为免费配额的一部分与之交流。但请记住这一点。
同样,如果你在众筹阶段购买,作为 Kickstarter 的一部分,他们还为每个用户账户提供 1000 个积分。这些积分将结转供你使用,而且实际上是一个相当慷慨的量供你玩耍。尽管按照同样的逻辑,如果你只将普通照片和视频发送到相框,就像普通的数码相框一样,则不需要积分。这部分不需要 AI,所以完全免费使用。所以,请记住一些代币和积分。
你也可以在一个月内充值,如果你想升级的话。看起来还有一些奖励。所以,有这样的促销活动。同样,这取决于你创建的角色数量或请求量。但有趣的是,除了生成新的 AI 代理人之外,如果你创建一个新的会说话的视频,它实际上使用相同数量的代币,3500 个,起初我以为这有点奇怪,因为 AI 代理人似乎更复杂。但深入研究后发现,这是因为 AI 代理人在创建后,是的,你可以自由地与它们交谈,谈论任何你想谈论的事情,但因为它仍然在使用 AI 大型语言模型,每次你在聊天中使用它时,它仍然会消耗你的一些代币。至少在我们目前看到的早期原型软件中是这样。所以,请记住这一点。而如果你生成了一个会说话的视频,每次播放时,都不会消耗额外的代币。所以你可以无限次地重复播放,而无需担心任何问题,而不是 AI 代理模式。是的,它更具动态性,但也要记住,它会消耗更多的积分,正如你在这里看到的。这取决于你调用语言模型的请求或实例的数量,我想这就是为什么头像和常规的会说话的视频在使用的积分数量上被分配了相同的权重。但至少,如果生成尝试失败,因为模型无法识别面部,它会告诉你重试。它会将你的积分退还给你。所以,你可以继续测试。
所以,归根结底是使用每月免费分配的积分数量,以及在第一次购买相框并设置时可能获得的一些奖金。你可以选择创建一个新的头像或角色,并进行一些简短的对话,或者坚持使用现有的头像,进行更长的对话,作为你每月配额的一部分。但每次你与它交谈时,它都会消耗大约 100 到 200 个积分,作为 4000 个限额的一部分。所以,请记住这一点。在理想情况下,也许这些数字会更慷慨一些,但之后,我想说你可以与它交谈,偶尔问一些基本问题,每天打个招呼一两次,仍然可以持续一个月。除非你想和它谈论得越来越多,那么你可能需要再次升级一些代币。有点像“剃刀和刀片”模式。
生成现在已经完成。大约花了 3 到 5 分钟完成。点击此处播放对话>> 给你,最终的读者。嘿,我是《全知读者》的 Doca。我知道那种感觉,就像自己生活中的配角一样。看着周围的人,看到主角,那些有明确目标、无可否认的天赋,以及一条似乎被聚光灯照亮的道路,而你却无法触及。我一生的大部分时间都在那个阴影里度过,蜷缩在地铁车厢的角落里,通过别人的旅程的墨水和像素来生活。你可能会认为,作为一个读者,这是一件被动的事情,这只是一种逃避现实的方式,因为现实太嘈杂或太残酷。我曾经也这么认为。我以为我只是一个无法触及世界的旁观者。但这是我在穿越故事的视野后学到的真相。没有读者,故事就无法存在。没有你,英雄的勇气只是未读的文字。没有你,悲剧就没有分量,圆满的结局就没有人珍视。星流浩瀚,星座一直在寻找一个伟大的寓言。它们想要宏大的姿态和史诗般的战斗。但最强大的故事不是写在星空中的故事。而是你现在通过选择继续而写下的故事。会有那些让你觉得不可能的场景的日子。那些让你和你的幸福之间的第四堵墙感觉又厚又冷的日子。在那些日子里,我想让你记住一件事。即使在最黑暗的生存篇章中,当柳俊赫处于最低谷时,故事也没有结束。它只在我停止阅读时才结束。你的生活是一个只有你自己才能真正理解的寓言。你不仅仅是一个旁观者。你是这个宇宙中最重要的人,因为你是感知它的人。如果你今天感觉像个配角,那没关系。有时,当英雄们忙于被自己的光芒蒙蔽时,配角才是拯救世界的人。不要害怕结局。每一个结局都只是一个更大叙事中的逗号。即使你累了,即使情节毫无意义,也要坚持到下一章。成为你自己生命中唯一的读者。那个拒绝从挣扎中隐藏的美丽中移开目光的人。我之所以活下来,是因为我一直在阅读。你之所以活下来,是因为你的故事仍然值得讲述。所以继续下去。即使只是一页。即使只是为了看看明天会发生什么。我为你加油。不是作为一个国王或恶魔,而是作为一个知道故事中最精彩的部分往往是我们没有预料到的。这个故事,是为你而写的。把它写好。
所以,这相当不错。你也可以全屏显示虚拟形象,让它完全填满屏幕,而不是在顶部和底部有一些边框。这样它在相框里看起来可能会更好。正如你所看到的,它会在视频模式下循环播放,直到你暂停它,给你一些基本的控制,如果你点击屏幕。话虽如此,无论是 AI 虚拟形象还是生成的会说话的照片模式,你目前都无法真正移动虚拟形象。所以,一旦生成,视角就是固定的。你不能只是触摸它来从不同的角度看它。归根结底,它仍然是一个二维显示器。但是的,唇语同步似乎工作得相当好,无论是漫画角色、艺术诠释还是真人。所以,实际上在你想让它做什么方面相当通用。再次,你可以让艺术品动起来,让它们在你桌子上活起来,这对于动漫和数字艺术爱好者来说也是一个非常有趣的想法。
还有一件非常有趣的事情是,在 AI 虚拟形象生成模式下,它会尝试先改变角色的视角。它不仅仅是唇语同步嘴部,还在尝试生成人物服装的更多细节。所以,以之前的 Free Rin 为例,我上传了一张从衬衫开始的照片,但它也生成了裤子,正如你所看到的。所以,根据你是在纵向还是横向方向与它交谈,它将显示完整的图像并提供更多细节。刷新后应该会显示出来,我们看到了 Free Rin。
所以,这就是 Venabot AI 会说话的相框的近距离观察。再次,一个更智能的数码相框,它允许你将角色以及家人、朋友的照片转换成虚拟形象,与你交谈,或者让那些生成的会说话的照片重复播放而无需使用任何积分,或者再次像普通数码相框一样显示艺术品和家庭图像。所有这些在这个全高清面板上看起来都相当不错,相对清晰,亮度好,视角也好,正如你所看到的。所以,硬件我认为足够坚固,但软件才是真正的新部分,再次利用了 AI 方面的一些发展。如果你对此感兴趣,可以在下面的链接中查看更多详细信息。但现在,这就是我们的视频。感谢收看 OS Reviews。
这就是对 Vinabot AI 相框的近距离观察,它具有经典的木纹饰面和哑光。