Transcription
大家好,欢迎来到灵姐说AI。
这期视频啊,给大家介绍一下谷歌浏览器的重大升级。谷歌它把自己的Gemini放进自己的Chrome浏览器里面了。这期视频啊,会给大家介绍它的重要的升级点表现在哪些方面,并且啊,我会教大家一步步的,怎么打开你的浏览器里面的AI模式。最后呢,我还会给大家去演示和展示一些在常用的一些办公生活的场景里面,怎么去使用谷歌的Chrome浏览器里面的这个功能。
我们先来看一下它官网的介绍。它这里标题就说啊,浏览器的新时代,让Gemini在Chrome里面发挥作用。我认为啊,把Gemini放在Chrome里面,这个动作其实非常的大。
要知道Chrome浏览器是什么概念?它在整个浏览器里面的市场份额,应该在80%以上。就是它拿着望远镜都找不到对手,这么一个存在。以前我们想到AI浏览器,可能会想到Perplexity搞的那个Comet,还有OpenAI搞出来的Atlas。现在OpenAI的Atlas的Windows版还没出来,它只是支持了Mac。
sty的Comet浏览器,Perplexity的使用率也就那样。现在Chrome浏览器上了这个AI功能,我相信在这个浏览器领域啊,基本上它是从找不到对手到无人能敌,横扫千军的这么一种状态了。
你看,我这里是安装了一个Comet浏览器的,但是我只有想在使用它的AI功能,或者是Perplexity的这个功能的时候,我才会打开这个浏览器。大部分时间,我还是一个深度的Chrome浏览器的使用者,因为本身谷歌的生态和各方面的服务和体验都是更好的。加上了AI功能,我觉得啊,真的不要太爽了。谷歌在这个点已经开始爆发起来,卷起来了。
我们往下看它的功能介绍。它这里说,引入了一种带侧面板的新的浏览方式,去重新构想多任务的处理方式。可以看到我这个浏览器有什么特别,就是在右上角这个地方啊,你看我和你的浏览器有什么差别?在右上角这里我有一个Gemini的图标,一点这个位置,我就打开了侧边栏。这个侧边栏的样式啊,其实和Comet浏览器特别像。这是Comet浏览器,你打开这个Assistant,可以看到,这里也是一个侧边栏。它的这个模式啊,是差不多的。
但是啊,我觉得它不止于此。这也是谷歌的厉害之处,它的生态的全家桶实在是太厉害了。
我们再接着看它的功能介绍。它这里讲了,可以直接在这个网页浏览里面,在网上转化图像。原来,我们可能要使用这个Nano Banana的时候,需要把图片下载下来或截图下来,然后再新打开一个窗口,然后再发给这个大模型,让它给处理。现在简单多了,你直接在同一个面板里面,把这个图告诉他,根本就不用截图,你直接用提示词来描述,然后他就可以帮你做这个图像的转化和生成的动作。你的整个的多任务的并行处理,就非常的爽。
再看第二个点,去跨链接应用的去完成任务。这个是像OpenAI或者Perplexity,它们所不具备的。这些点这个是谷歌生态的厉害之处。它这里啊,举了个例子,比如说你要去参加一个会议,那么你就要去查日程、查天气、查地点、预订机票,并且写邮件,等等等等。这一系列的操作,都可以在这个任务窗口里面去完成。相当于在整个的Chrome浏览器里面,就给这个对话提供了一个强大的上下文。而且这些所有的内容的接口,都是和谷歌无缝链接的。而且这些谷歌的这些功能啊,是可以分别在Gemini设置,链接应用里面去启用的。
大家看我前几期的视频里面,有一期讲谷歌的,我讲到谷歌最近的动作变快了,里面它有一个很重要的升级点,就是它的UCP协议,它打通了购物,打通了和其他的网站的一些协同。你看它的落点又落在了这一方面。这个浏览器的多标签窗口,给它提供了上下文以后,我们提示词会越写越少,越写越精炼。另一方面,它通过UCP协议和谷歌本身生态里面的链条,把这些后面的操作全部打通了。那么在这个侧边栏里面,随时唤醒Gemini的这个部分,你会变得非常的丝滑。
以后你可以做很多事情啊,比如说你打开了很多购物标签,你就可以让这个Gemini去帮你总结,这几个购物标签,这几个购物网站,同一个商品,它的一些性能指标,你帮我对比,做购物的选择。或者是说有一个系列的任务,你打开了多个旅游的景点,你让他给你安排一到两天的日程,他就根据你想要去的地点,帮你智能的去做安排。相当于你的浏览路径,思考路径,和这个浏览器啊,是紧紧的耦合在一起。
谷歌的这个操作也再次证明了,现在在2026年,已经进入到了一个什么AI浏览器,或者叫做AI入口争抢的这么一个节奏,这么一个节点。
你可以看到今年的春节的这个阶段,各个大厂都开始出手出招,纷纷在抢这个AI入口的心智了。不管是在国内还是国际上,都有这么一个趋势在这里面了。谷歌的这个操作是非常重磅的,因为我觉得他把做进去,实在是太丝滑了。
在最后的时候,我也会给大家去实测一下啊,我们哪些场景上面可以用到他,这个功能能切切实实的帮到我们。即使说你不在美国,没有办法去直接使用,他的一些购物啊,预订机票这样的后端的这种服务,但实际上这个功能对于我们使用Chrome浏览器,也是非常有帮助的。
第三个点,它讲到了一个Personal Intelligence,个人智能,一个更加个性化、更加主动的Chrome。刚我在前面也讲过了,就是你打开的这个标签页,你浏览的这个网页,其实就是你的上下文。你越是最近看的网页,就是代表你最近看的一些信息嘛。你在这个网页的停留时间,你的点击的行为,包括你的操作,你关注的内容,这些都是你的个性化的东西,都是你的上下文。那么基于你的上下文,它给你的回答,包括你的搜索答案,就会更加具有个性化。
它这里也说啊,Chrome会记住你过去对话的上下文,因此你可以在网络上获得更多的,针对你想要的独特的答案。你把时间花在哪里,哪里就是你的注意力。AI在这里也会更加了解你。
第四个,我觉得是重头戏,就是让Chrome自动浏览。我一直在讲,以后就是A2A的时代,以后啊,它就是你的代理的这个浏览的agent,它可以自动的帮你多步骤的处理一个事情。比如说你要填写表单,你可以把你的这个PDF,把你的这个文本的信息发给他,他就自动的帮你的这个表单的信息啊,以前大家要一个个自己填,粘贴粘贴,这明明就是一个啧,非常机械化的事情嘛。以后他可以帮你代理把这些信息,填到一些申请的表单里面去。
再比如说,他这里举的例子啊,你要办一个派对,你就可以从一个图片开始,他帮你搜索跟这个图片相似的内容,然后把相似的商品加到购物车里面,加到预算里面,他可以自动的帮你应用这个折扣码。如果说你赋予相关的这个浏览的权限,它就可以帮你完成整个的购买,下单的整个操作。包括以后帮我浏览商品的信息,对比这些购买信息,看这个YouTube的视频,它就是我的代理助手了。
谷歌浏览器,这一次内置的这个AI功能啊,我觉得有很大的替代性。你看我以前视频用的这个Monica的插件,我也安装过,现在我基本不用了。再加上这种Perplexity的Comet,以后我肯定也会用的少了,因为我本身在Chrome浏览器里面就有这些功能嘛,我就没有必要打开其他的。而且它目前的连接性是非常强的,非常接近和趋向我讲的这种A2A的这种形态。
你看它这里也讲到了,这个通用的商务协议UCP。现在虽然对接的这个商家还有限,但相信啊,以谷歌的这个号召力啊,以后不会少的。这里也讲到它会严格控制安全标准。确实这样的授权存在一定的风险性,但是这种趋势我认为是势不可挡的。
第二个部分,给大家演示一下如何通过设置,把Gemini配置进你的谷歌浏览器。安装的方法来源于这个网址,大家可以直接访问这个GitHub上面的链接,或者跟着我的视频一步步操作。
在这里啊,Windows环境下,打开Windows PowerShell终端。在这里复制这段命令,首先先下载并安装UV。这里显示啊,已经下载完成了,正在安装,已经安装完成了。接着复制这一段命令到终端,并回车运行脚本。在这个过程中啊,运行这个命令的时候,Chrome窗口会自动的关闭并重启,大家不要慌。
接着打开我们的浏览器,在设置里面改变我们的默认的语言,将默认的语言从中文改成英文。下一步打开我们电脑的系统配置,在区域和语言这个位置啊,将区域设置为美国,首选语言设置为英语。如果本身没有英语的语言配置,下载一下安装包,然后进行默认语言的修改。点击注销账户,并修改系统显示的语言。
这个时候重启你的Chrome浏览器,就会发现在右上角有一个角标。这样你的Chrome浏览器的AI模式,就设置完成了。
第三个部分,给大家实操一下Chrome浏览器的AI新功能。我先打开这个YouTube链接,点击右上角的Gemini的图标,它就打开了侧边栏。这个侧边栏也可以往左拉的。在这里我让它给我总结一下这个视频的核心内容,让它用中文回复我。然后1234,你看总结的是不是挺好的?而且这里还会有对应的时间戳。这个内容本身就是谷歌内部的,它总结的这个丝滑程度啊,比Comet更好。
我再试一下第二个任务,让它基于这个YouTube里面的画面给我生图,看看它能不能够完成。这里是一个滑雪的场景图。这个图像呢,本身我也是用AI生成的。我就跟他说啊,请参考视频中的画面,将人物换成一位穿着黑白时尚运动服的女性,给我生成类似的场景图,图片比例是16:9。这里的模式我改为Auto,试一下啊。
好,你看,它开始加载Nano Banana Pro了。看一下最后的生图效果,它能不能够理解我说的语义啊。哇哦,这个场景和它识别的这个画面,场景是完全匹配的。一个穿着黑白衣服的女性,滑雪的场景的照片,非常的匹配。基本上我不需要出原来的对话框,就可以完成整个操作了。我在Perplexity的Comet里面是没有这么丝滑的体验的。
并且,大家发现没有看到,对话框这个位置啊,这个加号点击一下,它在这里,可以Add我的Tab。我就是可以把我的这个窗口里面所有的标签页,都Add进来,把它作为我的上下文来引用。就像你引用这个图片,引用这个文章,引用这个PDF一样。这个体验真的啧,太绝了太舒服了。大家回过头来看一下Comet,你看这里,它只能选择截屏或者给它上传文件,体验差了不是一点点。我觉得我之后可能不会打开Comet了。
接着我们来测一测谷歌浏览器里面的Gemini,它跨多标签页的处理能力啊,到底怎么样。这个场景和我们现实啊,是比较贴合的。我们在做很多研究,会看很多网页,不知不觉呢,就像我现在这样,打开了很多标签页。比如说这里,我研究的就是浏览了一些AI入口,争夺相关的,这些大的模型厂商,他们的动作。这里的新闻呢,有谷歌相关的,也有Apple相关的,还有微软他们的Edge浏览器,OpenAI的Atlas,Perplexity的Comet,他们的一些动作。我就随便打开了一些网页。
我们让Gemini统一来帮我总结一下,看看他能不能帮我抓住这些网页的核心内容。我们把标签页拉过来一点,点击这里的加号。看到你看它,这里默认勾选的,是当前的这个Tab。那么我想总结所有的Tab,我觉得应该是把所有的这个浏览器的标签页,我都勾上。而且你发现没有,它不仅是跨标签页的,它是跨窗口的。因为你看到这里啊,上面这个部分呢,是我当前的窗口里面的标签页,下面这个部分啊,是我打开的另外一个标签页里面的窗口,都是可以同步可选的。
我先选我希望总结的这个标签页,跟他说,请你帮我总结这些网页的核心内容,并且可以进行归类,或者形成一定的逻辑,给我出一份调研报告。我们看看他的完成度怎么样。啊,这里我选的模型啊,它默认Fast,我选的是Fast的模型。完成度不错哦。你看它说这里内容啊,主要就是AI驱动的浏览器革命与入口之争。它把我的内容啊,做了一些归类。它这里说,谷歌浏览器,已经成为全能型的AI助手化,并且罗列对比了挑战者阵营,还有一些市场和法律的影响。并且呢,给我讲了一下调研的结论。如果说我选的是这个Pro模型,或者Thinking模型啊,我相信整个的调研报告的完成度会很好。
以上就是我对升级后的谷歌Chrome浏览器的使用和点评。你赶紧去试一下,我觉得应该不会让你失望的。欢迎在评论区告诉我你的体验。我们下期节目再见。记得订阅灵姐说AI,不要错过后续的精彩,新鲜的AI科技相关的内容。拜拜。
这个体验真的啧,太绝了太舒服了。我觉得我之后可能不会打开Comet了。