谷歌在Chrome中扩展Gemini,实现自主网页浏览
谷歌正在扩大Gemini在Chrome中的功能,将其人工智能助手带给印度更多的安卓用户,同时引入自主浏览功能,让AI能够在网上执行多步骤任务。
与传统的人工智能助手主要提供答案或总结信息不同,Chrome中的Gemini旨在直接与用户正在查看的网页互动。这使得用户可以对在线内容提问,获取冗长文章的摘要,并在不离开当前浏览会话的情况下与信息互动。
谷歌已将Chrome中的Gemini提供给印度的安卓用户,使助手能够分析当前在浏览器中打开的页面。用户可以要求Gemini解释或总结内容,从网页中检索特定信息,或帮助完成与屏幕上显示的材料相关的任务。
该服务还与多个谷歌应用程序集成,包括谷歌Keep和谷歌日历,扩展了在浏览时可以执行的操作范围。Chrome中的Gemini还结合了谷歌的Nano Banana图像生成和编辑技术,使用户能够在不切换到其他应用程序的情况下创建或修改图像。
最显著的新增功能是自主浏览,这使Gemini扮演更像代理的角色。系统不仅仅是回应请求,而是可以代表用户在网站上导航并完成一系列操作。
该功能可用于涉及多个步骤的任务,例如为活动安排停车、填写冗长的在线表单或订购杂货。这标志着人工智能助手在浏览器中的整合方式的更广泛转变,从信息检索转向能够直接与在线服务互动的系统。
谷歌一直在逐步在特定市场推出自主浏览功能,目前在印度的计算机和安卓设备上均可使用。访问权限仍然仅限于谷歌AI Pro和谷歌AI Ultra的订阅用户,反映出该公司通过其高级AI计划提供更先进的代理能力的战略。
此次扩展还突显了对在开放网络上运行的AI代理的安全性日益增长的担忧。谷歌表示,Gemini已经接受了识别威胁的训练,例如提示注入,其中嵌入在网页中的恶意或误导性指令可能试图影响AI系统的行为。
对于某些敏感操作,Gemini可能要求用户在继续之前确认操作。这些安全措施旨在让人们参与可能产生重大后果的决策,同时降低AI代理被恶意网页内容操控的风险。
语言可用性仍然是另一个限制。在安卓设备上,Chrome中的Gemini最初支持美式和英式英语,而谷歌表示还计划增加其他语言。计算机版本已经支持多种印度语言,包括印地语、孟加拉语、古吉拉特语、卡纳达语、马拉雅拉姆语、马拉地语、泰卢固语和泰米尔语。
这一发展反映了谷歌更广泛的努力,旨在将Chrome转变为不仅仅是传统的网页浏览器。通过结合页面理解、生成性AI和自主任务执行,该公司将Gemini定位为不仅能够解释用户在线所见内容的助手,还能帮助他们在网上完成操作。
-
21:00
-
20:32
-
20:15
-
20:00
-
19:40
-
19:19
-
19:00
-
18:56
-
18:15
-
18:00
-
17:30
-
17:15
-
16:50
-
16:33
-
16:16
-
16:00
-
15:42
-
15:25
-
15:10
-
14:47
-
14:32
-
14:15
-
14:00
-
13:40
-
13:20
-
13:05
-
12:45
-
12:30
-
12:12
-
11:47
-
11:32
-
11:15
-
11:00
-
10:42
-
10:25
-
10:10
-
10:10
-
09:47
-
09:30