谷歌今夏推进Gemini Intelligence:重塑安卓手机交互
谷歌将Gemini升级为安卓系统级智能代理,实现任务自动化,如代填表单,并仅在用户授权下工作。新增功能包括文字生成定制小组件、Gboard“润写”模式优化语音转文本。采用端云协同计算,本地处理简单任务,云端处理复杂任务。该智能体验将逐步扩展。
科技圈最近有个大动静。谷歌在今年的The Android Show | I/O Edition活动上,正式为安卓生态的智能助手未来画下了一张清晰的蓝图——Gemini Intelligence。这可不是一次简单的功能升级,而是一次从“聊天机器人”到“系统级智能袋里”的定位转型。
简单来说,谷歌的野心是让Gemini变得更“主动”。它不再满足于你问我答,而是希望深度理解你的意图,并能在你授权的前提下,跨应用、跨网页地替你完成任务。其核心,就是任务自动化。
这意味着什么?最直观的例子就是处理那些令人头疼的在线表单。以往浏览器的自动填充功能,大多只能对付一些简单的、重复的信息栏。而Gemini Intelligence的目标,是理解整个表单的上下文和复杂要求,并代你完成整个填写过程。只要这项任务原本能在网页上手动操作,未来Gemini就有可能帮你自动化执行。
当然,自动化也伴随着对隐私和控制的关切。谷歌对此特别强调了边界:Gemini只会在用户明确允许的应用中工作,并且只处理用户直接指派的特定任务,不会擅自行动。

除了自动化这个重头戏,Gemini Intelligence体系还带来了两个实用的新工具。
一个是“创建我的小组件”。如果你对手机桌面小组件有特别的想法,但找不到现成的,现在你可以直接用文字向Gemini描述你需要的功能,它便能生成对应的代码,帮你创建一个定制化的小组件。
另一个则聚焦于输入体验,名为Gboard的“润写”模式。这个功能主要服务于语音输入场景。我们口述时难免会有重复、犹豫或语序杂乱的情况,“润写”模式的作用就是智能整理这些原始语音内容,将其修饰成更通顺、流畅的书面文本,提升沟通效率。
如此强大的能力,背后离不开合理的算力分配策略。谷歌采用了端云结合的方式:简单的、对即时性要求高的请求,由设备本地的轻量级模型Gemini Nano处理;而遇到更复杂的任务时,则会无缝调用云端更强大的Gemini模型来协同完成。
这一套智能体验也将延伸到汽车场景。未来,支持Android Auto的车型在连接手机后,也能在车机界面上调用Gemini Intelligence的相关功能。
至于我们何时能用上这些新能力,谷歌已经给出了初步的时间表。其中,Chrome浏览器的自动化浏览功能计划从6月开始逐步启动。而首批获得完整Gemini Intelligence体验的设备,将是Google Pixel和部分三星Galaxy手机,相关更新预计从今年夏季开始分批推送。
Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















