谷歌近日宣布,其AI助手Gemini Spark新增对Google Photos的深度管理功能,可为AI Pro和Ultra订阅用户执行照片编辑、相册策展、创建共享合集以及将照片转化为日历事件等任务。此次更新将Gemini Spark的能力边界从文本对话扩展至用户的个人影像资产,进一步强化了其在谷歌生态内的助手角色。
据谷歌官方介绍,Gemini Spark能够理解自然语言指令,并据此完成一系列此前需要手动操作的Google Photos任务。例如,用户可直接要求其“整理上周旅行照片并按地点分组”,或“将这张照片添加至家庭共享相册”。此外,该工具还可识别照片中的关键信息(如活动海报、票据等),并自动生成对应的日历事件,从而打通影像记录与日程管理之间的数据链路。
这一功能的落地,依托于谷歌在多模态大模型与云端图像理解领域的技术积累。Gemini Spark通过调用Google Photos的底层API,实现对照片库的读取与操作,但其执行权限仍受用户预设的隐私边界约束。目前该功能仅面向AI Pro与Ultra订阅用户开放,尚未向免费用户或商业版Workspace用户提供。
从行业视角看,此举是谷歌将生成式AI嵌入个人数字资产管理场景的一次重要尝试。与微软Copilot在Office套件中的集成逻辑类似,谷歌正试图通过Gemini Spark将AI能力渗透至其消费级与准专业级云服务中,以提升订阅产品的用户粘性。Google Photos目前拥有超过20亿月活跃用户,其中相当比例的付费用户已订阅AI Pro或Ultra套餐,这为Gemini Spark的落地提供了现成的应用场景。
分析人士指出,AI助手对个人照片库的自主管理,在提升便利性的同时也引发了对数据安全与自动化误操作的关注。谷歌方面表示,Gemini Spark的所有操作均可追溯,用户可在活动记录中查看并撤销AI执行的动作。随着AI助手逐步获得对用户核心数字资产的写权限,如何在自动化与用户控制权之间取得平衡,将成为包括谷歌在内的所有AI平台厂商需要持续面对的课题。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。