
谷歌正式描绘了人工智能代理作为完全自主数字员工的未来图景。通过新一代 Gemini Agents,用户只需设定最终目标,无需拆解具体步骤,AI 即可独立回答问题、创建文档、生成素材及组织会议。这一转变标志着人类员工角色从“AI辅助者”向“工作委托者”演进,由 AI 自主处理长期运行的复杂任务。
与此前 Meta 和 OpenAI 发布的类似产品相呼应,Gemini Agents 的核心优势在于其高度的自主性与灵活性。它不再局限于被动响应,而是能够理解宏观意图并独立执行。
云端常驻与开放生态
Gemini Agents 运行于 Google Cloud 基础设施之上,具备“始终在线”特性。即便用户离线或不在工位,代理仍可在后台持续运行和处理任务。谷歌并未将其单纯定义为工具,而是赋予其“数字同事”身份:企业用户可为其分配专属电子邮件地址、日历及 Drive 存储空间配额。
在开放性方面,谷歌打破了生态壁垒。尽管依托自家云服务,Gemini Agents 已兼容 Anthropic 等竞争对手的模型,并承诺未来支持更多模型选择。谷歌云 CEO Thomas Kurian 表示,这是一个面向未来的平台,可在任何地方运行,执行任何任务,支持用户选择的模型,并应用企业级控制。
此外,该代理支持跨第三方平台协作,包括 Microsoft 365 和 Slack,并覆盖 iOS、Android、macOS 和 Windows 等主流操作系统。目前,Gemini Agents 尚未全面公开,仅向部分客户提供私人预览访问权限。随着产品接近全面可用,更多用例细节有望陆续披露。