Gemini agent是Google Cloud于2026年10月8日在“Gemini at Work 2026”大会上推出的企业级AI代理:单一代理具备持久记忆、企业工具集成能力,并可将任务分派给子代理。其架构上的核心创新在于,底层模型与代理本身是独立选择的,目前支持Google自家的Gemini系列,也支持Anthropic的Claude。该产品尚未向所有用户开放,目前处于针对特定客户的私密预览阶段,Google未披露具体上线地区,亦无法确认中文地区用户的访问情况。
这则消息的意义远超产品发布本身。企业AI平台之间的竞争,正从模型能力转向对工作流、数据和权限的系统性管控。真正值得追问的不是哪个模型回答得更好,而是:当一个AI代理以某人名义在包含机密文件的系统中连续工作数小时,究竟谁在负责监控?

Gemini agent与聊天机器人有何本质区别
实际上,普通聊天机器人响应单条指令;而据Google介绍,Gemini agent接收的是目标而非具体指令,并返回完整结果。它在云端运行:据VentureBeat报道。一项任务可以从某台设备发起,在笔记本电脑关闭后仍继续执行,持续时间可达数小时乃至数天。对于多步骤任务,它会创建临时子代理,每个子代理拥有独立身份,可并行或串行协作。记忆系统分为四类:会话记忆、语义记忆、程序记忆和情景记忆,分别对应当前任务、知识库、工作流程和已完成历史。
Gemini agent支持Web、移动端、桌面端和命令行访问,可集成Google Workspace、Microsoft 365和Slack,也提供无专属界面的API调用。据9to5Google报道,在Gmail、Docs、Sheets、Slides和Chat中,用户可通过@Gemini唤起代理。工具集涵盖Salesforce、ServiceNow、Jira、Git、BigQuery、Snowflake、Databricks、Microsoft Teams,以及任何支持Model Context Protocol(MCP,连接代理与外部系统的开放标准)的服务器。此外还有“同事代理”(coworker agent),这是一种具有固定角色和持久身份的代理,按Google的描述,它拥有专属Workspace账户,包含邮件、日历和Drive,并以自己的名字在文档修改记录中留痕。不过VentureBeat指出,Google并未明确每个代理是否都配备独立账户,还是仅限于持久性同事代理。
底层模型可选择:Gemini或Claude
Google对此的表述是:Gemini是代理,底层模型是独立的选项。目前编排层支持Gemini系列与Claude系列模型,更多专有模型和开源模型将于后续加入。管理员可决定哪些模型可供使用,Smart Routing功能则根据需求和成本在已授权模型中自动选择。据Futurum报道。用户可为单个任务手动选模,也可启用自动模式,系统从轻量模型出发,在需要时切换至更强大的模型。Google声称,典型工作流中仅有10%至15%的环节需要高端模型,预计可节省约三分之一的成本。这是Google自身披露的数据,未经独立核实,分析师认为该数据在技术层面合理,但同时也是一项相当可观的商业让步。
关于Claude的信息,各方来源均语焉不详。没有任何来源指明具体版本,也未说明有多少工作量实际运行于Claude之上。VentureBeat指出,Google尚未明确数据是否会发送至Anthropic等外部供应商,也未说明数据的保存方式和存储地区。Futurum则提供了一个市场视角:Claude借此获得更广泛的分发渠道和按量计费收入,但采用Google代理的客户未来可能减少对Anthropic原生界面的使用。
谁来监控一个连续工作数小时的AI代理
换句话说,Google的博文提出了四个安全核心问题:智能体是谁、能做什么、做过什么、以及绝对不能触碰什么。官方给出的答案如下。每个智能体都有独立身份,通过加密方式验证,以最小权限运行,并在日志中留有记录。权限基于角色设定,由安全管理员批准;对于外部系统,身份通过OAuth等标准协议传递。据VentureBeat报道,智能体只能访问在Workspace权限下明确共享的文件。每项操作均记录在归属于智能体(而非个人)的日志中,可实时监控。
在限制层面,智能体运行于名为Agent Sandbox的隔离环境,拥有独立的网络边界。所有进出流量及智能体之间的通信,均通过Agent Gateway这一AI专用防火墙实时执行规则。Google举例说明了一条规则,禁止智能体打开标记为“need to know”级别的机密文件;VentureBeat补充指出,相关控制措施可拦截试图将敏感数据发送至未授权模型的行为。在费用控制方面,每个项目设有严格的支出上限,一旦触发,该项目的智能体将自动暂停,只需点击一下即可恢复。

这一设计构建了一套受治理的非人类身份体系。Futurum分析师Nick Patience认为这是“正确的设计方向”。不过,若干问题仍待解答。Google尚未发布有关智能体在跨多个应用程序执行长任务时可靠性的独立基准测试数据;Patience也指出,连接器列表的长短,并不能说明智能体实际能对每个连接器做多少事。责任归属问题已在Claude的使用条款中有所体现:自11月12日起,构建或部署智能体的一方,须同时对智能体通过工具、浏览器或关联系统所执行的操作承担责任。
两个典型场景:金融研究与文档分析
换句话说,最接近数小时级别真实工作量的示例来自金融领域(目前处于预览阶段)。Google表示,该系统针对投资研究、信贷分析和风险建模提供逾50项核心能力,数据来源涵盖FactSet、LSEG、S&P Global、SEC备案文件及专有档案,并配备置信度评分、方法论说明、数据可追溯性和来源引用。据Google官方信息,客户包括CME Group和Deutsche Bank;DBS Bank据Google介绍,已部署由70至80个智能体组成的链条来处理信贷备忘录。银行业正积极为此类应用布局资金:Generali在其2027年计划中为人工智能、数据与自动化预留了3.25亿欧元,而意大利艾米利亚-罗马涅大众银行则将AI定位为顾问在文档处理与研究环节的辅助工具,客户关系的责任仍由人工承担。
在文档分析领域,Google援引了多家客户的数据:Bradesco表示文档审核时间从一小时压缩至五分钟,风险不一致率下降60%;Commerzbank的文档核查时间从20小时降至1小时;Grupo Bafar的各分行合同准备时间从140分钟缩短至17分钟。上述数据均为Google或客户方的自述,未经第三方独立验证。Futurum指出,Bradesco和DBS等案例均属有限场景的实施,且全程有人员介入监督,并非无人值守运行数天的自主智能体。法律领域(同样处于预览阶段)的智能体,可从NetDocuments和iManage继承案件层级的访问权限及团队间的信息隔离壁垒(“ethical walls”)。
访问权限、上线时间与定价
据VentureBeat引用的Google Cloud发言人信息,Gemini智能体即日起向部分精选客户开放私有预览,更大范围的开放承诺“即将到来”,但未给出具体日期。9to5Google补充说明,正式开放将面向持有部分Business及Enterprise套餐的Workspace客户,该产品定位企业用户,不面向个人消费者。唯一有据可查的时间线来自Futurum:根据其分析,Google预计2026年10月底前在北美实现全面上线;该分析师同时将欧洲地区的上线进展列为重点关注事项,因为涉及数据驻留合规要求。目前尚无针对中国大陆地区的上线信息。
在定价方面,VentureBeat报道,在已包含Gemini Enterprise的套餐(含Workspace Business及Enterprise许可)范围内,暂不收取额外费用,更详细的定价将在全面上线前公布。据Futurum引用的数据,Gemini Enterprise定价为每席位每月30美元;Google不额外收取席位费,而是将成本转移至token用量、算力消耗及支出上限机制。持久性协作智能体的定价,以及长期自主任务和子智能体的收费方式,目前均未披露。

Gemini agent 要点速览
已确认内容与未确认内容。来源:Google Cloud、VentureBeat、9to5Google、Futurum
- 已确认:具备持久记忆的单一智能体、子智能体与协作者、独立模型(Gemini 或 Claude)、已声明的身份与权限及操作日志、面向特定客户的私人预览。
- 尚未说明:欧洲地区访问权限、具体开放区域、上线日期(仅 Futurum 披露:10月底,北美地区)、协作者定价、Claude 版本、数据是否传输至模型供应商,以及独立基准测试结果。
- 持续关注:全面开放时间与地区、欧洲数据驻留合规情况、定价方案、连接器文档及自主操作边界限制。
更深层的解读
将智能体与底层模型解耦,Google 将模型变为可替换组件,而真正锁定客户的要素转移到了别处:记忆、技能、连接器、身份与操作日志。这一判断与 Futurum 的分析方向一致,其战略意义超过任何单项功能。对金融行业而言,影响更为直接:在不同供应商之间调度工作的智能体,会扩大可接触数据的主体范围,除非管理员明确限定允许使用的模型。欧洲监管机构已就此发出警示,指出欧盟金融体系对非欧洲 AI 供应商的依赖程度,Christine Lagarde 也专门提醒外界警惕已嵌入银行与支付基础设施的 AI 所带来的系统性攻击风险。谁在掌控智能体,本质上也是一个关于市场集中度的问题。
当智能体开始自主完成支付时,身份管理与操作限制将变得更加关键。Google 设定的支出上限针对的是算力成本,而非真实支付。Stripe 与 OpenAI 已发布面向AI 智能体商务的协议,允许智能体在无需用户逐步干预的情况下完成交易。目前所阅读的资料中,加密货币或区块链均未被提及,但与本领域的关联点正在于此:智能体、身份与支付三者的深度融合。基础设施层面的竞争同样不可忽视,Google 在芬兰承诺投入 130 亿欧元即是明证。
值得持续追踪的信号十分具体:全面开放的时间与地区、欧洲数据驻留合规状态、持久协作者的定价结构、Google 就数据传输至模型供应商问题的正式回应,以及首批针对长时任务可靠性的独立测试结果。在这些信息明朗之前,Gemini agent 仍停留在一份具有值得关注的治理架构设计的发布公告层面,尚不构成可供验证的生产工具。



