Google发布通用Gemini Agent:企业AI从聊天窗口走向持续执行
作者: CBISMB
责任编辑: 宫建强
来源: Google Cloud官方博客
时间: 2026-10-09 09:53
关键字: AI安全 ,Google Cloud ,企业AI ,多智能体 ,Gemini Agent ,成本治理
浏览: 0
点赞: 0
收藏: 0

企业对AI的要求正在从“回答一个问题”变成“完成一个结果”。Google Cloud 10月8日在Gemini at Work 2026发布通用Gemini Agent,企业AI从聊天窗口走向持续执行:它可以规划任务、调用工具、跨应用工作,并把结果带回员工正在使用的文档、邮箱和开发环境。
Google将它描述为面向工作的单一通用智能体,能够处理知识工作、问答、内容与媒体生成以及代码任务,并通过同一套接口连接企业上下文。用户交给系统的是目标,而不是每一步操作说明。
一个智能体跨设备、跨应用继续工作
Gemini Agent可通过网页、iOS、Android、Windows、Mac、命令行及协作工具访问,也能以无独立界面的方式集成到第三方系统。因为任务在云端持续运行,用户关闭笔记本后,耗时数小时或数天的工作仍可继续。
它可以连接Confluence、Microsoft Office、Teams、Slack、Google Workspace、Git、Jira、Salesforce、ServiceNow、BigQuery、Databricks、Postgres和Snowflake等企业工具,也支持连接企业内外的MCP服务器。Google还提供工具注册表,让团队把经过批准的能力发布给公司其他人员使用。
多智能体不只分工,还要有身份
面对复杂任务,Gemini可以动态创建临时子智能体,安排并行或串行工作;也可以创建具有长期职责的“同事型智能体”。后者能够拥有专用邮箱、存储和组织身份,只访问用户或团队明确提供的上下文。
在Google Workspace中,同事型智能体可以被加入Chat空间、在文档评论中被@,或以自己的名字留下修改记录。这个设计试图解决企业部署中的一个关键问题:当AI执行操作时,日志应清楚显示是哪个智能体做了什么,而不是把所有动作都记在某位员工名下。
技能、工具和四类记忆组成工作上下文
Gemini可调用可复用的技能,学习企业完成多步骤任务的方式。官方介绍了四类记忆:用于当前任务的会话记忆、结构化企业知识的语义记忆、保存工作方法的程序性记忆,以及记录过去行动的情景记忆。
这类长期上下文能减少反复交代背景,但也会放大治理难题。企业必须明确哪些信息可以写入长期记忆、保存多久、谁能查看,以及员工离职或项目结束后如何撤销和清理。
成本和安全被放进同一套运行控制
Google称,Gemini可以在不同模型之间路由任务,以平衡质量和成本;项目还可设置实时支出上限,当令牌和沙箱成本触及上限时暂停智能体。企业可按项目追踪费用,并向具体部门分摊。
安全方面,每个智能体拥有可加密证明的身份和最小权限,动作被写入审计轨迹。智能体在带网络边界的Agent Sandbox中运行,进出流量经过Agent Gateway,由企业策略实时约束。管理员可定义智能体永远不能接触的内容,并将规则应用到组织内的全部智能体。
编辑观察:通用智能体的价值取决于企业底座
Google披露,近80%的Google Cloud客户正在使用其AI产品,近90%的《财富》100强企业使用Gemini Enterprise;这些为官方口径,不等同于所有客户都已部署此次新智能体。面向中小企业的Gemini Agent当前处于早期访问,后续才会向更多客户开放。
企业不应只评估模型“聪不聪明”,还要检查身份、权限、工具注册、审计、记忆治理、成本上限和失败恢复。通用智能体连接的系统越多,便利性越高,错误动作可能传播得也越快。稳妥做法是从可回滚、低风险流程开始,逐步开放写入与外部操作,并始终保留人工接管路径。
配图为AIcent原创AI生成实景风格示意图,非官方新闻现场照片,不使用第三方新闻图片。
参考来源:Google Cloud官方博客(2026年10月8日)。正文为基于官方消息的中文整理,编辑观察与事实披露分开呈现。






京公网安备:11010502051901号