AI导航

Gemini 智能体正式发布:Google 把问答、文档和代码放进一个提示框

AI资讯
3 min read
2 次阅读

Gemini 智能体在 2026 年 10 月 8 日由 Google Cloud 在 Gemini at Work 2026 活动上发布。它被定位成一个通用的工作智能体:组织的业务上下文装在同一个入口里,员工从一个提示框出发,就能让它回答问题、处理知识工作、生成内容,也能写代码并运行。Google Cloud 首席执行官 Thomas Kurian 在官方博客里介绍,用户交代的是目标而不是步骤,回来时拿到的是已经完成的工作,成果直接落在文档、收件箱和开发环境里。

它和聊天机器人的区别在执行方式

Gemini 智能体能在云端持续运行,一项工作跑几个小时甚至几天,用户合上笔记本也不会中断,记忆和上下文只有一份,换设备接着用。它还能按任务临时组建一组子智能体分工处理多步骤工作,子智能体各有自己的身份;另一种形态是长期在岗的同事型智能体,有固定的角色、自己的企业邮箱地址和存储空间,只接触团队明确共享给它的上下文。技能和工具是它完成工作的两条腿:技能是可复用的多步骤工作说明,公司可以把自己的做法沉淀成技能放进共享注册表;工具则负责连接 Salesforce、ServiceNow、BigQuery、Slack 等业务系统,也支持接入内外部的 MCP 服务器。

在 Workspace 里,它直接出现在工作现场

这次发布把 Gemini 智能体嵌进了 Gmail、Drive、Docs、Slides、Sheets、Chat 和 Calendar,带着同一份记忆和权限在邮件线程、文档和聊天空间里就地干活。Google 举的例子是约一场区域活动负责人会议:用户不用提供任何姓名和邮箱,它能从聊天空间成员和上次活动的线程里判断出参会人,查完日历再发邮件协调时间。它也会主动提示可委派的任务,比如上级邮件要求交一份项目进展幻灯片时,界面会给出把任务转交给它的入口。数据分析是另一个重点方向:业务人员用自然语言提问即可生成运营报表,工程师则可以让它生成 PySpark 代码、训练模型并自己排查流水线问题;金融服务和法律两个行业版本已进入预览,分别内置了行业技能与权限继承安排。

模型可以换,权限和账单要管得住

Gemini 智能体在底层并不绑死单一模型:它会按任务在 Gemini 系列与 Anthropic 的 Claude 模型之间挑选合适的那个,简单的活不占用最贵的模型,靠智能路由和实时支出上限控制成本,项目触及上限时智能体会暂停,等管理员确认再继续。治理方面,每个智能体有独立身份和最小权限,所有动作写入以智能体名义归属的审计日志,任务在带网络边界的沙箱中执行,流量经过网关按公司政策放行。Google 同时披露了使用规模:过去一年有近 500 家 Google Cloud 客户各自处理了超过一万亿个 token,近九成财富 100 强在使用 Gemini Enterprise;早期客户中,巴西 Bradesco 银行把文档审查从一小时缩短到五分钟,Orange Spain 已经部署了一千多个自建智能体。需要注意的是,行业版本目前仍是预览,普通企业能以什么套餐、何时用上同事型智能体,官方还没有给出完整清单,评估时应以自家 Workspace 与 Cloud 合同的实际开通范围为准。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。