谷歌为Gemini引入智能体能力

发布时间 2026-10-09 10 小时前
来源 TechCrunch
字数 1,439 字
查看原文

智能总结

谷歌在 Google Cloud 活动上宣布将 Gemini AI 带入智能体时代,推出统一的智能体,可回答问题并代替用户执行任务。 Gemini 目前月活用户超 10 亿,财富 100 强中近 90% 使用 Gemini Enterprise。谷歌将首先面向企业客户推出该智能体,后续扩展到消费者。

在周四举行的一场 Google Cloud 活动上,谷歌宣布正将 Gemini AI 带入智能体时代,推出了一款统一的智能体。它不仅能回答问题,还能代替用户完成各种任务,所有操作都在同一个界面中完成。

这一举措的背景是:AI 工具已不再只是对话式体验,而是能够主动承担被指派的任务、生成代码、安排会议、预约出行等。它也顺应了面向消费者的智能体的崛起,例如 Meta 的 Muse 以及在即时通讯中运行的 Instinct 等,以及最近上线的 ChatGPT Dots。

谷歌仍有很大机会在智能体方向上实现规模突破。正如谷歌 CEO 桑达尔·皮查伊(Sundar Pichai)在活动开场时指出的,Gemini 目前拥有超过 10 亿月活跃用户。他还指出,如今财富 100 强企业中已有近 90% 在工作中使用 Gemini Enterprise。

鉴于 Gemini 在企业界的普及度,谷歌将首先把这款智能体推向企业客户,之后再逐步面向消费者推出。

皮查伊表示,这可以让公司解决在推出此类强大智能体时所面临的“安全、规模和性能方面的更棘手问题”。

Google Cloud CEO 托马斯·库里安(Thomas Kurian)解释说,这款新智能体可以被赋予“目标,而不仅仅是指令”。也就是说,它能够规划工作、使用自定义技能和工具,并连接企业内部系统以达成目标。

默认情况下,AI 会自动选择最合适的模型来完成任务,但用户也可以手动指定模型,包括来自第三方的模型,率先支持的是 Anthropic 的 Claude 模型。谷歌表示,未来将扩展模型选择器,纳入开源模型以及其他私有模型。

请求中可以附带附件,例如文件、文件夹或其他为特定工作流设计的项目,例如那些将文件与技能组合在一起的项目。该智能体可以连接企业的数据和系统,例如 Google Workspace、Microsoft 365、Slack、Jira、Confluence、Git、BigQuery、Databricks、Postgres、Snowflake 等等。

它还可以在公司网络内部或外部,安全地与任何模型上下文协议(Model Context Protocol,MCP)服务器连接并协同工作。

用户可以通过一个“任务收件箱”(tasks inbox)界面随时了解 Gemini 的进展,查看 Gemini 的思考过程、子任务的委派、特殊技能的加载、代码以及执行进度。

值得注意的是,这款 AI 将拥有自己的 Workspace 账户,就像一位普通同事一样。谷歌表示,这意味着它拥有独立的邮箱地址和独立的上下文,能了解公司里每个团队的人员构成、时区、谁需要审批事项、大家日历上的安排等。用户可以通过 @、发邮件、共享或加入群聊的方式呼叫该智能体。在它采取行动时,会留下一条归属于该智能体(而非某个人)的审计记录。

该智能体可在 iOS、Android 移动设备、Windows 和 Mac 桌面设备、命令行界面、Google Workspace、Microsoft 365、ServiceNow 以及 Slack 中访问。

该智能体的早期测试客户包括运动服饰品牌 On、Shopify 和 PayPal。谷歌还指出,Gemini Enterprise 的客户包括 BNP Paribas、Bradesco、Merck、Orange Spain、Santee Cooper、SOMPO、Ulta Beauty 和 Wesfarmers 等大型企业。

谷歌表示,新的灵活消费选项——包括多模型编排、智能路由和实时消费上限——将帮助企业更好地控制其企业级 AI 成本。