谷歌为Gemini引入智能体能力
「谷歌云宣布为Gemini引入统一智能体,可自主规划任务、调用工具并连接企业内部系统。Gemini月活已超10亿,近九成财富100强企业使用Gemini Enterprise,因此该能力先面向企业客户,后续再推向消费者。智能体拥有独立Workspace账号与审计轨迹,用户还可选择Anthropic Claude等第三方模型。」
在谷歌云的一场活动上,谷歌宣布将Gemini推进到智能体时代,推出一个统一的智能体:它不仅能回答问题,还能代表用户把事情真正做完,而这一切都发生在同一个界面之中。这意味着Gemini正从单纯的对话式工具,转向能够接管被指派任务、生成代码、安排会议、预订行程的执行型助手。
谷歌推进这项能力并非从零起步。谷歌首席执行官桑达尔·皮查伊在活动开场时指出,Gemini目前的月活跃用户已超过10亿;他还提到,接近90%的财富100强企业现在都在工作中使用Gemini Enterprise。正是基于Gemini在企业界的普及程度,谷歌决定先把智能体带给企业客户,之后再逐步向消费者开放。皮查伊解释,这样的顺序能让公司先解决安全、规模与性能方面那些更为棘手的问题,而这些恰恰是推出如此强大的智能体所必须面对的挑战。
谷歌云首席执行官托马斯·库里安进一步说明了这代智能体的关键差异:它可以被赋予“目标,而不只是指令”。也就是说,它能够自行规划工作步骤、使用自定义的技能与工具,并连接到企业的内部系统以达成目标。在模型调用上,系统默认会自动挑选最合适的模型来完成任务,但用户同样可以接管选择权,手动指定模型,其中也包括第三方模型,率先接入的是Anthropic的Claude系列。谷歌表示,未来会把模型选择器扩展到开源模型以及其他私有模型。
在任务输入方面,用户的请求可以携带附件,例如文件、文件夹,或为特定工作流设计的项目,包括把文件与技能组合起来的那类项目。智能体能够连接企业的数据与系统,覆盖Google Workspace、Microsoft 365、Slack、Jira、Confluence、Git、BigQuery、Databricks、Postgres、Snowflake等,也可以与企业网络内部或外部的任意Model Context Protocol(MCP)服务器安全协作。
为了让人类随时掌握进展,谷歌提供了“任务收件箱”界面。用户可以在这里看到Gemini的思考过程、它向子智能体委派任务的动作、加载了哪些特殊技能、生成的代码以及整体进度。换言之,智能体的执行过程不再是黑箱,而是可被观察、可被追踪的工作流。
颇具想象力的一点是,这个智能体会拥有自己的Workspace账号,就像团队里另一位同事那样,拥有专属的邮箱地址和专属的上下文。它知道公司里谁属于哪个团队、各自处在什么时区、哪些事项需要谁审批、每个人的日历上排了什么。用户可以通过标记它、给它发邮件、与它共享内容,或把它拉进群聊来调用它。当它采取行动时,系统会留下归属于这个智能体而非某个人的审计轨迹,为后续追溯与责任界定提供依据。
从行业视角看,这次发布把竞争焦点从“谁的模型更聪明”推向“谁的智能体更能落地”。模型能力可以通过接口调用外部获得,但要让智能体真正在企业里干活,还需要打通协同办公套件、代码仓库、数据仓库与工单系统的连接层,以及权限、审计与多人协作的组织级设计。谷歌选择把独立账号、审计轨迹与任务可视化作为卖点,正是针对企业最关心的可控性问题。而支持第三方模型的选择器,则透露出一种更务实的姿态:在智能体时代,模型本身可能趋于可替换,真正稀缺的是把模型、工具与业务系统编织成可靠执行链路的能力。
来源:Heooo AI工具导航