【科技24时区】周四的Google Cloud活动上,一个信号颇为明确:AI正在褪去单纯的“聊天机器人”外衣,向具备自主执行能力的“智能体(Agent)”演进。谷歌正式推出了一款统一的代理工具,它不再局限于回答问题,而是能在单一界面中代表用户完成实际任务。这一举措标志着AI工具正跨越交互体验的边界,转向对分配任务的全面接管——无论是生成代码、安排会议,还是预订行程,皆在其能力范畴之内。
这种转变并非孤立现象。此前,Meta推出的Muse、基于消息平台的Instinct以及ChatGPT近期亮相的Dots等面向消费者的代理产品已陆续登场,市场热度渐起。但谷歌显然有着更宏大的野心与底气。正如CEO桑达尔·皮查伊在活动开场时所强调的,Gemini目前月活跃用户已突破10亿大关,且近90%的财富100强企业正在工作中使用Gemini Enterprise。凭借在企业级市场的深厚积淀,谷歌选择了一条更为稳健的路径:先深耕B端业务,待技术成熟后再向C端消费者推广。
皮查伊坦言,这种策略有助于解决强大代理上线时面临的“安全性、规模化和性能”等棘手难题。Google Cloud CEO托马斯·库里安进一步阐释了新代理的核心逻辑:它接收的是“目标”,而非琐碎的“指令”。这意味着代理能够自主规划工作流,调用自定义技能与工具,并深入连接企业的内部系统以达成既定目标。
值得注意的是,在模型选择上,谷歌展现了罕见的开放性。默认情况下,AI会自动甄选最适合当前任务的模型,但用户拥有最终控制权,甚至可以指定第三方模型——首批支持的便包括Anthropic的Claude系列。未来,这一模型选择器还将扩展至开源模型及其他私有模型。请求内容不仅限于文本,还可包含文件、文件夹或针对特定工作流设计的项目包,实现了数据与技能的深度融合。
为了打破数据孤岛,该代理能够安全地接入Google Workspace、Microsoft 365、Slack、Jira、Confluence、Git、BigQuery、Databricks、Postgres及Snowflake等企业常用系统。更重要的是,它支持与公司内外部任何符合模型上下文协议(MCP)标准的服务器进行安全协作。用户可以通过一个名为“任务收件箱”的界面实时监控Gemini的动态,清晰查看其思考过程、子代理的任务分发、特殊技能加载情况以及代码生成进度。
颇具意味的是,这个AI代理将拥有独立的Workspace账户,宛如一位真正的同事。它拥有专属邮箱和上下文记忆,熟知公司内部的人员架构、团队归属、时区差异、审批流程乃至每个人的日历安排。用户可通过标记、邮件、共享文件或将其拉入群聊等方式与之互动。而在执行操作时,所有审计日志均归属于该代理本身,而非具体操作人员,这在权责界定上迈出了关键一步。
目前,该代理已覆盖iOS、Android移动端,Windows、Mac桌面端,命令行接口,以及Google Workspace、Microsoft 365、ServiceNow和Slack等平台。早期测试阵容不乏On运动品牌、Shopify和PayPal等行业巨头,而BNP Paribas、Bradesco、默克、Orange Spain、Santee Cooper、SOMPO、Ulta Beauty和Wesfarmers等大型知名企业也已加入Gemini Enterprise的客户行列。
随着企业级AI应用的深化,成本控制成为焦点。谷歌同步推出了包括多模型编排、智能路由及实时支出上限在内的灵活计费选项,旨在帮助企业更精准地把控AI投入产出比。当AI从“参谋”变为“执行者”,这场关于效率与安全的博弈,才刚刚拉开序幕。
谷歌Gemini迈入“代理”时代:从对话助手到能独立干活的数字员工
科技区角
2026-10-09 04:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。