Google 又发布了一次 Gemini,这次它说模型可以另选

Google Cloud 在 Gemini at Work 2026 上「发布了 Gemini」,被开发者调侃是在发布一个用了快三年的名字。但这次 Gemini 指的是一个 agent,Google 自己写明:底下跑哪个模型是另一回事,今天就能跑 Claude。它真正要卖的,是模型之外的三样东西。

10 月 9 日,Google Cloud 的 CEO Thomas Kurian 在 X 上发了条推,说他们在 Gemini at Work 大会上「发布了 Gemini」。开发者 Theo 转发时只补了一句:「Today, Google announced Gemini. Yes you read that right.」

Theo 引用 Thomas Kurian 的推文

Gemini 2023 年底就有了,Google 又宣布了它一次,难怪被拿来开玩笑。不过这次宣布的 Gemini 跟以前那几个不是一个东西,它是一个干活的 agent。Kurian 那场主旨演讲后来改写成了博客,我读下来觉得最该划线的是这句:

Gemini is the agent, and the model underneath it is a separate choice.

Gemini 是 agent,它底下用哪个模型,是另一个选择。

Google 自己就训练前沿模型,却在一年里最重要的企业发布会上跟客户讲,模型你可以另选。这句话背后的盘算,比发布的任何一个新功能都值得琢磨。

01|同一个名字,第几次「发布」了

Gemini 这个名字底下的东西,几年里换过好几轮。2023 年 12 月它是 Google DeepMind 的模型系列;2024 年 2 月 8 日,聊天机器人 Bard 改名叫 Gemini,Workspace 里的 Duet AI 也跟着改成 Gemini for Workspace;后来企业套件叫 Gemini Enterprise,这次 Google 说财富 100 强里将近九成在用。到了今年 10 月,Gemini 又成了「一个通用的工作 agent」,顺带还有预览中的金融版、法律版,以及还没上线的政府、医疗、零售版。

模型这边反倒换了叫法。Kurian 介绍模型阵容时说的是 Argon(前沿推理)、Flash(速度和量)、Omni(生成媒体)、Gemma(开放权重的轻量模型),前面都没带 Gemini。稿子别的地方仍然管它们叫 Gemini 模型家族,只是站在台前的那个 Gemini,这回是 agent。

OpenAI 的 Tibo 同一天也凑了个热闹:「Today, we are announcing ChatGPT. It is here: chatgpt.com」。

Tibo 的反讽推文

一个用了好几年的产品名被郑重其事地再宣布一遍,他和 Theo 笑的都是这个。名字一直没动,底下装的东西一直在换,用户听到「Google 发布了 Gemini」,还得先问一句是哪个。

可这几次换得并不乱。模型、聊天产品、办公套件、agent,排下来正好是 Google 每个阶段主推什么。轮到 agent 这一回,模型被往后放了。

02|模型能换,Google 拿什么收钱

「模型另选」在原文里写得挺实:Gemini 会把每项工作派给合适的模型,「今天就在我们的 Gemini 模型家族和 Anthropic 的 Claude 模型之间编排」,以后再接其他私有和开源模型。企业今天用着 Gemini agent,跑在底下的可能是 Claude。

Google 当然没放下模型,新 TPU 照发(TPU 8i,称性价比比上一代高 80%),自家模型也照出。但整场发布会花力气讲的是模型外面那几层,顺着原文看,大概三样。

公司数据接进来多少

Kurian 介绍这个 agent,头一句就是它「掌握你所有的业务上下文」。办法是把数据接进来,不搬家。Gmail、Drive、Docs、Sheets、Calendar 里直接有 Gemini;BigQuery 配了个 Knowledge Catalog,用来统一公司内部「这个指标到底怎么算」;叫 Borderless Lakehouse 的那部分,能直接查 Amazon S3、Azure Data Lake、Salesforce、SAP、Workday 的数据。再往外接 Confluence、Jira、Slack、Teams、Snowflake、Databricks 和 MCP 服务器。

模型上的差距,换个模型就能补。一个 agent 要是已经连着公司几十个系统,还摸熟了内部那些口径,想换掉它就麻烦多了。

给 agent 发账号

这次发布里我觉得最有意思的是「同事 agent」(coworker agent)。按原文,它有自己的 Workspace 账号,邮箱、日历、Drive 都有,公司通讯录里也搜得到,邮箱后缀是 @agents.company.com。能看什么,取决于你和同事给了它什么。

围着这个账号,Google 把企业 IT 那一套配齐了:加密验证的身份、最小权限、按角色细分的权限控制、记在 agent 名下的审计记录。进出的流量和 agent 之间的流量,都要过一道叫 Agent Gateway 的「AI 网络防火墙」,按公司策略实时拦。

这些跟 agent 聪明与否关系不大,管的是另一类问题:谁授权它干的,有没有留记录,出了事查谁。数量一多就绕不过去。Google 列的客户里,美军首席数字与 AI 办公室说自建了 10 万多个 agent,日本保险公司 SOMPO 在 3.4 万员工里建了 1 万多个,这个量级没有身份和审计,根本管不过来。

账单

原文里有个数字,跟后面那些功能放在一起看挺别扭。Kurian 说每 token 价格从 2024 年到现在降了 98%,挂的出处是 TNW 6 月的一篇报道,那篇的标题直译过来是「token 价格降了 98%,企业 AI 账单翻了三倍」。

报道引了效率平台 Jellyfish 研究负责人的数据:9 个月里每个开发者的 token 消耗涨了约 18.6 倍,用得最多的工程师产出大概是轻度用户的两倍,token 却花了十倍。账单涨幅那部分出自没署名的行业分析,我只拿它看个方向。

单价降得没有用量涨得快,于是这场发布会把省钱功能摆上了台面。可以在 Cloud Billing 控制台给项目设 AI 花费硬上限,由 Gemini 执行;有路由工具把每项工作派给够用又最便宜的模型;花费按项目记,方便分摊到部门;业务报表做好存下来,以后重复运行「不再产生 token 成本」。

最后这条我多看了两眼。每周都要出的报表,以前每次都得重新调一遍模型,现在 Google 拿「少调模型」当卖点。和前面的「模型另选」连起来看,模型能换就会按价格换,谁来决定每项工作派给哪个模型,账单就落在谁手里。

03|得打折扣的地方

这毕竟是 Google 自己的发布稿。客户名单和效果数字,像「文档审阅从 1 小时缩到 5 分钟」「解决时间缩短 80%」,都是 Google 和客户自己说的,没看到第三方核验。金融版和法律版还在预览,政府、医疗、零售版没上线。「模型另选」眼下也只到 Gemini 和 Claude 两家,其他模型写的是「未来」。Google 没有退出模型竞争,它想占的是挑模型的那个位置。

04|被锁住的是什么

Theo 笑的是名字,这一点没说错,Google 确实又发布了一次 Gemini。

对企业来说差别在别处。以前选 Gemini 是选一个模型,觉得别家好就换,成本不高。现在的 Gemini 连着公司几十个系统,有邮箱有权限,还替你决定每项工作用哪个模型、花多少钱。

模型越来越像能随手换的零件,这话 Google 在自己的发布会上说出来了。企业接下来要定的,更多是让哪家的 agent 进门、拿到邮箱和权限。模型隔几个月可以重新挑一次,agent 进了门,就没那么好请走了。


参考:

关于

关注我获取更多资讯

月球基地博客公众号二维码,扫码关注获取更多 AI 与编程资讯
📢 公众号
月球基地博客作者个人微信二维码,扫码交流 AI 与编程话题
💬 个人号
使用 Hugo 构建
主题 Stack 由 Jimmy 设计