10 月 9 日,Google Cloud 的 CEO Thomas Kurian 在 X 上发了条推,说他们在 Gemini at Work 大会上「发布了 Gemini」。开发者 Theo 转发时只补了一句:「Today, Google announced Gemini. Yes you read that right.」
Gemini 2023 年底就有了,Google 又宣布了它一次,难怪被拿来开玩笑。不过这次宣布的 Gemini 跟以前那几个不是一个东西,它是一个干活的 agent。Kurian 那场主旨演讲后来改写成了博客,我读下来觉得最该划线的是这句:
Gemini is the agent, and the model underneath it is a separate choice.
Gemini 是 agent,它底下用哪个模型,是另一个选择。
Google 自己就训练前沿模型,却在一年里最重要的企业发布会上跟客户讲,模型你可以另选。这句话背后的盘算,比发布的任何一个新功能都值得琢磨。
01|同一个名字,第几次「发布」了
Gemini 这个名字底下的东西,几年里换过好几轮。2023 年 12 月它是 Google DeepMind 的模型系列;2024 年 2 月 8 日,聊天机器人 Bard 改名叫 Gemini,Workspace 里的 Duet AI 也跟着改成 Gemini for Workspace;后来企业套件叫 Gemini Enterprise,这次 Google 说财富 100 强里将近九成在用。到了今年 10 月,Gemini 又成了「一个通用的工作 agent」,顺带还有预览中的金融版、法律版,以及还没上线的政府、医疗、零售版。
模型这边反倒换了叫法。Kurian 介绍模型阵容时说的是 Argon(前沿推理)、Flash(速度和量)、Omni(生成媒体)、Gemma(开放权重的轻量模型),前面都没带 Gemini。稿子别的地方仍然管它们叫 Gemini 模型家族,只是站在台前的那个 Gemini,这回是 agent。
OpenAI 的 Tibo 同一天也凑了个热闹:「Today, we are announcing ChatGPT. It is here: chatgpt.com」。
一个用了好几年的产品名被郑重其事地再宣布一遍,他和 Theo 笑的都是这个。名字一直没动,底下装的东西一直在换,用户听到「Google 发布了 Gemini」,还得先问一句是哪个。
可这几次换得并不乱。模型、聊天产品、办公套件、agent,排下来正好是 Google 每个阶段主推什么。轮到 agent 这一回,模型被往后放了。
02|模型能换,Google 拿什么收钱
「模型另选」在原文里写得挺实:Gemini 会把每项工作派给合适的模型,「今天就在我们的 Gemini 模型家族和 Anthropic 的 Claude 模型之间编排」,以后再接其他私有和开源模型。企业今天用着 Gemini agent,跑在底下的可能是 Claude。
Google 当然没放下模型,新 TPU 照发(TPU 8i,称性价比比上一代高 80%),自家模型也照出。但整场发布会花力气讲的是模型外面那几层,顺着原文看,大概三样。
公司数据接进来多少
Kurian 介绍这个 agent,头一句就是它「掌握你所有的业务上下文」。办法是把数据接进来,不搬家。Gmail、Drive、Docs、Sheets、Calendar 里直接有 Gemini;BigQuery 配了个 Knowledge Catalog,用来统一公司内部「这个指标到底怎么算」;叫 Borderless Lakehouse 的那部分,能直接查 Amazon S3、Azure Data Lake、Salesforce、SAP、Workday 的数据。再往外接 Confluence、Jira、Slack、Teams、Snowflake、Databricks 和 MCP 服务器。
模型上的差距,换个模型就能补。一个 agent 要是已经连着公司几十个系统,还摸熟了内部那些口径,想换掉它就麻烦多了。
给 agent 发账号
这次发布里我觉得最有意思的是「同事 agent」(coworker agent)。按原文,它有自己的 Workspace 账号,邮箱、日历、Drive 都有,公司通讯录里也搜得到,邮箱后缀是 @agents.company.com。能看什么,取决于你和同事给了它什么。
围着这个账号,Google 把企业 IT 那一套配齐了:加密验证的身份、最小权限、按角色细分的权限控制、记在 agent 名下的审计记录。进出的流量和 agent 之间的流量,都要过一道叫 Agent Gateway 的「AI 网络防火墙」,按公司策略实时拦。
这些跟 agent 聪明与否关系不大,管的是另一类问题:谁授权它干的,有没有留记录,出了事查谁。数量一多就绕不过去。Google 列的客户里,美军首席数字与 AI 办公室说自建了 10 万多个 agent,日本保险公司 SOMPO 在 3.4 万员工里建了 1 万多个,这个量级没有身份和审计,根本管不过来。
账单
原文里有个数字,跟后面那些功能放在一起看挺别扭。Kurian 说每 token 价格从 2024 年到现在降了 98%,挂的出处是 TNW 6 月的一篇报道,那篇的标题直译过来是「token 价格降了 98%,企业 AI 账单翻了三倍」。
报道引了效率平台 Jellyfish 研究负责人的数据:9 个月里每个开发者的 token 消耗涨了约 18.6 倍,用得最多的工程师产出大概是轻度用户的两倍,token 却花了十倍。账单涨幅那部分出自没署名的行业分析,我只拿它看个方向。
单价降得没有用量涨得快,于是这场发布会把省钱功能摆上了台面。可以在 Cloud Billing 控制台给项目设 AI 花费硬上限,由 Gemini 执行;有路由工具把每项工作派给够用又最便宜的模型;花费按项目记,方便分摊到部门;业务报表做好存下来,以后重复运行「不再产生 token 成本」。
最后这条我多看了两眼。每周都要出的报表,以前每次都得重新调一遍模型,现在 Google 拿「少调模型」当卖点。和前面的「模型另选」连起来看,模型能换就会按价格换,谁来决定每项工作派给哪个模型,账单就落在谁手里。
03|得打折扣的地方
这毕竟是 Google 自己的发布稿。客户名单和效果数字,像「文档审阅从 1 小时缩到 5 分钟」「解决时间缩短 80%」,都是 Google 和客户自己说的,没看到第三方核验。金融版和法律版还在预览,政府、医疗、零售版没上线。「模型另选」眼下也只到 Gemini 和 Claude 两家,其他模型写的是「未来」。Google 没有退出模型竞争,它想占的是挑模型的那个位置。
04|被锁住的是什么
Theo 笑的是名字,这一点没说错,Google 确实又发布了一次 Gemini。
对企业来说差别在别处。以前选 Gemini 是选一个模型,觉得别家好就换,成本不高。现在的 Gemini 连着公司几十个系统,有邮箱有权限,还替你决定每项工作用哪个模型、花多少钱。
模型越来越像能随手换的零件,这话 Google 在自己的发布会上说出来了。企业接下来要定的,更多是让哪家的 agent 进门、拿到邮箱和权限。模型隔几个月可以重新挑一次,agent 进了门,就没那么好请走了。
参考:
- Welcome to Gemini at Work 2026,Google Cloud Blog,Thomas Kurian
- Token prices fell 98%. Enterprise AI bills tripled.,TNW,2026-06-05
- Google Bard is now Gemini,InfoQ,2024-02
关于
关注我获取更多资讯