WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
今日情报播客来源我的
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
Market Intelligence/虎嗅

办公Agent的聚合路线“四国杀”正式打响

办公Agent正式进入模型聚合大战。8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。就在同一天,百度文库网盘通用智能体GenFlow正式启用中文名“库库AI”,并推出独立桌面端,其模型池同样包含DeepSeek、智谱...... 本文来自微信公众号: 全天候科技 ,作者:全天候科技 办公Agent正式进入模型聚合大战。 8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。

·2026.08.16·6 min 阅读
事件背景基于真实抓取数据整理

本条来自 虎嗅(Business / 中文商业),聚焦 technology、ai。 办公Agent正式进入模型聚合大战。8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。就在同一天,百度文库网盘通用智能体GenFlow正式启用中文名“库库AI”,并推出独立桌面端,其模型池同样包含DeepSeek、智谱...... 本文来自微信公众号: 全天候科技 ,作者:全天候科技 办公Agent正式进入模型聚合大战。 8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。 就在同一天,百度文库网盘通用智能体GenFlow正式启用中文名“库库AI”,并推出独立桌面端,其模型池同样包含DeepSeek、智谱GLM等外部模型。 无独有偶,腾讯WorkBuddy、字节TRAE Work都已经内置多家第三方大模型。 从腾讯、字节到阿里、百度,国内头部厂商的办公Agent正在不约而同走向模型聚合模式。 过去大模型产品争的是“谁家的模型更强”,到了办公Agent阶段,竞争逻辑开始出现变化:先把不同模型放进同一个工作台,让更多用户愿意把真实工作交进来。 只有用户真正用起来,写作、表格分析、PPT制作等真实工作流持续进入Agent,平台才有机会积累任务拆解、工具调用、失败恢复和用户纠正等反馈,并反过来打磨Harness,形成数据飞轮。 但下一道题也会随之出现:同一项任务究竟该调用哪个模型。路由由此成为聚合路线需要继续解决的问题。 一 踏入同一条河流 目前千问办公对外展示的“前沿模型”数量并不算多,除了自家的千问模型,外部模型主要是GLM-5.3和DeepSeek V4 Pro。 但千问办公明确表示三款前沿模型发布后都快速完成了接入,“这个节奏,我们会一直保持下去”。 这意味着,千问办公的内置模型池后续还会继续扩张。 相比之下,腾讯WorkBuddy已经形成了更大的内置模型池,不仅包括混元Hy3,还有智谱GLM、MiniMax、Kimi和DeepSeek等多个系列。 字节旗下TRAE Work也走在类似方向上。目前产品端可见的模型已经包括字节Seed系列、智谱GLM、DeepSeek以及千问等模型; 百度刚刚推出独立端的库库AI,同样引入了DeepSeek、智谱GLM等外部模型。 四家产品的共同点已经相当明显:办公Agent不再把自己的能力完全绑定在一家模型上。 原因在于,对办公Agent来说,现阶段比把每一次模型调用都留给自家模型更重要的是先让用户真正用起来。 当Agent开始搜索网页、打开文档、分析Excel、制作PPT、调用软件,并与用户来回修改一项工作时,都会留下更完整的执行过程:模型如何拆解任务、调用了哪些工具、哪一步失败、用户在哪一步进行了纠正,以及最终什么结果被接受。 真实工作流正是Agent时代稀缺的数据资源。 百度集团副总裁、个人超级智能事业群总裁王颖认为,随着公共数据逐渐被模型充分学习,AI继续提升的过程中人产生的新知识、新经验和新想法会越来越重要。未来真正需要共同建立的是通用智能体能力、记忆与存储,以及个人知识和经验三部分能力。 模型池越丰富,越有机会提升不同任务的完成率,降低用户尝试一款Agent的门槛;只有更多用户真正把工作交给Agent,平台才能获得持续反馈,再去优化任务拆解、Context管理、工具选择、失败恢复等Harness能力。 模型聚合由此不只是模型能力的拼盘,也是在为数据飞轮争取更多真实任务。 但聚合并不意味着大厂之间的边界已经消失。 从目前产品端可见的默认模型池来看,WorkBuddy虽然接入了多家外部模型,但其中没有阿里的千问和字节Seed;TRAE Work已经内置千问模型,但没有腾讯混元;库库AI目前也未见混元、千问和Seed。 各家虽然都在扩大模型选择,但仍然保留着自己的生态边界。 二 不可能三角 把更多模型装进同一个Agent,只解决了“有没有得选”的问题,真正决定聚合路线能不能跑通的是下一步怎么选。 大模型落地一直存在一组近似“不可能三角”的权衡:效果、速度和成本很难同时拉满。 能力更强的模型通常意味着更高的推理价格,复杂任务为了得到更好的结果也往往需要更长的思考和执行时间;反过来,一味追求便宜和低延迟,又可能牺牲任务完成质量。 路由要解决的本质上就是这道三角题:为了把一项工作做完,应该在什么环节花更多钱换能力,又应该在什么环节用速度和成本换效率。 这也让聚合型办公Agent的竞争开始出现另一层差异。 理想的状态是用户只需要提出任务,后台根据任务难度、时效要求和模型成本完成选择。 到了这一步,用户看到的可能只是一次“帮我做完这份报告”的请求,后台却可能已经在不同步骤之间调用不同模型。 对于个人用户,这种差别最终体现在结果好不好、需要等多久、消耗多少积分;对于企业客户,则会进一步落到一项工作的单位算力成本。 办公Agent一旦进入大规模使用,几分钱、几毛钱的单次调用差异,都会随着任务量被不断放大。 路由由此也成为成为一笔规模化的经济账。但从Agent的完整执行链条看,路由也是Harness中的一环。 一项任务从用户提出,到最终交付,中间还涉及任务拆解、Context管理、工具调用、模型选择和失败恢复。路由决定“这一环该调用谁”,但真正决定任务能不能稳定完成的是整套Harness能否把这些环节协同起来。 这也是聚合路线真正可能形成壁垒的地方。模型本身可以接入,价格也可能随市场竞争不断下降,但如何在效果、速度和成本之间找到更好的平衡需要的是足够多的真实任务,以及平台长期积累下来的调度经验。 当WorkBuddy、TRAE Work、千问办公、库库AI手里的模型越来越多,真正拉开差距的可能是同一道题谁算得更精:什么时候该用最强模型,什么时候又根本没必要。

Original Intelligence基于真实抓取数据整理

办公Agent正式进入模型聚合大战

  • 办公Agent正式进入模型聚合大战

办公Agent正式进入模型聚合大战

8月14日晚间,千问办公宣布上线智谱GLM-5

3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用

办公Agent正式进入模型聚合大战。8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。就在同一天,百度文库网盘通用智能体GenFlow正式启用中文名“库库AI”,并推出独立桌面端,其模型池同样包含DeepSeek、智谱...... 本文来自微信公众号: 全天候科技 ,作者:全天候科技 办公Agent正式进入模型聚合大战。 8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。 就在同一天,百度文库网盘通用智能体GenFlow正式启用中文名“库库AI”,并推出独立桌面端,其模型池同样包含DeepSeek、智谱GLM等外部模型。 无独有偶,腾讯WorkBuddy、字节TRAE Work都已经内置多家第三方大模型。 从腾讯、字节到阿里、百度,国内头部厂商的办公Agent正在不约而同走向模型聚合模式。 过去大模型产品争的是“谁家的模型更强”,到了办公Agent阶段,竞争逻辑开始出现变化:先把不同模型放进同一个工作台,让更多用户愿意把真实工作交进来。 只有用户真正用起来,写作、表格分析、PPT制作等真实工作流持续进入Agent,平台才有机会积累任务拆解、工具调用、失败恢复和用户纠正等反馈,并反过来打磨Harness,形成数据飞轮。 但下一道题也会随之出现:同一项任务究竟该调用哪个模型。路由由此成为聚合路线需要继续解决的问题。 一 踏入同一条河流 目前千问办公对外展示的“前沿模型”数量并不算多,除了自家的千问模型,外部模型主要是GLM-5.3和DeepSeek V4 Pro。 但千问办公明确表示三款前沿模型发布后都快速完成了接入,“这个节奏,我们会一直保持下去”。 这意味着,千问办公的内置模型池后续还会继续扩张。 相比之下,腾讯WorkBuddy已经形成了更大的内置模型池,不仅包括混元Hy3,还有智谱GLM、MiniMax、Kimi和DeepSeek等多个系列。 字节旗下TRAE Work也走在类似方向上。目前产品端可见的模型已经包括字节Seed系列、智谱GLM、DeepSeek以及千问等模型; 百度刚刚推出独立端的库库AI,同样引入了DeepSeek、智谱GLM等外部模型。 四家产品的共同点已经相当明显:办公Agent不再把自己的能力完全绑定在一家模型上。 原因在于,对办公Agent来说,现阶段比把每一次模型调用都留给自家模型更重要的是先让用户真正用起来。 当Agent开始搜索网页、打开文档、分析Excel、制作PPT、调用软件,并与用户来回修改一项工作时,都会留下更完整的执行过程:模型如何拆解任务、调用了哪些工具、哪一步失败、用户在哪一步进行了纠正,以及最终什么结果被接受。 真实工作流正是Agent时代稀缺的数据资源。 百度集团副总裁、个人超级智能事业群总裁王颖认为,随着公共数据逐渐被模型充分学习,AI继续提升的过程中人产生的新知识、新经验和新想法会越来越重要。未来真正需要共同建立的是通用智能体能力、记忆与存储,以及个人知识和经验三部分能力。 模型池越丰富,越有机会提升不同任务的完成率,降低用户尝试一款Agent的门槛;只有更多用户真正把工作交给Agent,平台才能获得持续反馈,再去优化任务拆解、Context管理、工具选择、失败恢复等Harness能力。 模型聚合由此不只是模型能力的拼盘,也是在为数据飞轮争取更多真实任务。 但聚合并不意味着大厂之间的边界已经消失。 从目前产品端可见的默认模型池来看,WorkBuddy虽然接入了多家外部模型,但其中没有阿里的千问和字节Seed;TRAE Work已经内置千问模型,但没有腾讯混元;库库AI目前也未见混元、千问和Seed。 各家虽然都在扩大模型选择,但仍然保留着自己的生态边界。 二 不可能三角 把更多模型装进同一个Agent,只解决了“有没有得选”的问题,真正决定聚合路线能不能跑通的是下一步怎么选。 大模型落地一直存在一组近似“不可能三角”的权衡:效果、速度和成本很难同时拉满。 能力更强的模型通常意味着更高的推理价格,复杂任务为了得到更好的结果也往往需要更长的思考和执行时间;反过来,一味追求便宜和低延迟,又可能牺牲任务完成质量。 路由要解决的本质上就是这道三角题:为了把一项工作做完,应该在什么环节花更多钱换能力,又应该在什么环节用速度和成本换效率。 这也让聚合型办公Agent的竞争开始出现另一层差异。 理想的状态是用户只需要提出任务,后台根据任务难度、时效要求和模型成本完成选择。 到了这一步,用户看到的可能只是一次“帮我做完这份报告”的请求,后台却可能已经在不同步骤之间调用不同模型。 对于个人用户,这种差别最终体现在结果好不好、需要等多久、消耗多少积分;对于企业客户,则会进一步落到一项工作的单位算力成本。 办公Agent一旦进入大规模使用,几分钱、几毛钱的单次调用差异,都会随着任务量被不断放大。 路由由此也成为成为一笔规模化的经济账。但从Agent的完整执行链条看,路由也是Harness中的一环。 一项任务从用户提出,到最终交付,中间还涉及任务拆解、Context管理、工具调用、模型选择和失败恢复。路由决定“这一环该调用谁”,但真正决定任务能不能稳定完成的是整套Harness能否把这些环节协同起来。 这也是聚合路线真正可能形成壁垒的地方。模型本身可以接入,价格也可能随市场竞争不断下降,但如何在效果、速度和成本之间找到更好的平衡需要的是足够多的真实任务,以及平台长期积累下来的调度经验。 当WorkBuddy、TRAE Work、千问办公、库库AI手里的模型越来越多,真正拉开差距的可能是同一道题谁算得更精:什么时候该用最强模型,什么时候又根本没必要。

❧
Industry Analysis规则派生 · 可核对

本条目归入「Technology AI」垂直,涉及真实话题:technology、ai。

· 市场:关注 technology、ai 对相关品类与竞争格局的潜在影响。

· 消费者:受众行为与偏好变化值得追踪。

· 品牌:本动向对品牌资产建设的启示。

· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。

Marketing Insight规则派生 · 可核对

· 核心话题:technology、ai。

· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?

Career Usage规则派生 · 可核对

面试中可引用「办公Agent的聚合路线“四国杀”正式打响」:围绕 technology、ai,说明你对行业动向的判断与可落地动作。

本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。

关联公司由品牌 / 正文匹配真实 dossier
Tencent
China Internet & Platforms · 中国社交与游戏龙头,2025 年营收人民币 7,517.66 亿元(+14%),归母净利润人民币…
关联播客真实 RSS 单集
咖啡豆|两次遭遇苹果冲击,运动手表佳明为何还能增长?
声动早咖啡 · 2026.08.14
商业小样46 | 买机票时,为什么总要多交两笔钱?
商业就是这样 · 2026.08.10
巴黎水和圣培露还能赚钱,雀巢为何要剥离水业务?
声动早咖啡 · 2026.08.10
延伸信源A / B 级权威来源 · 供深挖
Marketing BrewACampaignAThe DrumAWARCAAdweekADigidayA
Business English提取正文真实商业词汇
ai
ai

办公Agent正式进入模型聚合大战。8月14日晚间,千问办公宣布上线智谱GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。就在同一天,百度文库网盘通用智能体GenFlow正式启用中文名“库库AI”,并推出独立桌面端,其模型池同样包含DeepSeek、智谱...... 本文来自微信公众号: 全天候科技 ,…

系统商务英语 →
关联 English Brief
MCP 走向无状态,开发者追问:这不就又变回 API 了吗?
InfoQ 中文
办公Agent的聚合路线“四国杀”正式打响
虎嗅
来源
阅读原文 · 虎嗅 ↗
发布:2026.08.16
类型:Business / 中文商业
话题:technology、ai
相关阅读
虎嗅/2026.08.15
AI 满篇的“不是……而是……”,我开始不敢写了
虎嗅/2026.08.15
泡沫是技术革命的必要前置成本
虎嗅/2026.08.14
从超级个体到组织收益,AI卡在哪?
虎嗅/2026.08.14
智元机器人把20多个“天才”秘密隔离了起来,然后呢?|大苗看具身
虎嗅/2026.08.14
在乌兰察布,89个数据中心跟羊抢水喝
个人笔记
自动同步到云端