模型都放平以后,办公 Agent 到底在争什么
最近"模型聚合"这个说法到处被提:腾讯、字节到阿里、百度,办公 Agent 都不约而同改了打法,不把自己绑死在一个自研模型上,而是做成统一的入口和网关,按场景把任务分给不同的模型。
我不太信"不约而同"。这几家地盘差远了,有的是云厂商靠卖底座和算力吃饭,有的是 ToC 工具天天琢磨怎么让你用着顺手,还有的背靠社交或云生态,护城河根本不在模型这层。走到同一个姿势,更像窄路上被迫排成一线,而不是约好去同一家馆子。所以值得琢磨的,不是为什么都这么干,而是模型放平之后,大家到底在争什么。
很多人把聚合理解成省钱或选更聪明的模型,我更愿意把它看成启动了一个飞轮:模型池越丰富,任务完成率随之提升,用户才愿意交付更多真实工作任务,真正的失败样本多起来,再把拆解、记忆、纠错这些上层链路磨结实。模型会换代、会越来越便宜,这条靠真实使用养出来的链条,才长在自己手上。
但这个飞轮门槛其实高得吓人。要它转起来,前提是有足够多的真实办公任务去喂出业务错误样本;没有用户体量,接入再多模型也攒不出质量。换句话说,这套壁垒天然向已经握有大量存量办公用户的巨头倾斜,中小团队即便把聚合做得再周全,也很难复制同样的优势。这大概才是头部敢一起往这条窄路上挤的原因。
也不能只看收益,聚合自己会带来新成本。切换不同模型,会出现记忆割裂、输出风格不统一,造成碎片化的用户体验;路由得先"判断该调哪个模型",这本身就要消耗时延和算力;更别提企业场景里,数据不能随便外送给第三方模型,权限、合规、供应商审计全是硬约束。聚合在企业落地,远没有听起来那么顺滑。
这里还有一个容易被误读的地方:说模型被放平,不等于底座不重要。一旦出现能力跃迁式的新底座,依然会整体抬高上层 Agent 的天花板。聚合只是降低了"自研模型"在竞争里的分量,并不是模型从此无关紧要。
说到底,办公 Agent 的竞争从来不止于技术链路。模型、路由、飞轮都可以外包或复制,可文档沉淀、用户迁移成本、办公软件生态、组织里早已跑顺的工作流习惯,这些才是更深的壁垒。技术打磨得再细,嵌不进用户每天的工作流,照样没人用。
所以模型放平,放平的只是那个最显眼的变量。放平之后剩下的差别,是接几个模型也弯道超车不了的——几家真正在争的,从来不是模型这一手。