🤖
豆包工作发布首日拆解
字节押上TRAE和扣子 · 飞书上下文全面打通
办公Agent四国杀正式开打
AI
AI工具导航
cn.xcoolevdb.site · 2026年8月25日
豆包工作发布首日拆解:字节押上TRAE和扣子,办公Agent四国杀开打
8月25日,字节跳动正式发布企业级办公Agent豆包工作,把TRAE、扣子和7月底已并入的飞书团队全部集结在豆包体系之下,叠加腾讯WorkBuddy、阿里千问办公、百度库库AI,办公Agent四国杀正式成型。这场大战的真正战场不在模型,而在企业上下文。
📋 本文目录
一、事件速览:8月25日,字节亮牌
二、豆包工作能做什么:从聊天框到交付结果
三、任务执行系统:操作电脑、云电脑接力、手机遥控、多Agent工作小队
四、组织大整合:TRAE、扣子、飞书向豆包集结
五、飞书上下文:字节最硬的牌
六、四国杀格局盘点(四产品对比表+8月时间线表)
七、为什么办公Agent的PMF先从ToC跑出来
八、模型聚合之后,决胜点是路由
九、高盛视角:Agent进入执行时代
十、上手指南与冷思考+结语
一、事件速览:8月25日,字节亮牌
8月25日,据华尔街见闻、极客公园等多家媒体报道,字节跳动正式发布企业级办公Agent豆包工作。电脑版官网可下载,免费领30天订阅权益;同步升级飞书内的豆包企业版入口。这是字节首次以完整的”产品+组织”双线阵容切入企业办公Agent战场,也是国内办公Agent四国杀格局真正成型的一天。
豆包工作产品负责人赵祺在发布中表示,豆包工作可以自主拆解任务、调用工具、持续推进复杂工作流,从”对话窗口”升级为”交付结果”。配合8月24日的组织调整公告——TRAE、扣子团队并入豆包体系,向豆包产品负责人赵祺汇报,TRAE Work/扣子与豆包整合,TRAE IDE/CLI继续编程线,7月底飞书团队已并入豆包——可以看出字节对这场战的打法:把模型、Agent、IDE、企业协作、办公应用五条产品线全部押到豆包这一条船上。
本站在四天前本站盘点的办公Agent大战一文中,曾指出8月14日阿里千问办公、百度库库AI同日上线,叠加腾讯WorkBuddy,办公Agent三国杀已经形成。四天过去,字节豆包工作以最强阵容入局,三国杀正式升级为四国杀,而其中暗藏的牌局远不止一款新产品那么简单。
🔑 8月25日豆包工作发布关键节点
• 8月25日:豆包工作正式发布,电脑版官网可下载,免费领30天订阅权益
• 产品定位:企业级办公Agent,自主拆解任务、调用工具、推进复杂工作流
• 入口升级:飞书内豆包企业版入口同步升级,实现”一处升级,全端可用”
• 8月24日:组织调整,TRAE、扣子并入豆包,向赵祺汇报
• 7月底:飞书团队已并入豆包体系
• 8月17-21日:密集发布手机远程控制电脑、Windows虚拟桌面、双模式、侧边工作台、技能商店、连接器、工作伙伴,累计200+技能和连接器
如果只看产品发布,这是一次常规的企业Agent上新;但如果把镜头拉远到8月整月——密集的产品发布、组织整合、认证落地、竞对跟进——就会发现,这并非单点动作,而是字节用一个月时间完成了从”AI产品矩阵”到”AI办公操作系统”的转身。
二、豆包工作能做什么:从聊天框到交付结果
豆包工作的核心定位,可以用一句话概括:它不再是一个聊天框,而是一个交付结果的工作系统。
据极客公园和豆包工作公众号介绍,豆包工作在能力上覆盖了企业办公的全链路场景:
• 写东西:写方案、会议纪要、报告、调研总结、表格分析
• 生成物:生成文档、表格、PPT、图片、视频、网页、应用
• 指哪改哪:协作编辑中支持框选定、点修改,所见即所得
• 操作设备:授权后操作浏览器和电脑,跨应用执行任务
• 长任务:长任务调用云电脑接力,本机关机不中断
• 远程控制:手机远程操控电脑,实现人在路上,任务在跑
• 多Agent:组建多Agent工作小队(数据/研究/设计智能体协作)
把这些能力放在一起,会发现豆包工作的产品形态和前几代办公AI有明显区别:它不是把任务拆成”提示词+对话、复制粘贴结果”的循环,而是把任务看作”从输入到交付物的完整工作流”,由Agent自主规划路径、调用工具、推进多步骤执行。
特别值得注意的一项能力是”框选定、点修改”。这一交互最早在Cursor、Notion AI等工具中出现,本质是把AI的编辑粒度从”整段重写”细化到”局部元素级修改”,对最终用户的修改成本而言是数量级降低。豆包工作把它纳入默认交互,意味着字节认为这一交互已经过了教育期,可以放进企业Agent的标配能力里。
💼 豆包工作能做什么(企业视角)
• 写方案:输入目标与约束,输出完整可执行方案文档
• 会议纪要:基于真实会议内容生成结构化纪要与待办
• 报告与调研总结:多源信息汇总、分析、产出报告
• 表格分析:对Excel/在线表格做分析、出图、给结论
• 多模态生成:文档/表格/PPT/图片/视频/网页/应用一站生成
• 协作编辑:框选定 点修改的局部精修,不再整段重写
换言之,豆包工作这次发布真正想回答的并不是”AI能不能写东西”,而是”AI能不能把整件事做完,并把结果交到人手里”。这是从”工具”到”工作系统”的产品跃迁,也是字节对企业级办公Agent的第一份正式答卷。
三、任务执行系统:操作电脑、云电脑接力、手机遥控、多Agent工作小队
如果只把豆包工作看作”更强的聊天框”,会错过这次发布真正的产品质变。它的核心不是对话模型,而是一套任务执行系统。这套系统由四个关键机制组成,每一个都在重塑Agent的产品形态。
3.1 操作电脑:Agent首次跨应用执行
据豆包工作公众号介绍,豆包工作授权后可以操作浏览器和电脑。这意味着Agent不再局限于”在某个应用内部”完成任务,而是能跨应用调度——比如在ERP里抓数据、在Excel里处理、再把结果贴到飞书文档。这一能力在企业场景里是刚需,也是”个人Agent”和”企业Agent”的分水岭。
3.2 云电脑接力:本机关机任务不中断
长任务调用云电脑接力,本机关机不中断,这一点解决的是企业Agent最常被诟病的可靠性问题。过去如果Agent跑一个长流程,本机关机、网络断开、浏览器关闭都会让任务中断。云电脑接力的引入让Agent有了”独立运行环境”,用户的本机只承担交互入口的角色,执行过程由云端承接。
3.3 手机远程操控电脑:Agent随人而走
8月17-21日密集更新中,手机远程控制电脑正式上线。这意味着你可以在路上用手机指挥家里的电脑跑任务,人和设备的空间解耦。这一能力对企业高管的差旅场景、自由职业者的移动场景都意义重大,也让Agent从”工位工具”升级为”随身助手”。
3.4 多Agent工作小队:数据/研究/设计智能体协作
最关键的一项是组建多Agent工作小队——数据智能体、研究智能体、设计智能体可以协作完成同一个任务。这一能力本质上是在企业Agent之上叠加了一层”团队抽象”:一个复杂任务被拆解为数据收集、深度研究、视觉设计等子任务,各Agent并行执行,最后由调度Agent整合交付。这与企业里”数据分析师+研究员+设计师”的小团队工作方式高度同构。
| 执行机制 |
解决的痛点 |
企业价值 |
| 操作浏览器和电脑 |
Agent无法跨应用调度 |
数据抓取、跨系统协作 |
| 云电脑接力 |
本机关机任务中断 |
长时间流程可靠性 |
| 手机远程操控 |
人机空间绑定 |
差旅/移动办公 |
| 多Agent工作小队 |
单人Agent能力有限 |
复杂任务并行执行 |
| 技能商店/连接器 |
Agent能力扩展难 |
200+技能/连接器生态 |
| Windows虚拟桌面/双模式/侧边工作台 |
企业IT环境兼容 |
不破坏既有工作流 |
如果说模型是Agent的大脑,那这四个机制就是Agent的”手脚+办公位+团队”。豆包工作在产品形态上,实际上已经把”Agent”这个词从”对话”重定义为了”任务执行系统”。
四、组织大整合:TRAE、扣子、飞书向豆包集结
如果只看产品发布,容易低估字节这次动作的力度;真正有信号意义的是8月24日的组织公告:TRAE、扣子团队并入豆包体系,向豆包产品负责人赵祺汇报。这是一次罕见的大整合,把字节内部与”AI办公”相关的多条产品线全部押到了一条船上。
整合之后的产品分工是:
• TRAE Work/扣子:与豆包工作整合,主要承担Agent和办公场景的入口能力
• TRAE IDE/CLI:继续编程线,服务开发者,不并入办公线
• 飞书团队:7月底已并入豆包,与豆包工作共享上下文与权限体系
• 豆包工作:作为企业级办公Agent的主品牌,统筹对外发布与商业化
这套组织调整传递的信号很明确:字节认为企业办公Agent不是单一产品的胜利,而是”模型+Agent+IDE+企业协作+办公应用”整条产品线协同作战的结果。任何一环薄弱,都会导致Agent在企业场景里跑不通。
🏢 字节组织整合关键节点
• 7月底:飞书团队并入豆包体系
• 8月17-21日:豆包工作密集更新(手机远程控制/Windows虚拟桌面/双模式/侧边工作台/技能商店/连接器/工作伙伴)
• 8月24日:TRAE、扣子团队并入豆包,向赵祺汇报
• 8月25日:豆包工作正式发布,TRAE Work/扣子与豆包整合
• 累计能力:200+技能和连接器,覆盖办公全链路
这种整合在互联网大厂里并不常见——多数公司的做法是让各条产品线独立跑,KPI分摊,组织不交叉。但办公Agent的特殊性在于,它的每一个具体场景都需要模型、Agent编排、企业上下文、协作应用、安全合规五件事协同,任何一件分头负责都会出现推诿。字节选择把五条线压到豆包一个品牌下,等于在赌”集中兵力打穿企业场景”是当下唯一正确的姿势。
再往深一层看,TRAE本来是字节的”AI IDE”产品线,主攻代码场景;扣子是字节的”AI应用搭建”产品线,主攻低代码Agent构建;飞书是字节的协作办公套件;豆包是字节的大模型品牌。这四块业务在组织上分属不同部门时,会自然各自为战;一旦整合到豆包体系,模型层的更新就能直接喂给Agent,Agent的执行结果可以直接写回飞书文档,飞书的权限体系可以无缝被Agent调用——这是典型的”产品集成+组织整合”双管齐下的打法。
五、飞书上下文:字节最硬的牌
如果说TRAE、扣子、飞书的整合是组织动作,那飞书在产品层面的贡献是”上下文”。在豆包工作的发布会里,飞书上下文被反复强调,字节的逻辑很清楚:企业Agent的真正壁垒不是模型,而是模型能调用的”企业上下文”。
据极客公园报道,豆包工作在飞书内的打通是这一轮发布最重磅的产品能力,具体表现为:
• 权限范围内调用:聊天记录、文档、会议纪要、日程等飞书数据,基于用户授权和飞书权限体系调用
• 基于真实企业上下文:写方案、调数据、生成报告时,直接读取飞书内已有的协作内容
• 共创内容沉淀回飞书:Agent生成的内容可以写回飞书文档,反哺企业知识库
• 继承飞书权限体系:个人/企业数据隔离,全链路安全可控
• 国内首批通过办公智能体能力与云端基准测试双项认证
这一组能力的关键词是”权限”和”上下文”。对企业IT而言,这两件事比”AI能不能写”重要十倍:任何Agent在企业里跑不通,根因几乎都是”调不到真实数据”或”权限/合规过不了”。字节通过飞书的整合,把这两个根因直接消除了。
“组织上下文分散在聊天、文档、会议、权限、业务系统里,积累效应强、迁移成本高,是长期壁垒。个人Agent交付的是主观价值(省2小时),进组织才有客观价值(转化率/交付周期/收入)。”
这一逻辑被多家办公Agent的产品负责人反复强调。本站整理公开材料发现,飞书上下文在豆包工作里的实际作用,可以拆成三层:
第一层:数据层
飞书内的聊天记录、文档、会议纪要、日程,成为Agent可以直接调用的”企业数据源”。这与”上传一份PDF让AI读”是完全不同的事——飞书数据是实时、结构化、有权限的,Agent调用时看到的内容,和员工看到的内容完全一致。
第二层:权限层
飞书已有的成熟权限体系(可见/可编辑/可分享/可下载)被豆包工作继承,Agent执行任务时严格按用户权限运行。这让企业IT不必为Agent单独建一套权限,大幅降低部署成本。
第三层:回流层
Agent的产出物写回飞书后,自动进入企业知识库,成为后续Agent和其他员工可复用的资产。这意味着每一次Agent执行,都在给企业沉淀数据资产,而不是用完即丢。
这才是豆包工作最硬的一张牌。模型可以套壳,工具可以拼凑,但一家公司的”飞书+企业上下文”是用一年、三年、五年的协作历史沉淀出来的,迁移成本高到企业无法承受。字节把这张牌打出来,等于把办公Agent的护城河从”模型能力”重新定义到了”企业上下文厚度”。
六、四国杀格局盘点
把镜头拉远到8月整月,会发现豆包工作发布是这一轮办公Agent大战的高潮,而不是起点。从8月3日阿里千问办公公测,到8月14日千问办公和库库AI同日上线,再到8月25日豆包工作正式发布,国内办公Agent的四国杀格局在不到一个月内彻底成型。
本站在前文已经盘点了8月14日时点的三强格局。四天过去,四款产品在模型策略、组织架构、生态策略上各有动作,值得用一张总览表说清楚。
6.1 四产品对比表:模型/形态/生态策略
| 产品 |
厂商 |
核心形态 |
模型池 |
生态策略 |
| 豆包工作 |
字节跳动 |
桌面端办公Agent |
豆包Seed/GLM/DeepSeek/千问 |
TRAE+扣子+飞书全线整合,飞书上下文 |
| WorkBuddy |
腾讯 |
桌面端办公Agent |
混元Hy3/GLM/MiniMax/Kimi/DeepSeek |
企业微信/腾讯文档接入,腾讯系办公生态 |
| 千问办公 |
阿里巴巴 |
桌面端办公Agent |
通义千问/GLM-5.3/DeepSeek V4 Pro |
整合QoderWork/MuleRun/悟空,计划接钉钉 |
| 库库AI |
百度 |
桌面端办公Agent |
文心/DeepSeek/GLM |
8/14启用中文名”库库”+桌面端,搜索+知识图谱 |
这张表最直观的信号是:四款产品全部不约而同地走向了”多模型路由”的策略——每一家都在自家主力模型之外,接入了GLM、DeepSeek、千问等头部模型作为可选后端。这印证了第八章会展开的判断:在企业Agent场景里,模型不是壁垒,模型之上的路由/编排/上下文才是壁垒。
6.2 8月时间线表:四国杀成型全记录
| 日期 |
事件 |
意义 |
| 8月3日 |
千问办公公测,整合QoderWork/MuleRun/悟空,计划接钉钉 |
阿里办公Agent公开亮相 |
| 8月14日 |
千问办公上线GLM-5.3和DeepSeek V4 Pro |
多模型路由策略落地 |
| 8月14日 |
库库AI启用中文名+桌面端,引入DeepSeek/GLM |
百度从”搜索+AI”转向”办公Agent” |
| 8月17-21日 |
豆包工作密集更新,200+技能和连接器 |
字节铺好产品基础 |
| 8月24日 |
TRAE、扣子并入豆包,向赵祺汇报 |
字节组织大整合 |
| 8月25日 |
豆包工作正式发布 |
四国杀格局正式成型 |
短短不到一个月,四款产品完成从”亮相”到”产品就位+组织整合”的全部动作。如果回看2025年同期,这一波节奏的密度几乎是前一年的两倍——这正是”AI产业进入执行时代”的真实写照(第九章会展开)。
6.3 WorkBuddy参照:腾讯跑出来的真实数据
四国杀里进度最快、产品形态最先验证的,是腾讯的WorkBuddy。据腾讯2026年Q1财报,WorkBuddy是”中国使用最广泛的效率AI智能体”,日活已达百万量级。易观Analysys数据显示,WorkBuddy 6月桌面端月访问量为2097万。
据报道,WorkBuddy今年3月还只是腾讯内部一个十几人团队的支线产品,马化腾过问后迅速扩至百人团队。活跃留存超过60%,付费留存超过80%——这两个数字在SaaS行业里都属于顶尖水平,说明WorkBuddy不仅把人拉进来了,还把人留下来了,更让企业愿意付钱。
对字节而言,WorkBuddy的存在既是压力也是坐标:压力在于腾讯已经抢跑,字节必须拿出比WorkBuddy更强的产品力;坐标在于WorkBuddy的数据已经证明,办公Agent在企业市场有真金白银的PMF,字节不必从零教育市场。
七、为什么办公Agent的PMF先从ToC跑出来
一个有意思的现象是:办公Agent四国杀里,几乎所有厂商都是从ToC(个人用户)起步,然后才杀向ToB(企业)。这和企业级SaaS的传统逻辑相反——过去二十年的SaaS都是先ToB再ToC,因为企业有付费能力、有采购流程、有IT决策者。
但办公Agent打破了这个逻辑。原因在于,Agent的”价值证明”和SaaS的”价值证明”在传播路径上是反的。SaaS的卖点是”管理效率”,只能由老板和IT部门感知,员工是被动接受者;Agent的卖点是”省时间”,每个员工自己就能感知,而且越早用越能积累先发优势。
从员工到老板:自下而上的渗透路径
WorkBuddy的数据已经验证了这条路径:活跃留存60%、付费留存80%,这意味着用户先在ToC场景里深度使用,然后主动向企业申请采购。这种”员工先买、企业后买”的路径,在SaaS时代几乎没有先例,只有在生成式AI爆发的2024-2026年才成为可能。
从个人价值到组织价值:主观到客观的跨越
多位行业产品负责人在公开发言中提到,个人Agent交付的是主观价值(省2小时),进组织才有客观价值(转化率/交付周期/收入)。这一句话点出了办公Agent从ToC到ToB的关键跨越:省2小时是个人感知,转化率/交付周期/收入是老板感知。当Agent在企业里规模化部署之后,价值评估维度必须从”主观省时间”升级到”客观业务指标”。
这也是为什么豆包工作这次发布格外强调”飞书上下文”——企业上下文的接入,正是让Agent从”省时间”升级到”改善业务指标”的关键一步。Agent能调到企业真实的销售数据、生产数据、客户数据,才能交付业务结果;调不到,就只能在”省时间”这个维度打转。
八、模型聚合之后,决胜点是路由
对比四国杀的四款产品,有一个非常显眼的趋势:每一家都在接入外部模型。豆包工作内置Seed/GLM/DeepSeek/千问,WorkBuddy模型池是混元Hy3/GLM/MiniMax/Kimi/DeepSeek,千问办公上线了GLM-5.3和DeepSeek V4 Pro,库库AI引入DeepSeek/GLM。
这意味着模型本身已经不是壁垒。豆包的Seed很强,但GLM-5.3、DeepSeek V4 Pro同样在头部;混元Hy3、Kimi、GLM在WorkBuddy的模型池里都能用。任何一款Agent,只要接上”国产Top5模型”作为可选后端,在模型能力上就基本够用。
真正的决胜点:路由与编排
当模型成为公共资源,胜负手就转移到了”路由”上:什么时候用哪个模型?什么任务用强推理模型、什么任务用快速模型?如何把多个模型的结果整合成一份合格的交付物?这背后考验的是Agent的”任务理解-任务拆解-任务分发-结果整合”四步能力。
路由之上的能力:工具与连接器
仅有模型路由还不够,Agent还需要把模型能力落地到具体工具上——这就是为什么豆包工作发布时专门强调200+技能和连接器。工具的数量和覆盖广度,决定了Agent能不能真正”做事”;模型的智能,决定了Agent能不能”做对事”。两者缺一不可。
再往上:企业上下文
再往上走一层,决定胜负的就是”企业上下文”——Agent能调到什么数据?能在什么权限下运行?能写回到哪个系统?这正是飞书上下文对豆包工作的价值,也是WorkBuddy绑定企业微信和腾讯文档的价值,是千问办公绑定钉钉的价值,是库库AI绑定百度网盘+文库的价值。
所以今天的办公Agent竞争,本质上是”模型之上叠加路由、路由之上叠加工具、工具之上叠加企业上下文”的三层叠加。每一层都有壁垒,但最大壁垒在最上层——企业上下文的厚度,才是迁移成本最高、对手最难复制的护城河。
九、高盛视角:Agent进入执行时代
把视角再拉远一层,高盛2026年8月研报中提出的判断,值得所有关注AI产业的人认真看。在这份报告里,高盛对AI产业演进给出了几个关键判断:
• 商业化模式转变:从按席位订阅转向按消费量、交易量、结果收费。订阅制是SaaS时代的逻辑,按结果付费是Agent时代的逻辑。
• Agent角色转变:从辅助工具走向工作流执行者。Agent不再只是帮员工查资料,而是直接替员工完成任务、交付结果。
• 价值转移:从模型向专有数据、业务上下文、领域专业能力迁移。模型同质化之后,真正的价值在专有数据和业务上下文。
• 算力需求:未来5年AI相关算力需求增长约24倍。Agent执行时代对算力的消耗将远高于聊天时代。
这四条判断放到办公Agent四国杀里,几乎一一对应:豆包工作从订阅制向”按结果/按任务”计费迁移,Agent从对话工具转向任务执行者,价值从豆包Seed模型转向飞书企业上下文,200+技能和连接器对算力的消耗远超聊天场景。
高盛报告里还提到了一个关键趋势:”未来5年AI相关算力需求增长约24倍。”这意味着办公Agent一旦进入企业规模化部署阶段,云算力的消耗将呈现指数级增长,反过来会重塑云计算市场的竞争格局。这也是为什么豆包工作发布里专门提到”云电脑接力”——这一能力既是产品功能,也是算力战略的落地。
“公共数据被充分学习后,人产生的新知识、新经验、新想法越来越重要。”——百度 王颖
百度王颖的这句话,和高盛报告里的”价值向专有数据迁移”是同一逻辑:当模型在公共数据上已经训练到极致,下一阶段的差异化就来自”专有数据+人的新知识+业务上下文”。这正是办公Agent在企业市场的真正机会——不是再造一个更强的模型,而是把模型放进企业的真实业务流里,让它持续学到企业独有的知识。
十、上手指南与冷思考+结语
上手指南:四步用上豆包工作
1. 下载入口:电脑版官网可下载,免费领30天订阅权益,先跑通核心场景。
2. 飞书打通:同步升级飞书内豆包企业版入口,授权后让Agent调用真实企业上下文。
3. 多Agent小队:尝试组建数据/研究/设计智能体协作的复杂任务,体验并行执行。
4. 远程+长任务:在差旅场景用手机远程操控电脑,体验云电脑接力的可靠性。
冷思考:五个值得警惕的点
1. 免费期是教育期,不是常态:30天免费权益用完后,企业付费意愿和组织预算是否到位,需要提前评估。
2. 权限合规永远排第一:Agent调用企业上下文时,即使有飞书权限保护,也要提前和IT/法务对齐数据边界。
3. 不要把生产链路绑死在一款Agent上:四国杀格局未定,TRAE Work/扣子/WORKBUDDY/千问办公/库库AI都有被切换的可能,关键任务留有备选方案。
4. 人的判断不可被替代:Agent交付的方案/报告/纪要,关键决策环节必须由人复核,不能直接用。
5. 多Agent协作的”团队税”:多Agent工作小队听起来很美,但调度开销、沟通成本、结果不一致的风险都会拉高实际成本,小任务不建议用。
💡 一句话总结
8月25日豆包工作发布,是字节把TRAE、扣子、飞书三张牌押上桌面的关键一步,办公Agent四国杀正式成型。这场大战的真正战场不在模型,而在企业上下文——谁能把模型、路由、工具、企业上下文四层能力叠加到最厚,谁就能在下一阶段的AI办公操作系统之争中拿到船票。Agent从聊天框到交付结果,产业从订阅制到按结果付费,执行时代已经来了。
后续我们将持续跟进豆包工作、WorkBuddy、千问办公、库库AI四国杀的产品迭代、企业落地和算力消耗数据。也欢迎回顾我们此前的相关深度内容:四天前本站盘点的办公Agent大战。