8月25日,豆包发布全新的Agent办公产品“豆包工作”。
作为字节面向AI办公场景的统一产品和品牌,豆包工作拥有新的Logo和独立的入口。我们注意到,豆包工作的Slogan是“工作新习惯,先让豆包干”,这不禁让人想起飞书之前的口号“先进团队,先用飞书”。
新品牌豆包工作似乎在与原来的豆包AI助手做区隔,新Logo类似莫斯乌比环设计,从配色上也更接近飞书。豆包擅于提供“情绪价值”的一面太过深入人心,为了不走老路,能看出这回豆包办公从整体调性上特别强调专业和办公属性。

就在前一天,字节完成了对旗下办公AI产品的整合:TRAE、扣子(Coze)团队整体并入豆包体系,其产品将与豆包在工作场景的产品能力进行整合;TRAE IDE及CLI将作为豆包品牌下的编程产品线持续发展。
豆包工作官方称,其与飞书已经深度打通,让Agent基于企业上下文更准确地完成工作。同时上线个人版和企业版,除了更多的额度外,收费版中用户还可使用最新版的视频和图片模型。
接近大厂AI办公人士告诉我们,“一个AI产品出来,开枪时间只有一个月。这一个月不开枪,就永远没有机会再开枪”。
一月三步棋,字节如何重建办公入口?
从结果来看,谷歌将Gemini整合进其办公套件Google Workspace和微软构建以Copilot为核心构建“办公 AI”产品矩阵的路线,都走得磕磕绊绊。
有专业人士告诉我们,判断一个产品是不是真正的AI原生产品,就看把AI功能去掉之后,它是否还成立。
过去国内在原有产品基础上做AI功能增减也是上面的逻辑,但行业内逐渐认识到真正的AI产品逻辑,应该是AI是其存在的唯一理由,离开AI其产品价值立即归零。
近期,从Workbuddy、千问办公到百度库库AI、豆包工作,就是转向的印证。他们的核心思路很一致,即不再把AI当做一个可选的“插件”,而是将AI作为整个产品的基石和唯一入口。
上述专业人士表示,钉钉和飞书这类协同平台提供的是“上下文层”,AI能否在大型企业落地,关键在于能否消化这一中间层。
字节调整的第一步也恰恰在此,7月底,字节完成了飞书产品团队整体并入豆包的组织重组。飞书的定位从独立办公SaaS,转变为了豆包企业级AI的办公场景载体。公司的知识都沉淀在飞书,豆包工作接入后,可查会议结论、总结群聊、制定方案、生成周报等。
第二步是补全执行与生态。通过整合TRAE团队,补强了AI操作电脑、跨软件执行任务的“动手能力”;通过整合扣子(Coze)团队,获得了超过200个技能和连接器的“生态连接能力”。最终将办公能力从豆包App内的一个模式,升级为独立的“豆包工作”品牌,以一个统一的AI原生入口出战。
一个月下三步棋,由此形成了火山引擎出模型、算力和数据平台,飞书出场景、上下文和权限体系,豆包出AI交互与统一入口的战略协同格局。
在消化上下文的基础上,豆包工作将自身定位为一个能自主拆解任务、调用工具、持续推进复杂工作流程的智能执行体。
具体功能包括,内容生成与编辑功能,支持生成文档、表格、PPT、图片、视频、网页甚至应用。其 “指哪改哪” 的协作编辑能力,允许用户直接框选修改生成内容,无需反复重来;跨软件操作与远程执行,获得授权后,它能直接操作浏览器和电脑,跨软件完成数据处理、信息收集等任务。对于耗时任务,可调用云电脑持续执行,用户甚至能通过手机远程查看和控制进度;多Agent协同,用户可调用超过200个技能和连接器,或组建由多个专业Agent组成的 “工作小队” 分工协作。
在豆包工作上线的第一时间,光子星球就做了一手评测。总体来说,豆包工作的回答很务实,实现了可见、可控和可逆。当一款产品同时满足这3个要素,“把工作交给AI”才有机会从口号变成可执行的选项。
从读懂云盘,到指哪改哪
结合豆包工作给出的功能展示,我们针对它跟WorkBuddy、千问办公等这些同类产品设计了五轮差异化测试。
第一个测试是云盘互通。我们让豆包工作去读取云盘中近三个月的所有文章,分析写作主题和风格,并做一个创意作品集网页。
它一篇不落地读完了116篇文章,每篇文章生成的卡片都带着标题、一句话摘要和主题标签,在我们逐条抽查后,发现摘要和标签与原文明显不符的数量是零。

网页成品本身过关,设计风格偏保守,但不是那种一眼AI的模板味,响应式适配做得完善,本地浏览器打开后排版、链接、交互全部正常。
这项测试验证的是官方宣称的“豆包工作与飞书深度打通”。从结果看,云盘读取到网页生成的整条链路是畅通的,而且内容理解这一环没有掉链子。对写内容创作者来说,这是一个能直接用的场景,攒下的文章素材,一句话就能变成一个可以分享出去的作品集页面。
第二个测试是“指哪改哪”。我们直接用第一个测试生成的作品集网页当编辑对象,要求它把首页的作者介绍改成指定文案,把第三张文章卡片的标签换成“深度实测”,同时保持其他内容不要动。
现在市面上做PPT和文档的AI工具,在编辑环节大多是整篇重新生成。用户想要改一句话,AI就把整个文档重写一遍,甚至有可能把用户已经满意的部分也修改了。
但是豆包工作的做法不一样,只要光标移到页面元素上,它就会自动提示该元素的类型,而且选中哪个就改哪个,颗粒度细到具体的HTML标签。
最终结果完全符合我们的预期,指定的两处都按照要求被修改,同时对未指定的区域逐屏对比,没有一处改动。重新编辑后的网页,可以正常打开,排版仍然没有崩。

对做过前端或者运营过网站的人来说,这个能力的价值不需要解释。AI生成内容的最大消耗不在生成,而在每次从头再来的推倒。豆包工作元素级的精准编辑把“生成一次然后反复打磨”变成了可能,这也是五项测试里我们评价最高的一项。
它替你操作电脑,你在不在都行
第三个测试是虚拟桌面。我们让它打开携程网页版,查9月5日北京到上海的高铁二等座,把上午9点到12点出发的车次、历时、票价整理成Excel,再存到桌面。
整个过程在应用内启动的独立浏览器里完成。任务执行期间,我们同时用本机的浏览器和其他软件,双方互不干扰。这一点和Manus的云端虚拟机体验完全不同,任务就发生在你眼前的这台电脑上,但又不影响你正常使用。

在最终交付的Excel里,车次、历时、票价和携程页面实际数据一致,没有发现错漏。

全程可见加随时接管,这个组合解决的是Agent产品最核心的心智障碍——信任。你敢不敢让它替你操作电脑,取决于你能不能看到它在干什么,以及出现问题的时候能不能立刻抢回来。关于这两个问题,豆包工作都完成得很好。
第四个测试是手机远程派发。电脑锁屏放在一边,我们在手机豆包App上发了一条指令,让它把下载文件夹里的文件按图片、文档、压缩包分类归档,完事给一份清单。

锁屏状态没有影响执行,任务照常跑完。回到电脑前检查,文件归类错误数量依然为零,清单也同步推了回来。

让我们意外的是,在这项测试过程中发现了惊喜,比起手机遥控电脑,豆包工作里的“云电脑”才是更实用的形态。遇到需要持续运行的任务,但又不方便开电脑的时候,就可以直接丢给云电脑执行。手机远程更像是一个应急入口,云电脑才是“人离开,活不停”的正解。

第五个测试是工作伙伴。豆包工作的伙伴市场里目前有13种类型的专业Agent,我们挑了三个合适的伙伴组成工作小队,然后下了一个完整需求,“调研最近一个月主流AI办公工具的动态,整理横评维度,最后输出一份公众号选题大纲。”
需求发下去之后,队长先分析任务,再把子任务分给小队成员,每个角色接力的过程在界面里完整可见,谁在干什么一目了然。

我们逐条核查了最终交付的选题大纲,行业动态和引用链接两项,没有发现编造的内容。
小bug也有,比如小队里的三个Agent不能同时干活,得前一个干完下一个才能接上。多Agent组队的意义本来就包含并行提效,现在的形态更像把一个人的工作拆成了三份依次做,分工的价值虽然有了,但效率的账没算过来,这也是五项测试里唯一明确的改进点。
争夺时间窗口
“开枪只有一个月”并非夸张,而是由AI办公赛道的特殊性所决定的。
AI办公工具的本质是改变用户习惯。一旦用户习惯了某个AI工作台的交互方式、上下文绑定和操作路径,迁移成本极高。因此,第一个让用户和企业把真实工作交进来的产品,拥有极大的先发优势。
以豆包工作为例,在我们测试中,116篇文章全部读完且理解零错漏;虚拟桌面隔离、全程可见、随时接管以及数据无误;网页编辑做到了元素级精准,指哪改哪不殃及其他部分,这项能力在同类产品里目前找不到对标。
同时,AI办公又是典型的重资源赛道,需要模型、算力、场景、数据、渠道多方协同。时间窗口极短,要求玩家必须在极短时间内完成组织、产品、品牌的三重整合,字节、阿里的调整都在一个月之内。
有人说“这是生态入口的胜利”。照这个逻辑,使用钉钉的用户都该去用千问办公,使用飞书的用户都该去用豆包工作。但现实显然并非如此,每个大厂手中都不只有一个入口,上个时代的钉钉、飞书和企微,AI时代的豆包、千问和元宝。
入口只决定了用户是否愿意点开,而决定留不留下来则是另一回事——信任。让Agent代替用户深度切入真实工作环境,核心障碍从来都不是能力,而是敢不敢。


VIP复盘网