实测豆包AI工作流:都达标,尤其视频借助Seedance带来办公差异化优势,就是Prompt要够多够细费token


在年初OpenClaw引发了Agent开源热潮后,大厂们就灵敏的嗅到了属于AI Agent最优的落地选择,也就是办公场景,随后腾讯便推出了WorkBuddy。
此后,百度、阿里等大厂们也相继推出了自己在办公领域的Agent产品,进入8月,字节豆包推出了自己的办公Agent豆包工作,宣布入局。
目前市场上的这些Agent产品虽说在大的产品架构和方向上,区别不是很大,但在各自的专精领域上还是有所不同的,比如WorkBuddy和百度搭子,面对的主要是C端基础办公领域,而千问办公则是面向B端中高端场景。
豆包工作就又不一样了,因为豆包工作背靠字节系,它选择融入了一个得天独厚的优势,也就是Seedance等视频模型带来的多模态场景,这一优势是其他Agent产品很难超越的差异化门槛。
虽说豆包工作建立起了这道门槛,但到底好不好用还是得经过实际体验才知道。
一
一句话能解决一套PPT?
首先进行第一项测试,我们以 "2025年中国AI办公工具市场格局与趋势" 为题,让豆包工作帮我做一份PPT出来,并且只给出了这一句任务前提,之后全程就没有再介入。
豆包工作先自行查阅了网络上的权威数据资料,比如智研咨询、QuestMobile、艾媒咨询、IDC等数据源,整理出了多个可能需要用到的数据,并且在每个数据后面都附带了来源出处,可自行进行数据核对,这一步相当于直接省去了原本在撰写报告中最耗费精力的资料搜集工作。
资料搜集完成后,豆包工作直接根据现有资料库生成了一份12页的PPT,并且整体PPT的结构比较完整,PPT的背景和风格也是自动匹配选用的简约商务风,数据也适当进行了图表转化,在风格上看着还是比较简洁的。


不过整个的执行过程并不是一次性完成的,中间一共返工了三次,有两次是因为自动生成的条形图触发了格式校验误判,还有一次是数据来源页文字溢出了,说明在执行效率上还存在进步空间,不过最终生成的PPT内容从结果来看还算不错。
美中不足的是生成的PPT风格有点过于朴素,没有搭配配图和精致图表,在内容的填充度上不够,整体资料细化程度也不够,如果要直接对外展示的话还需要自行再往里填充更多细节。
所以从这一点看,豆包工作可以帮忙进行从零搭建报告最费时间的资料搜集和框架工作,能作为基础框架工具使用,但还没做到一句话实现完整详细结果交付的地步。
二
视频生成,一句话就做出高清短视频
随后,我们进行了第二项测试,也就是对多模态能力的展示,新识研究所没有给豆包工作提供任何素材,只在对话框中输入了一条简短的指令,"生成一个银河星星变换、长约15秒的视频"。
豆包工作没有直接根据这一句模糊的指令然后就开始干活,而是先大致理解我的意思,然后自己构思输出了一套参数让我确认。

比如模型选用的是默认的seedance_2.0_fast,时长15秒,比例为16:9横屏,画面描述为:深邃夜空中璀璨的银河缓缓流淌,无数星星闪烁变换,星芒与星云交织流动,星光粒子逐渐汇聚成绚烂的银河光带,镜头缓慢推近,氛围梦幻、静谧、浩瀚。
这种先自己构思一套参数和详细视频需求描绘,再让用户进行确认后执行的交互逻辑,不仅能减少用户不满意输出效果的无效返工和token浪费,也把整体的画面风格决定权还给了用户。
此外,豆包工作这套交互逻辑,还大大降低了不懂如何描述自己脑海画面的用户自己生成视频的门槛,并且如果豆包工作自己构思的视频描绘与用户需求不一样,用户不知道要改动哪里、该怎么去改的问题也能顺势解决了。
最重要的是生成结果,从最终交付的视频来看,不仅视频分辨率高清,画面美观,视频镜头等的场景变换也十分连贯,没有出画、出错的情况,也没有穿模等问题,而且还自动配备了比较恢弘大气的背景音乐,让视频的整体视听观感更强。

虽然豆包工作的多模态能力很强,但还是存在一点小短板的,比如单次生成的视频在时长存在上限,默认模型最长只有15秒,更换模型虽然可以延长到30秒,但如果想要更长的视频就需要自己去进行分段拼接了,也就是说,如果只是用豆包工作来生成半成品视频素材是足够的,但没法直接用来生成长视频成片。
三
数据分析能力强,多数据能精准识别错误和异常情况
在完成了多模态技能的测试后,我们又对豆包工作的数据分析和汇总能力进行测试,让豆包工作自己构建一份贴近真实场景的电商数据,并且还要自主完成从数据清洗到异动归因的完整分析并生成报告。
为了考验豆包工作数据清洗的能力,新识研究所特意在数据里埋入了一些脏数据,包括12行的重复数据、15条数量缺失、56条成本缺失以及2处异常值。
豆包工作执行任务中先自动删除了重复行,然后再对缺失值做了合理的回填,并且提前将预埋的两处异常值也全部识别出来了。

在指标计算完成后,豆包工作输出了完整的业务画像,总销售额433.51万元,毛利率52.49%,客单价3462.56元,6月为销售峰值,达到84.51万元,环比增长69.47%。

其中电子产品贡献了51.2%的销售额,但毛利率仅为49.76%;家居用品毛利率最高,达到64.65%,营收占比却只有6.62%。销量主力品类盈利能力偏弱,这个综合的业务结构矛盾,要比简单零散的指标更有参考价值。
不过最厉害的还是豆包工作的异动归因能力,面对6月销量暴涨的情况,豆包工作没有笼统的描述为业绩向好,而是锁定了6月15日至20日这6天,并判断这段时间的快速增长很可能是来自618大促活动。
此外,针对7月的异常订单,豆包工作还单独测算了影响,如果不修正错误,7月环比会被误读为-25.1%,修正后真实跌幅是-36.08%。
在完成这些数据分析和测算后,豆包工作还生成了5张可视化图表,以方便结果展示,从结果来看,豆包工作在进行较为复杂的数据处理任务中的效率和准确程度还是比较优异的。
四
能将一张静态台账升级为多视图协作系统,帮助提升管理效率
最后,我们进行了一项有趣的测试,打算看看豆包工作能不能把一张项目管理台账CSV,给升级成带一个可使用的协作系统。
因为很多项目现在更多还是使用的静态Excel台账,记录的进度慢,责任人也只能靠自己进行手动更新和询问其他人再来同步数据,这样整体的流程和效率其实比较慢,可能会浪费一些无效的沟通成本,因此新识研究所就想测试豆包工作能不能把这种静态的表格,转化成可交互的实用工具。
我们交给了豆包工作一份包含34条项目记录和12个字段的CSV文件,豆包工作通过app_builder来搭建网页应用,全程仅用了4步就完成了。
豆包工作生成的系统包含了三类独立视图,其中仪表盘展示了5项KPI卡片,包括项目总数、进行中、已完成、延期项目数、预算使用率,再搭配上状态分布环形图、部门柱状图和预算对比图,用户打开就能直观的掌握项目整体的健康度。


并且生成的表格视图展示了全量的原始数据,支持搜索、多条件筛选、排序,还可以查看详情,在看板视图中按未开始、进行中、已完成、已延期分成了四列,每张卡片都标注了负责人、优先级、进度条和截止日期,这三套视图共用的是同一个数据源,不过分别能解决不同的管理需求。
当然,它距离成熟的企业级系统仍有差距:看板不支持拖拽修改状态,没有持久化存储,不支持在线编辑,缺少权限管理功能。本质上这是一套可查看、可演示的原型,还不能直接用作团队日常生产系统。
它最大的价值是速度,一份CSV文件仅用了4步就能产出一个多视图的交互系统,对于需要快速验证业务流程、搭建轻量工具的团队来说,在效率上会有较大提升。
不过豆包工作目前的产出显然还是无法替代专业的项目管理软件,不过还是能把搭建简易系统这件事从等待开发排期,变成了即时可得。
五
结语
这四个测试跑完,对于豆包工作的能力边界有了个简单的认知,并且任务越结构化,给定的规则越明确,豆包工作的完成度也能越高。
除了在PPT生成、视频生成、数据分析和简易系统搭建上,豆包工作还具有端到端执行能力,用户只要给出目标,豆包工作就能自动拆解任务、调用工具、交付成果。
如果要说一点小短板的话,大概也就是不提供足够详细的Prompt,豆包工作自己在细节打磨上还不够,比如上面的PPT版式精修、视频字幕剪辑、系统交互优化,这些都需要人工收尾。
也就是说,如果用户没给出详细的需求,豆包工作也只能按照个大概给出最后的结果,中间需要用户自己去修修改改,没有一次性把需求给完的话可能会浪费一些不必要的token。
不过想要自主理解和完善细节,这是需要Agent能力上限提升的,属于行业技术能力上限的桎梏,倒也不是豆包工作自己的Agent能力缺点,毕竟从结果来看,豆包工作已经能适配大多数的办公场景了。
当然,豆包工作也不会是Agent最后的终点。

