小众消息

当 AI 不再只给答案: 豆包工作把办公能力推进到了执行层

办公一直是 AI 工具最热衷演示的场景:写文案、总结会议、生成 PPT、分析 Excel。问题是,早期产品大多只负责产出内容;整理成文档、写回表格和归档文件,仍然要由用户完成。

豆包的「工作任务」开始接手这些后续步骤。用户给出工作目标后,模型可以拆分任务、调用工具并持续执行,最后交付文档、表格、演示文稿等可以继续使用的文件。

聊天机器人主要看回答得好不好;Agent 还要看任务能不能做完,以及做到一半卡住了怎么办。

先把名字搞清楚:「豆包工作」是个独立的产品

豆包目前有几组容易混淆的名称,有点绕。

豆包开始收费时曾推出「办公任务」,主要变化是增加免费版各项能力的使用额度。「豆包办公」只是外界对「豆包办公任务」的非正式简称。此后,「办公任务」更名为「工作任务」。

豆包工作则是承载这套能力的独立产品,提供可以单独下载的软件客户端。用户也可以在豆包主客户端中使用「工作任务」,或者通过飞书调用。

简单来说,这里涉及三个不同层次:

  • 专业版是收费与额度安排;
  • 工作任务是一种任务执行模式;
  • 豆包工作是独立产品。

三种入口调用的是同一套工作任务能力,主要区别在入口和使用环境。

工作任务开始接手文件和工具操作

字节跳动 Seed 团队在 2026 年 6 月发布 Seed 2.1,强化了模型调用文件、浏览器和外部工具完成长任务的能力。

在工作任务中,模型可以接触本地电脑、浏览器、文档、表格和 Skills,并根据目标选择相应工具。

例如,处理销售数据时,不只是给出几条分析建议,还可以读取原始表格、清洗字段、计算指标、生成图表,再把结果整理成新的文件。制作教学材料时,可以同时处理课程要求、教案、参考资料和演示文稿,而不是停在一份 PPT 大纲上。

资料可能来自网页和 PDF,数据分散在多个 Excel 文件中,结论需要写进 Word,最后再制作成 PPT 或网页。传统聊天式 AI 通常只负责其中一个片段,用户不得不反复复制内容、转换格式并重新补充上下文,既繁琐,也容易遗漏信息。

工作任务在把这些步骤串成一条连续流程。用户仍然需要定义目标、提供材料、确认关键条件并验收结果。是否真正提高效率,也不能只看生成的 PPT 漂不漂亮,还要看材料是否读全、计算是否正确、文件能否继续编辑。

Skills 就是 Agent 手里的工具

豆包工作把文档、表格、PPT、数据分析、可视化、应用生成和录音转写等能力组织为 Skills。

传统软件把功能放在菜单和按钮里,用户需要分别学习不同应用的操作方法。Skills 则把这些能力封装成可以由模型调用的功能模块。用户描述需要的目标任务,模型再判断应当使用哪些 Skills,并把自然语言要求转化为具体操作。

过去要做一份经营分析报告,通常得先在 Excel 中整理数据,再用图表工具实现可视化,最后把结论复制到 Word 或 PPT。现在,模型可以依次自动调用相关能力,把这些步骤组合成一条工作流程。

不必先考虑应该打开哪个软件,只要说清楚要完成什么任务。至于文档、表格和图表工具怎样配合,可以交给模型安排。
这类任务最怕的不是模型回答得慢,而是做到一半突然卡住。文件打不开、登录失效都可能让前面的工作白费,所以执行过程能不能查看,出问题后能不能接着做,会直接影响是否实用。

从生成文件到操作电脑,也要保留接管权

工作任务现在已经把执行范围延伸到本地电脑和浏览器了。

按照现有产品能力,用户可以让模型整理文件、处理本地文档,或者在浏览器中点击和输入。设备授权后,还可以从手机端连接电脑,继续桌面端尚未完成的任务。

比如,我现在已经开始在豆包工作中使用这样的提示词:

请对我的 macOS 系统做一次全面的进程安全审计。检查是否存在危险、可疑或未授权的进程。

Agent 开始操作浏览器和本地电脑以后,权限就不能含糊。哪些内容可以读取,哪些文件可以修改,涉及删除、支付和发布时是否必须确认,都应该让用户看得见。

翻看了下豆包的说明,任务模式可能通过浏览器访问网站、理解页面内容并执行点击和输入。遇到登录或安全验证时,部分步骤仍然需要用户接管。对于已经登录的网站,系统在一定条件下也可能调用仍然有效的本地登录状态继续执行。用户可以终止任务,并管理相关 Cookie 设置。

让 AI 写错一段文案,代价通常有限;让其整理本地文件、操作账号、发布内容或调整系统设置,错误可能造成文件丢失、信息泄露、误发布甚至账号风险。

有没有用,拿一项真的工作试试

豆包工作覆盖的场景很多,包括文档、表格、PPT、会议纪要、教学备课、电商运营、学术研究、金融分析、网页制作和电脑维护。

场景列表再长,也不能证明产品适合每个人。最直接的检验方法,是拿一项真实工作进行验证。

我更愿意拿一项每周都要重复的工作试它,比如整理会议资料、汇总销售表格,或者把几份文件合成一份报告。
Image

豆包工作生成的报告示例,部分

我首先看材料有没有读全,计算能不能复核。最后拿到的还应该是一份可以继续修改的文件。如果一个任务原来需要在四五个软件之间反复切换,现在能够在一条流程里完成,节省下来的时间就是真正的收益。

Agent 可以负责收集资料、转换格式和完成初步分析,我倒是觉得多数时候都比人工(我自己)做得好多了。Image

对于复杂任务,如果觉得处理效率不够,那么刚发布的「多 Agents 并行」就可以派上用场:

使用「多 Agents 并行」能力,分析附件《2025 年我国卫生健康事业发展统计公报》。
安排 4 个子 Agent 同时工作:
1. 数据 Agent提取 2024—2025 年核心指标。包括医疗机构、床位、卫生人员、卫生费用、诊疗量、入院量和患者费用,并计算同比变化。
2. 医疗服务 Agent分析卫生资源、医疗服务量、基层医疗、公立与民营医院、中医药服务及患者费用的主要变化。
3. 公共卫生 Agent分析疾病控制、妇幼健康、老龄化、食品安全、人口与托育等内容,提炼值得关注的指标。
4. 复核 Agent检查数据、单位、同比和统计口径,区分百分比与百分点,核对正文与表格是否一致,指出不能从公报直接得出的结论。
所有 Agent 完成后,由主 Agent 汇总,生成一份简洁的分析报告,包含:- 300 字以内的摘要;- 8—10 项关键发现;- 一张 2024—2025 年核心指标对比表;- 4—6 张清晰的数据图表;- 三项值得关注的结构性变化;- 数据口径、限制及需要谨慎解释的地方。
要求:- 每项重要数据注明页码或表号;- 不得虚构数据或擅自推断因果关系;- 严格区分人数、人次、机构数、床位数、百分比和百分点;- 2025 年卫生总费用须注明为初步推算数;- 最终生成一份可编辑的 Word 报告,并将数据图表插入报告。
Image

别着急讨论谁替代谁,先让它干点活儿

过去使用办公 AI,更像随时找个人帮忙写几段文字。到了豆包工作,开始能打开文件、调用工具,把后面的步骤一起做完。

对每天在网页、Excel、Word 和 PPT 之间搬运资料的人来说,能够少做几轮复制、粘贴和格式转换,就已经是很具体的价值。

对正在寻找 AI 落地场景的创业者和公司管理者,与其继续开会讨论 AI 能替代哪些岗位,不如先选一条真实、可控的工作流程,付费让团队用上一段时间。

拿点原本要自己加班干的活儿,交给豆包工作试试。好不好用,跑几次就知道了。

提醒:现在下载豆包工作,然后用豆包或飞书登录,有免费一个月会员的羊毛可以薅。