制作一个相机的拆解图,你会怎么做?下面这个是最新版豆包的答案。

除了相机,它还可以拆汽车、拆电脑。


这个用的是豆包上线的新功能:新办公任务,操作见视频。
下面是我用的提示词,直接拿去用:
1 | /doubao-visualization 以上传的图片作为产品的精准参照,完整保留产品原有的外形、比例、透视角度、材质、纹理、配色方案、标志、标识以及所有可见文字细节,不得做任何改动。 |
更让我在意的是,这张图不是单纯的生图能力展示。
它背后真正值得看的,是豆包终于开始往桌面 Agent 方向走了。

过去一年,大家都在聊桌面 Agent:Claude Code 能在终端里帮你改代码,Codex 能接管一部分开发流程,很多国内工具也开始往"让 AI 直接干活"这个方向卷。
但豆包一直显得比较克制。
它明明是很多普通人接触 AI 的第一站,用户量也足够大,可很长一段时间里,豆包桌面端给人的感觉还是:
- 能聊天
- 能上传文件
- 能总结内容
- 能生成图片
这些当然有用,但离真正的"桌面 Agent"还差一步。
这一步,就是让 AI 不只回答你,而是开始替你完成任务。
所以这次豆包上线"新办公任务",我觉得是一个很重要的信号。
它不是单独上了一个小功能,而是把几件事放到了一起:
- 发布 豆包专业版(包含 ¥68 / ¥200 / ¥500 等不同套餐)
- 接入 豆包 2.1 系列大模型
- 推出 办公任务 Agent 模式
前两个是基础,第三个才是关键。

因为办公任务 Agent 解决的不是"AI 会不会说",而是"AI 能不能干"。
比如它可以:
- 操作本地文件和电脑里的工具
- 打开浏览器、搜索资料、整理信息
- 调用 Skills 技能完成特定任务
- 做定时任务,不用你每次重新提醒
- 结合文档、表格、PPT 这类办公场景直接产出结果
这就和以前的聊天机器人不一样了。
以前你问豆包:"帮我想一个方案。"
现在你可以更进一步:"按照这个方案,帮我把素材整理好,生成文档,再做成可以交付的结果。"
这个变化不一定一上来就惊天动地,但方向非常明确:豆包正在从聊天窗口,变成办公桌面里的执行助手。
很多用户找不到"办公任务模式",因为它不在首页对话栏里。
入口大概是这样的:

再回到开头那张产品拆解图。
它真正有意思的地方,不是"豆包能不能画一张漂亮图"。
而是它完整跑通了一个小型工作流:上传图片 → 理解产品结构 → 按要求拆解 → 控制风格 → 输出结果。
这就是桌面 Agent 最核心的能力雏形:理解你的目标,然后把目标拆成步骤,最后给你一个可交付的结果。
所以我会把这张图看成豆包桌面 Agent 的第一张名片。
它说明豆包终于不只是"中国版 ChatGPT"了。
它开始往更实际的方向走:成为普通人电脑里的"数字员工"。

