制作一个相机的拆解图,你会怎么做?下面这个是最新版豆包的答案。

除了相机,它还可以拆汽车、拆电脑。

这个用的是豆包上线的新功能:新办公任务,操作见视频。

下面是我用的提示词,直接拿去用:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
/doubao-visualization 以上传的图片作为产品的精准参照,完整保留产品原有的外形、比例、透视角度、材质、纹理、配色方案、标志、标识以及所有可见文字细节,不得做任何改动。

制作高品质的产品爆炸分解示意图:按照符合实际装配逻辑的方式,将产品拆分为外壳、前盖、后盖、主体结构、内部模块、连接件、螺丝、功能部件以及附属零件。

将所有拆分后的零件沿产品的主要结构轴线,以前后顺序整齐排布成爆炸展开形式。各零件之间保持适度均匀的间距,层级清晰、对位准确、朝向统一,让观看者能够清晰理解产品的组装方式。

所有零件均需呈现真实且精细的效果,包括体积感、边缘、接缝、材质质感、表面纹理、高光、阴影以及结构连接关系。整体分解图需做到精准、符合实际,适合工业设计展示使用。

整个画面置于纯净的浅灰色专业背景中,采用柔和的专业布光,搭配自然的投影效果,焦点清晰,达到高清商业级渲染水准。

最终效果需呈现为高端产品拆解示意图的风格:简洁规范、符合技术表达要求、布局规整、视觉效果专业且易于理解。

禁止要求:

不得改动产品的外观设计、比例、色彩、标志、文字及材质;不得随意添加与产品不符的零件;不得使布局杂乱无序;不得出现零件变形、细节模糊等问题;不得添加多余的标注、指示箭头、界面元素、水印、无关文字或背景装饰。

更让我在意的是,这张图不是单纯的生图能力展示。

它背后真正值得看的,是豆包终于开始往桌面 Agent 方向走了。

过去一年,大家都在聊桌面 Agent:Claude Code 能在终端里帮你改代码,Codex 能接管一部分开发流程,很多国内工具也开始往"让 AI 直接干活"这个方向卷。

但豆包一直显得比较克制。

它明明是很多普通人接触 AI 的第一站,用户量也足够大,可很长一段时间里,豆包桌面端给人的感觉还是:

  • 能聊天
  • 能上传文件
  • 能总结内容
  • 能生成图片

这些当然有用,但离真正的"桌面 Agent"还差一步。

这一步,就是让 AI 不只回答你,而是开始替你完成任务。

所以这次豆包上线"新办公任务",我觉得是一个很重要的信号。

它不是单独上了一个小功能,而是把几件事放到了一起:

  • 发布 豆包专业版(包含 ¥68 / ¥200 / ¥500 等不同套餐)
  • 接入 豆包 2.1 系列大模型
  • 推出 办公任务 Agent 模式

前两个是基础,第三个才是关键。

因为办公任务 Agent 解决的不是"AI 会不会说",而是"AI 能不能干"。

比如它可以:

  • 操作本地文件和电脑里的工具
  • 打开浏览器、搜索资料、整理信息
  • 调用 Skills 技能完成特定任务
  • 做定时任务,不用你每次重新提醒
  • 结合文档、表格、PPT 这类办公场景直接产出结果

这就和以前的聊天机器人不一样了。

以前你问豆包:"帮我想一个方案。"

现在你可以更进一步:"按照这个方案,帮我把素材整理好,生成文档,再做成可以交付的结果。"

这个变化不一定一上来就惊天动地,但方向非常明确:豆包正在从聊天窗口,变成办公桌面里的执行助手。

很多用户找不到"办公任务模式",因为它不在首页对话栏里。

入口大概是这样的:

再回到开头那张产品拆解图。

它真正有意思的地方,不是"豆包能不能画一张漂亮图"。

而是它完整跑通了一个小型工作流:上传图片 → 理解产品结构 → 按要求拆解 → 控制风格 → 输出结果。

这就是桌面 Agent 最核心的能力雏形:理解你的目标,然后把目标拆成步骤,最后给你一个可交付的结果。

所以我会把这张图看成豆包桌面 Agent 的第一张名片。

它说明豆包终于不只是"中国版 ChatGPT"了。

它开始往更实际的方向走:成为普通人电脑里的"数字员工"。

相关阅读