news 2026/10/8 6:57:46

WorkBuddy 能生图、能生视频,只是很多人还没点开那个入口

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
WorkBuddy 能生图、能生视频,只是很多人还没点开那个入口

朋友:"WorkBuddy 不就是另一个 DeepSeek 吗?写写文案、改改文档还行。"

我:"你上次做电商详情页那八张图,是不是还在 Midjourney 出图、剪映剪视频、稿定做海报,三个工具来回切?"

朋友:"……你怎么知道。"

这句话我一周里听了不下五次:"WorkBuddy 不就是写文案、改文档的嘛,跟 DeepSeek 差不多。"——错得离谱,而且错得挺可惜。很多人把它当 DeepSeek 用,以为只能处理文本类工作,压根不知道它现在的创意设计、图片视频已经强到能当主力的程度。我用同一个需求跑了三遍,成本差值得写下来。

WorkBuddy 的「设计创意」功能已经全面升级!这次补齐了图片与视频生成的短板,能力上足以与豆包正面抗衡。

至此,WorkBuddy 与豆包在工作场景里"双强并立"的格局基本成型。两者之中,豆包略占上风的一点,是它能和飞书深度打通,协同链路更顺畅。

另一条线同样值得关注:DeepSeek 走了开源路线,在企业应用中反而更有优势。不少公司对 AI 到底能落地到什么效果心里没底,开源模型正好让他们可以先"小试牛刀",用较低的成本跑通场景、验证价值,同时也能更好地保障数据安全。

今天带着大家来测一测,感受一下效果。我做的东西很具体:一个国产骑行水杯的电商详情页素材包。一张主图、三张场景图、一张潮流感海报、一条 16:9 的短视频。这是我最常接、也最烦的一类活:要的不只是"好看",而是规格统一、风格统一、交付能用。而过去这些素材散在三个工具、四五个窗口、十几次对话里,最后找回来对一遍风格,半天就没了。

WorkBuddy 这次更新的「设计创意」模式,核心是接进了 Miora——生成图、生成视频、品牌设计,从说需求到确认规格到看结果,全在一个任务里,素材自动汇总到同一张画布。听着像功能罗列,用起来才是关键。下面是我的真实过程。

1第一步不是点按钮,是改掉我的描述习惯

入口很简单,坑却都在"你怎么说"上

打开客户端 → 新建任务 → 切到「设计创意」→ 选「生成图片」「生成视频」或「品牌设计」。路径不复杂,真正要调整的是提示词的写法。我以前的习惯是"帮我生成一张高级点的产品图",这种描述在这里基本等于没说。

我的第一个主图提示词,最终版本长这样:

参考这张产品图片,生成一张用于商品详情页的 2503×1575比例的产品图。保留口红管体细节,产品主打城市精英女性使用场景,可以将产品放置在电商展台上,整体简洁大气、自然光,画面具有张力不添加宣传文字,图片直接交付

关键点:指定了尺寸、用途、场景、约束,末尾加了「直接交付」。

三条经验,条条是钱买来的:

  • 把"用途"写进需求

    。同样是杯子,"用于详情页主图"和"用于小红书封面"会给出两套构图逻辑——前者要产品占满、信息自洽,后者要留白给标题。说清用途,模型才选对构图。

  • 多张参考图必须分工

    。外观、配色、构图各一张时,要分别说明"这张参考外观、这张参考配色、这张参考构图",不然它会自己挑一张全权代表,结果三个方向全跑偏。

  • 成品还是源文件,先说死

    。要直接用的,结尾加「直接交付」;要能改的,写「生成可编辑设计的产物」——后者会调出可编辑画布,图层、版式、文字都能继续调。我第一次没写,拿到一张死图,改个文案只能重跑。

2生成视频,考的是你的"镜头语言"

图可以说"好看",视频必须说"怎么动"

图片还能靠形容词蒙混,视频不行。主体运动、镜头运动、节奏、结束状态,四项缺一不可。这是我最终跑通的一条咖啡杯视频脚本:

波光粼粼的海面上,一名冲浪者正踩着一块复古长板破浪前行,白色冲浪服,板头溅起细碎水花。清晨低角度暖阳从右后方斜射,柔光,远处海平线处的崖壁虚化成暖金色剪影。

镜头从中景沿一条连续弧线向上绕行,边推近边抬高视角,由冲浪者的正面平视平滑过渡到正上方的俯拍,一气呵成不切镜。

冲浪板划开的海面留下一道白色水痕,被晨光映成细碎金鳞;浪涌起伏,水珠在空中短暂悬停。舒缓匀速,一镜到底。最后停在俯拍视角,冲浪者与长板完整居中占满画面,人板倒影在靛蓝海面上清晰对称,一道金光正从浪尖滑向镜头。写实摄影质感,浅景深,暖调低饱和。16:9 横屏

光影还不错,就是人物动作太僵硬,如果能更动态就更好了。加粗那段是灵魂:不说清"怎么运动到结束",出来的就是一堆静态画面堆起来的幻灯片。

3短剧创作

生成前先确认,看着慢,其实最快

每批生成开始前,WorkBuddy 会弹窗让你确认三件事:这次产出什么、数量多少;画幅、尺寸或视频时长;本次用的参考素材(没有就明确写纯文字生成)。确认后才开始跑。

我以前的做法

一口气把 8 条需求丢进去,跑完发现尺寸错了 5 条,只能逐条重跑,算力时间和情绪成本双赔。

VS

现在

花 10 秒看一眼:数量对不对、画幅适不适合发布位置、参考图有没有用对。确认完再生成,几乎没有返工。

workbuddy打通了图片视频流程,生成短剧效率也是很高了,下面我们生成一个完整的剧集,整个流程走一遍:

最近发现了一个很不错的开源项目,叫Drama Skills。

它把 AI 短剧 / 漫剧的制作过程,直接拆成了 11 个 Skill。

从故事开发、分集剧本、人物场景,到分镜、图片提示词、视频提示词,再到生产、剪辑和审查,基本把一条短剧前后的流程都串起来了。

最早是支持 Claude Code、Codex 这样的 Coding Agent,现在凡是支持 Agent Skill 的,它都支持。现在在workbuddy里面用也很方便。

1)技能安装

安装这些技能:https://github.com/zenstory-ai/drama-skills

2)剧本生成

提示词:

创建一个竖屏 AI 短剧项目,

名字叫《我家多了一双红色高跟鞋》。类型是都市悬疑,第一集控制在 50~60 秒。

主要场景是一个平常的打工家庭,夫妻两人上班,婆婆带娃,一个8岁的女儿在上学,核心人物控制在 4个。

故事围绕“现实里存在一个人,但监控里看不到她”展开。

根据这个设定完成故事开发和第一集剧本,先不要生成图片和视频。

3)视觉设定

完成本集的人物、场景和关键道具视觉设定,并保证后续镜头中的人物造型、空间布局和关键位置保持一致。

核心规则:现实中有红衣女人,但监控画面对应座位始终为空。

4)开始「导演」镜头,做分镜

提示词:根据第 1 集剧本和视觉设定完成正式分镜,总时长控制在 50~60 秒。重点设计现实视角和监控视角之间的切换,并写清每一镜的景别、时长、人物位置、起点、终点、动作和运镜。

5)分镜图片视频生成

提示词:根据当前项目的视觉设定和分镜,先生成需要的人物、场景参考图和几个关键镜头画面。先完成家里,女人回家及婆婆,以及几个主要镜头,让我确认效果。

还有 Drama Skills 自带了一个本地短剧创作台,可以通过命令打开:/short-drama dashboard

4其它skill

图片视频功能补齐之后,WorkBuddy 算是彻底打通了任督二脉。再配上 Skill 机制,做短剧、做广告的效率直接翻了几个量级。下面分享几个我高频在用的 Skill,结合这次升级的新能力,有多方便你一看便知——不用再像以前那样东拼西凑,为了一个成片去调各种图片、视频模型的 API,现在全在 WorkBuddy 里一步到位。

1)视频字幕金句生成skill

学员拿它涨了 2000 粉,我让全班拆完,结论和你想的不一样

上个月有个学员跑来跟我报喜:用一个开源 Skill 做名人金句图,小红书涨了 2000 粉,最高一条 1.1 万赞,还有两条 1661 和 968。

我第一反应是:这不新鲜。字幕截图配金句,三年前就有人做。

但她接下来的话让我坐直了——她说,她一天能做 30 条,全部定时排到月底,不占工作时间。

这下我感兴趣了。我让全班把这个 Skill 拆一遍。拆完我发现,绝大多数人把这个工具用反了。视频到位后,skill按固定流程执行:抽帧预览字幕区域 → 选 5 个不同字幕的时间点 → 生成 3:4(1440×1920)主画面 + 字幕条拼图 → 逐张检查后交付总览图和 JPG。

2) 天宫美学skill

最近有一个一个开眼镜店的,自学AI绘画造了座“天庭”,还惊动了外交部为其转发。很多人说这就是自己梦中的仙境。

之前是用MJ一张一张生成的,使用skill可以批量生成提示词与图片

3)巨物skill

4) 电商TVC广告生成skill

它做什么:丢一张产品图进来,直接产出一版可复制的 30 秒 Seedance 2.5 电商 TVC 完整提示词—— 含产品视觉锁定(4–8 个身份锚点防漂移)、6–9 镜头连续时间线(0–30 秒无空档)、声音设计、画面文字规范、全程一致性约束。默认 16:9、无旁白、电影级商业广告质感。也支持基于旧稿迭代优化。

写在最后

文中所有的skill我都打包好了,有需要的朋友直接回复【skill】免费获取!

#WorkBuddy#AIGC生产流#提示词工程#AI生图#AI视频#内容工业化#设计创意

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/8 6:57:22

阿里Java面试参考指南:程序员金九银十突击必备!

谈到Java面试,相信大家第一时间脑子里想到的词肯定是金三银四,金九银十。好像大家的潜意识里做Java开发的都得在这个时候才能出去面试,跳槽成功率才高!但LZ不这么认为,LZ觉得我们做技术的一生中会遇到很多大大小小的面…

作者头像 李华
网站建设 2026/10/8 6:56:50

通信协议中的超帧:从SDH S1字节到LTE H-SFN的周期嵌套设计

做传输和无线接入的工程师,对 frame 这个词再熟悉不过。但第一次在 SDH 分析仪上看到 Hyperframe 这个字段时,不少人会愣一下:帧之上有多帧,多帧之上还有个超帧,这层层套娃到底图什么?后来在 LTE 的 eDRX 参…

作者头像 李华
网站建设 2026/10/8 6:56:38

ponytail技能框架实战:统一脚本、配置与排错经验

经常有朋友问我:插件装了一堆,工作流反而更乱了,怎么办?我最近一年都在用ponytail这个工具,它最初只是团队内部一个不起眼的命令行小插件,但磨合下来,居然把之前各自为政的脚本和配置收敛了一大…

作者头像 李华
网站建设 2026/10/8 6:56:25

OpenRig 多智能体编排实战:tmux 与 MCP 构建持久化协作系统

1. 从"一次性对话"到"常驻协作":OpenRig 要解决的真实痛点如果你最近半年一直在折腾 AI Agent,大概率经历过这样一个阶段:一开始用单文件脚本调 API,感觉挺爽;接着开始加工具调用、加记忆、加多轮…

作者头像 李华