常刷短视频的朋友,一定见过类似爆款画面:一个人刚仰头喝了一口可乐,下一瞬间气泡直接把可乐顶到喉咙口,甚至从鼻子里喷出来,人物被呛得五官起飞。这类内容通常被归入“汽水挑战”“可乐加曼妥思挑战”“可乐进鼻子”等搞笑赛道,笑点主要集中在反差、失控反应和慢放后的表情细节上。
这里首先要说清楚一件事:真人的鼻腔黏膜非常敏感,可乐、曼妥思气泡如果被吸入呼吸道,轻则强烈刺激、呛咳,重则可能造成误吸甚至窒息,这类危险动作不要在现实里模仿。更合适的做法,是拿 AI 视频生成工具把相同的画面做成虚拟特效,通过文生视频、图生视频、首尾帧和后期剪辑来还原“可乐从鼻口喷出”的反差喜剧感。
本文会从这类搞笑视频为什么会火开始,拆解制作一条 AI 搞笑视频需要用到的工具、提示词思路、分镜逻辑和剪辑节奏,并给出可复制模板。不管你是做短视频账号,还是单纯想学习 AI 视频工作流,这条闭环流程都值得完整跟一遍。
1. “可乐喷鼻”类搞笑视频为什么会成为经典
1.1 这类内容的本质是“预期违背”
无论是“喝可乐被呛到喷出来”,还是“可乐加曼妥思后瓶口像火山一样喷发”,人们的笑点内核其实都是预期违背:观众本来以为主角会顺利完成,结果一个正常的小动作突然失控,场面从平静瞬间变成混乱。头部视频之所以好笑,往往不是因为创意本身多新鲜,而是因为演员的失控反应足够真实,慢放后的表情细节足够夸张。
如果用真人拍摄这类内容,演出成本并不低。演员要顶着液体入鼻的不适感反复拍,中间还需要补光、机位、清洁和防滑措施。拍摄宠物版或者小孩版更困难,宠物不可能配合演出,人类幼崽则存在明显的安全与伦理问题。此时,AI 视频生成就体现出独有的价值:它可以让虚拟角色以夸张、卡通化、完全可控的方式呈现“被呛到喷出可乐”的状态,不需要真人承担任何风险。
1.2 AI 生成搞笑视频解决的核心问题
AI 视频生成对搞笑内容创作者而言,解决的问题非常具体:
自带夸张感。很多 AI 模型在生成人物动作时,会对“剧烈反应”做比较夸张的处理,配合慢动作提示词后,画面会天然带有一种“无厘头”气质,非常适合搞笑素材。
角色可控。只要固定同一个人物形象,就可以让这个虚拟角色在不同场景、不同情绪下反复出镜,慢慢沉淀成账号 IP。
成本低、试错快。真人口播挑战需要化妆、场地、道具,AI 素材只需要写提示词、生成、挑选、剪辑,一个零基础创作者也能在几小时内完成一条出片。
它可以替代危险挑战。可乐加曼妥思、鼻腔灌可乐这类动作在现实里风险不小,用 AI 生成后,既保留了视觉冲击力,又不会引导观众模仿危险动作。
1.3 AI 搞笑视频的常见应用场景
这类素材的适用范围很广,不只局限于“挑战视频”本身:
- 账号整活类短视频:把 AI 生成片段作为主体,再铺上解说或背景音效。
- 影视混剪和二次创作:把某部动画或原创角色丢入“可乐喷鼻”这种极限情境,制造反差。
- 剧情号的转场素材:用一段可乐喷出画面承接人物“被生活呛到”的隐喻,情绪从憋屈变成搞笑释放。
- 品牌营销:饮料品牌、零食品牌做新品推广时,把产品放入“失控挑战”场景,增加娱乐感。
- 表情包 / 动态梗图:从 AI 视频里截取关键帧转成 GIF,用于聊天和评论区。
从传播角度来看,这类内容的普遍特征是信息密度高,观众不需要了解背景知识,3 秒内就能 get 到笑点,所以天然容易被算法推荐。
1.4 为什么要单独立项学习这套制作流程
很多人第一次接触 AI 视频时,会误以为“只要把一句话描述甩给工具就会出片”。实际做过后会发现,生成结果往往很随机:人物会多出几根手指,液体方向不符合物理规律,角色上一秒还在喝可乐下一秒突然变成大叔。搞笑视频对“失控感”有要求,但对角色稳定性和动作逻辑同样有要求。
这篇文章不是教你一句提示词碰运气,而是从脚本策划、工具选型、角色锚定、分镜生成到剪辑包装,完整走一条可重复的 AI 搞笑视频制作流程。学会这套流程后,不只可以做“可乐喷鼻”效应,还可以迁移到“饮料喷泉”“生日蛋糕糊脸”“水枪射击”等更多搞笑话题。
2. 环境与工具准备:做一条 AI 搞笑视频需要准备什么
先说明,AI 视频生成工具的界面、功能入口和生成能力更新很快,不同账号开通的模型权限也会不同。本节不会写死某一个版本的按钮路径,而是先建立通用的工具选择思路,再给你一个上手成本最低的软件组合。
2.1 工具分类:文生图、图生视频、在线剪辑
完成一条可乐搞笑视频,通常需要三类工具:
第一类是 AI 绘图工具,作用是确定虚拟角色、场景的首帧画面。你可以先画出一张“手持可乐的男生”图片,后续所有视频片段都以这张图为基准,角色一致性会大幅提升。常见的工具有 Midjourney、Stable Diffusion、通义万相、即梦 AI 绘画等,选择标准很简单:只要能输出高清竖版图片,导出后可以继续用于图生视频即可。
第二类是 AI 视频生成工具,负责把静态图片或提示词变成带动作的多帧视频。目前可选的工具包括可灵 AI、即梦 AI、Runway、Pika、Vidu、Luma 等。使用顺序建议是:先用“图生视频”功能,保证人物形象稳定;没有参考图时,才退一步使用“文生视频”。
第三类是剪辑软件。剪映是当前国内短视频创作者最常用的工具,它自带音效库、贴纸、文字特效和速度调整,非常适合给 AI 素材补上缺掉的声音和节奏。剪映桌面版和手机版都可,建议使用桌面版,因为导入多段素材后时间轴操作更方便。
2.2 运行环境和账号准备
如果你使用的是在线 AI 视频工具,绝大多数情况下不需要高性能显卡。核心条件是:
- 网络环境稳定,可以访问对应在线平台(务必使用官方合规渠道)。
- 有一个可用的手机号或邮箱完成注册。
- 工具账户有足够的生成额度,一般新用户注册后会赠送少量免费时长或积分。
- 视频导出分辨率至少需要 720P,建议 1080P,画面比例先设成 9:16,方便最终发布到短视频平台。
如果准备用 Stable Diffusion 做更多可控角色图,需要一台带 NVIDIA 显卡的电脑,显存 8GB 起步,并安装 Python 环境和 WebUI / ComfyUI。不过对于零基础入门,我更建议先使用在线工具,跑通流程后再考虑本地部署。
2.3 素材资料准备
在开始生成前,先准备一份“素材包”,能明显提高效率:
- 角色参考图至少 1 张,优先正面清晰、表情自然、服装明确的全身或半身图。
- 场景关键词,比如“室内厨房”“明亮客厅”“便利店门口”“游泳池边”。
- 道具说明,比如“330mL 可乐易拉罐”“透明玻璃杯”“薄荷糖”。
- 镜头偏好,比如“中景”“特写”“侧面拍摄”“慢镜头”。
- 画风偏好,比如“真人写实风”“3D 卡通渲染”“动漫日系”“皮克斯风格”。
你不需要把所有素材一次性用完。最早生成的角色参考图,是整个流程最容易翻车、也最值得多花时间的部分,因为后面所有搞笑片段的“好笑程度”都建立在观众相信这个角色真实存在的基础上。
3. 你需要知道的 AI 视频生成底层原理
3.1 文生视频:从提示词到连续画面的“翻译过程”
AI 视频生成工具背后通常是基于扩散模型(Diffusion Model)的一系列算法。简单理解,它可以被看成两段式工作:
第一步,把文本描述嵌入到向量空间,理解你想要的“内容语义”;第二步,以一个随机噪声视频为起点,不断去噪、还原,逐步生成与文本匹配的画面。但和文生图只生成一张静态图不同,文生视频还需要考虑时序一致性,也就是每一帧之间不能剧烈跳变,角色脸部、背景、液体的连续性都要维持。
这也是为什么提示词里必须同时包含“画面内容”和“动作方式”。如果你只写“一个人喝可乐喷出来”,模型只会生成一个独立瞬间;如果加入“从嘴里鼓起气泡—液体喷出—液体落在脸上”的动作线条,生成结果才会出现流畅的爆发过程。
3.2 图生视频:用固定角色解决一致性
纯文生视频最容易出现角色漂移问题。比如第一帧是蓝衣服男生,第二帧衣服变成红衣服,第三帧胡子长了出来。这类问题在长镜头里尤其明显。
解决办法是使用图生视频,也就是上传一张已经确定的角色图片,再写一条动作描述。模型会把这张静态图作为第一帧条件展开动画,等于你帮它锁定了“主角是谁”,它只需要负责“接下来怎么动”。多个 AI 视频工具都支持图生视频,个别工具还提供“尾帧图像”选项。如果你能同时上传首帧和尾帧,就可以让画面从 A 状态自然演变为 B 状态,对于“喝可乐前”到“喷可乐后”的转场非常实用。
3.3 别忽视反向提示词和运动参数
生成参数中,最常被新手忽略的是反向提示词。它的作用是告诉模型“我不想要什么”。在搞笑视频中,反向提示词可以写:
deformed hands, extra fingers, distorted face, bad anatomy, blurry, low quality, static image, no motion, mutated body, too dark, realistic violence翻译过来是:变形的手、多余的手指、扭曲的脸、糟糕的解剖结构、模糊、低质量、静态图片、没有动作、突变身体、太暗、真实暴力。
多数在线工具会在界面上提供“画面比例”“运动幅度”“相似度”等选项。画面比例选 9:16;运动幅度是否拉满要看生成效果,运动幅度太高容易崩,太低又像 PPT。建议先生成一条运动幅度 5 到 7 分的素材,确认角色脸部没有变形后,再决定是否调整。
3.4 为什么一次生成往往不够
几乎所有视频生成工具都有“随机性”。输入相同提示词、相同参考图,每次结果都可能不同。这不是模型的缺陷,反而是创作机会:同一个搞笑情节可以生成多个版本,从中挑选一个动作最自然或者最失控的素材。你可以把一次跑出的视频当作“one take”,下次调整关键词时,只改动一个变量,比如把“猛烈喷出”改成“缓慢涌出”,观察结果差异,慢慢形成对工具的直觉。
4. 完整实战:用 AI 制作一条“可乐喷鼻”搞笑视频
下面以一个 10 秒成片为例,从分镜策划开始,完整走一遍 AI 搞笑视频制作流程。
4.1 项目设定与分镜脚本
项目名称可以叫“AI 搞笑短片:可乐喷鼻挑战(虚拟角色版)”。总时长目标 10 秒以内,竖屏 9:16,用于短视频发布。
先设计分镜脚本,这一步直接决定后续提示词怎么写:
| 镜号 | 时间 | 画面内容 | 台词/音效 |
|---|---|---|---|
| 1 | 0-2s | 男生站在厨房台面前,举起可乐易拉罐,自信地喝了一口 | 气泡“呲——”声 |
| 2 | 2-6s | 男生腮帮鼓起来,下一瞬间可乐液体从口鼻处猛烈喷出,液体飞溅,满脸都是 | “噗——”夸张喷水声 |
| 3 | 6-9s | 特写男生眯眼皱眉,用手背擦脸,露出委屈又搞笑的表情 | 憋笑音效 + 慢放 |
| 4 | 9-10s | 画面出现卡通字幕“请勿模仿”,原速收尾 | 清脆提示音 |
分镜脚本的意义是让 AI 素材有剪辑结构。如果直接把所有剧情交给一条 AI 视频,很容易得到 3 秒钟的无意义动作。现在拆成四个短镜头,单个镜头的生成压力更小,成功率更高。
4.2 第一步:生成角色参考图
选择一个你顺手的 AI 绘图工具。打开文生图功能,输入以下提示词:
一个二十岁出头的年轻男生,穿蓝色短袖T恤和休闲短裤,站在现代厨房操作台旁边,右手拿着一罐刚打开的可乐饮料。人物正面半身构图,表情自信,自然微笑,明亮自然光,4K写实风格,干净背景,适合短视频角色的竖屏画面。如果你想走卡通路线,把画风改成:
皮克斯风3D卡通渲染,一个可爱夸张的年轻男性角色,穿蓝色T恤,站在厨房台面旁,手拿可乐罐,表情自信,明亮色彩,圆润画风,竖屏构图。注意卡通化和写实化的区分。如果后续画面涉及大量液体喷溅、面部扭曲,卡通风格往往更容易通过平台审核,也会降低观众误认为“真实危险行为”的概率。新手建议优先选择卡通 3D 或偏动画渲染风格。
在生成的多张图中挑选一张五官清晰、服装完整、手持动作自然的图片作为“主角锚点图”。建议把它保存为role_blue_tshirt.png,后续所有图生视频都基于这张图生成。
4.3 第二步:生成第 1 镜“喝可乐前奏”
用“图生视频”功能,上传上一张生成好的角色图。注意提示词中的人物描述要尽量保持一致:蓝色T恤、年轻男生、厨房。
第 1 镜提示词:
画面中的蓝衣年轻男生正站在厨房台面前,右手把易拉罐举到嘴边,仰头喝了一口可乐,随即放下易拉罐。动作连贯自然,表情从自然变成有点被气顶住的感觉。镜头稳定,中景,室内明亮光线,高画质。这里要留意一个细节:AI 工具在图生视频时可能忽略你希望“喝但没有立刻喷”的过程,直接生成喷水画面,导致缺少铺垫。你可以在提示词里明确“不要喷出液体,只有吞咽动作”,并在反向提示词中加入no liquid splashing, no spray, no nose spitting。
如果工具无法准确控制到这个程度,也可以直接生成一条“仰头吞咽”素材,后面剪辑时只截取前 1 到 2 秒。
4.4 第三步:生成第 2 镜“可乐从口鼻处喷出”
第 2 镜是整条视频的高潮。这部分提示词必须写得非常具体,否则模型容易把液体理解成鼻涕、呕吐物或异常分泌物,观感会变得奇怪。比较好的策略是使用“气泡+水花”组合,而不是直接描述解剖学意义上的“鼻腔喷射”。
推荐提示词:
上一张图中的蓝衣男生正对镜头,腮帮子明显鼓起,像嘴里含着一大口碳酸饮料。突然之间,大量棕褐色带气泡的可乐液体从他捂住嘴的指缝间和鼻头附近猛烈喷出,水花飞溅到空中和脸上,衣服袖口沾到饮料。整体是夸张的搞笑慢动作效果,液体呈弧线喷射,像漫画里的喷泉。镜头切近景,人物表情痛苦但尽量保持可控,不要产生血腥感,室内厨房背景不变。如果当前模型生成不了“鼻子喷”的动作,可以退一步生成“嘴巴含液体后泡沫从嘴鼻周围溢出”的素材,再用剪辑软件加后期音效和放大特效制造相似观感。真实可乐液体通常是深褐色半透明状态,背景中的液体颜色不要调成鲜红,避免审核歧义。
反向提示词加入:
blood, injury, vomiting, mucus, disturbing body fluids, realistic violence, deformed face, extra fingers翻译为:血、受伤、呕吐、粘液、令人不安的体液、真实暴力、变形的脸、多余的手指。
这段生成可能需要跑 3 到 5 次,选一条液体轨迹最自然、脸部没有明显崩坏的版本。如果一条生成结果不够“猛”,不要用文字反复堆砌“非常非常猛烈”,而是改变运动幅度参数,或者在提示词里加入“慢镜头模式下液体以高速喷出”这种带镜头运动逻辑的描述。
4.5 第四步:生成第 3 镜“委屈擦脸特写”
第 3 镜要的是表情反应,不需要太多液体。继续使用同一张角色图作为参考,提示词改成:
同一个蓝衣男生特写画面,他半闭着眼睛,眉毛皱成一团,表情既委屈又搞笑,脸上挂着几滴透明水珠,右手正用手背擦脸上的水。他微微偏头,表情从错愕转为不好意思地笑。镜头固定在胸口以上,背景是模糊的厨房,画面干净,慢动作,轻松搞笑氛围。这个镜头的核心是“收”。前面 2 到 3 秒喷得越激烈,这里的人物表情越无奈,反差越大。剪辑时可以把第 3 镜速度继续放慢到 0.8 倍速,搭配一个“biu”或者“呜——”的音效,观众会更容易产生共情。
如果想让这条视频更有完整故事感,可以在生成第 3 镜后,把该镜头的最后一帧再导入图生视频工具,生成第 4 镜:
男生无奈地看着镜头,耸了耸肩,把可乐罐放到桌面,画面淡出。这样就能得到一个从“喝可乐”到“喷可乐”再到“放下可乐”的完整情绪闭环。
4.6 第五步:用剪映完成拼接与包装
AI 视频素材生成好后,进入剪辑阶段。以剪映为例,操作步骤通常是:
把三段 AI 视频素材按顺序拖入时间轴。第 1 段约 2 秒,第 2 段约 4 秒,第 3 段约 3 秒。选中第 2 段开头,使用“变焦点”功能,加一些轻微抖动,模拟真实冲击感。
添加音效。在剪映音效库中搜索“气泡”“喷水”“汽水开瓶”“噗嗤”“节奏鼓点”等关键词,把喷发声效放在第 2 镜开始那一帧,把“委屈呜咽”音效放在第 3 镜。
添加文字花字。例如在第 2 镜喷出的瞬间,添加“可乐进鼻子啦!”或“碳酸的愤怒”,以大号黄色字体加粗放置在画面上方。字幕补充一行:
本片由 AI 生成特效,仅供娱乐,危险动作请勿模仿。最后调整滤镜。AI 生成的素材颜色有时发灰,可以在剪映中选择“鲜亮”滤镜,增加饱和度和对比度,让可乐液体变成更有识别度的棕褐色。导出时选择 1080P、30 帧即可。
4.7 预期结果说明
完成后,你会得到一条带有完整叙事链的搞笑短视频:
前 2 秒观众看到角色正常喝可乐,建立预期;中间 4 秒画面突然出现大量可乐液体喷射,制造冲突和视觉冲击;后 3 秒人物委屈擦脸,释放笑点;最后 1 秒字幕收束,避免被误认为真实危险动作。如果每个镜头都能生成理想素材,这条视频的制作周期通常在 1 小时左右。
5. 如何把“可乐加曼妥思挑战”做成 AI 素材
“可乐加曼妥思”是另一个高传播度的搞笑挑战。现实里曼妥思糖进入可乐后会使大量二氧化碳快速析出,形成剧烈喷泉;如果把糖直接含在嘴里再喝可乐,风险极大,所以这里依然使用 AI 虚拟演示。
5.1 场景建模思路
可以复用同一个角色或场景,变成一个完整的“失败实验”剧情,分镜更清晰:
| 镜号 | 内容 |
|---|---|
| 1 | 角色把一颗曼妥思糖扔进可乐瓶,盖上盖子晃了晃 |
| 2 | 瓶口突然喷出大量可乐柱,直冲天花板 |
| 3 | 可乐柱在高处散落后浇到角色头顶/脸上 |
| 4 | 角色呆愣后开始大笑 |
第 2 镜提示词模板:
一个透明的可乐瓶放在木桌边缘,瓶口正在猛烈喷出棕褐色可乐液体,巨大的液体圆柱向上喷射,夹杂大量白色气泡和水花,形成约两米高的可乐喷泉。背景是普通客厅,桌上散落几颗薄荷糖。画面写实,慢动作,广角视角,夸张搞笑但不要出现人员受伤。第 3 镜提示词模板:
上一画面中的可乐喷泉落下,大量液体溅到一个蓝衣男生的头顶和脸上,他闭着眼缩脖子,头发和衣服湿透,表情非常无奈,身边水花四溅。以侧面近景拍摄,背景是客厅,夸张卡通感,慢动作。这类素材生成完后,剪辑节奏和 4.6 小节一致,只是音效从“喷水声”换成更长的“可乐喷出”和“哗啦啦淋水声”。
5.2 从一条视频衍生出多个版本
当你已经拥有同一个角色的多张动作素材后,就可以用“改提示词+保留角色参考图”的方式批量产出同系列搞笑视频。例如:
- 角色喝奶茶被珍珠呛到,液体从吸管喷出。
- 角色往嘴里塞一大口蛋糕,突然打喷嚏,奶油喷到屏幕上。
- 角色对电风扇张开嘴,牙被风吹得发颤。
每个版本都在复制同一个工作流:先确定角色锚点图,再生成前奏动作、失控动作、反应动作,最后剪辑加音效。你的账号因此能形成“固定虚拟角色 + 无限搞笑情境”的 IP 生产线。
5.3 给不想露脸创作者的替代方案
如果不想使用写实真人形象,可以改用纯卡通角色、动物角色、毛绒玩具甚至一个可乐瓶拟人形象。AI 图生视频对卡通形态的生成通常比真人写实更容易保持稳定,也不会因为“长得像某个真实的人”而产生肖像权问题。
更极客一点的做法,是用 3D 软件建模一个原创角色,然后在 Blender 中渲染若干关键帧,再通过图生视频转为动态;但这一步对新手门槛较高,纯传播类视频其实用 AI 绘图 + 图生视频已经足够。
6. 常见问题与排查思路
在制作过程中,最耗时间的往往不是生成,而是找 bug。下面整理了一份高频问题排查表,遇到问题可以按表快速定位。
| 问题现象 | 常见原因 | 解决思路 |
|---|---|---|
| 多个镜头里角色长得不一样 | 每个镜头都是用不同的文生图提示词生成的 | 先文生图定角色,再全部使用图生视频;优先重用同一个角色锚点图 |
| 生成出的角色手指、牙齿崩坏 | 模型对复杂身体部位的约束能力有限 | 增加反向提示词;缩小画面构图,少让手部做复杂动作;多生成几次选最优 |
| 液体喷出的方向不符合物理 | 提示词没有写明运动轨迹或镜头方向 | 补充“从脸庞前方向右上方向喷出”“呈弧线”“垂直向上喷”等方向词 |
| 视频太短或动作太快 | 单次生成时长有限,运动幅度参数过高 | 分段生成;在剪辑中慢放,或降低运动幅度参数 |
| 图生视频后角色变成其他人 | 参考图与提示词冲突,或相似度参数不够 | 提示词里不要重复描述完全不同的服装;调高“相似度”选项;保持背景一致 |
| 生成画面被平台审核拦截 | 被理解为真实危险挑战或异常体液画面 | 改成卡通风格;把“从鼻子里喷出”改为“液体从口鼻周围呈气泡状溢出”;画面颜色避免红色系 |
| 可乐液体颜色显得像血 | 棕褐色可乐在红色/暖色光下易偏红 | 后期用 HSL 调色把液体色相偏移到橙褐色;提示词增加“透明棕色液体” |
| AI 视频没有声音 | 大多数 AI 视频工具默认不生成音频 | 在剪映中补音效,不需要额外录制 |
| 同一提示词生成结果差异巨大 | 扩散模型存在随机性 | 多跑几次,保留效果最好的一条;不要频繁修改所有参数,每次只改一个变量 |
如果生成结果“不够搞笑”,不要盲目加大液量或夸张程度。更有用的办法是检查前后两段的节奏差:前奏越正常,高潮越离谱,笑点越强;前奏已经极度夸张,后面再喷反而没有惊喜。喜剧效果来自对比,这个原则同样适用于 AI 素材摆放。
7. 发布与内容合规建议
7.1 必须给 AI 内容做显著标识
目前主流短视频平台普遍要求 AI 生成内容进行标识,创作者在发布界面也能找到“AI 生成”或“虚拟内容”选项。发布这条“可乐喷鼻挑战”视频时,应该在标题、画面或简介中标注清楚:素材由 AI 生成,角色为虚拟形象。
这一步不只是为了合规。因为普通人看到这条视频的第一反应有可能是“他是不是真的把可乐吸进鼻子里了”,有人可能会模仿,也有人会直接举报。画面里加上“AI特效,请勿模仿”后,观看风险会大幅降低,平台推荐也更不易误判。
7.2 不要用“虚假真实感”吸引流量
有一种错误做法是故意不标注 AI,让观众误以为这真的是真人整蛊,从而赚取好奇点击。这种账号可能在短期内获得推荐,但风险很大:一旦被观众识破,会迅速掉粉;如果画面中被误认为是未成年人遭受伤害,还可能引发更严重的舆论问题。
从长期运营角度看,AI 搞笑视频最稳的定位是“展示虚拟角色的失控瞬间”,而不是“伪造真实危险挑战”。角色越像虚拟 IP,观众越能在安全前提下放松地笑。
7.3 素材来源和肖像边界
如果角色参考图使用 AI 生成的随机人物,通常不构成对具体真人的肖像权侵犯,但生成结果仍有可能与某人高度相似。发布前最好检查是否有明显指向某位公众人物。如果是用自己的照片做图生视频,属于自娱自乐范畴,但也不要刻意用提示词把面部改得酷似明星。
另外,不要直接拿真人实拍视频做“AI 换脸”或“去水印”处理后再二创。这类操作涉及肖像权、版权和平台规则,风险远高于收益。本教程的所有素材都应该来自你本人创建或拥有合法使用权的图片与音频。
8. 从模板化走向系统化:最后几点建议
到这里,你已经掌握了一条“AI 视频搞笑素材”从 0 到出片的完整工作流:理解搞笑内容结构、准备角色锚点图、写分镜提示词、生成素材、剪辑加音效、发布前标识 AI。
如果你想继续深入,下一步可以研究三个方向。一是提高角色一致性,学习如何用固定种子、控制网络或首尾帧功能做出同一个角色的长剧情视频;二是提高镜头叙事性,研究“推拉摇移”等镜头语言在 AI 视频提示词中的表达方式;三是提高二次创作效率,把跑通的提示词模板整理成自己的素材库,以后换汤不换药地复制到不同搞笑主题上。
生成画面崩坏时,不用急着怀疑自己写提示词的能力。AI 视频本身就是概率生成,多试几次、每次只改一个变量,是比盲目重写更高效的方法。如果你准备做短视频账号,可以先从一条最简单的“可乐喷出”开始,完整发布后再在评论区看观众反应,用反馈指导下一个选题。