“解说”在即梦上其实有两种做法,取决于你想要的是“旁白解说”还是“角色开口解说”。前者只需要配个音、加个字幕,后者则需要用到即梦的对口型或数字人功能。下面把两条路都讲清楚,你可以根据自己的内容类型选一条走。
不是所有“解说”都需要让画面里的人张嘴。如果你做的是影视解说、知识科普、风景纪录片这类内容,画面里的人物不需要说话,只需要一个画外音在讲述,这就是旁白解说。
如果你做的是数字人口播、课本人物讲解、虚拟主播这类内容,画面里的角色需要“真的开口说话”,嘴型和声音要对上,这就是角色解说。
旁白解说更简单,剪映就能完成。角色解说需要用到即梦的对口型或数字人功能。下面分别讲。
旁白解说的核心是“先有画面,再有声音”,声音不依赖画面里的人脸,所以不需要对口型。即梦负责生成画面素材,剪映负责配音和字幕。
根据你的解说主题,在即梦的图片生成或视频生成里制作对应的素材。比如做科普解说,就生成与知识点匹配的动画或实拍风格画面;做影视解说,就生成符合剧情氛围的场景图或视频片段。
生成时统一设置好比例(竖屏9:16或横屏16:9),把素材按顺序导入剪映。
如果你自己录音,打开剪映的“音频”面板,点击“录音”,按住麦克风图标开始朗读解说词。录音完成后可以裁剪、分割、调整位置。
如果你不想自己录,可以用剪映的“文本朗读”功能。在时间线上添加文本字幕,选中字幕后点击“朗读”,从音色库中选择合适的声音(比如“沉稳男声”适合纪录片,“亲切女声”适合生活类内容),系统会自动生成配音并添加到轨道上。
配音完成后,用剪映的“识别字幕”功能自动生成字幕。选择“文字”面板,点击“识别字幕”,系统会自动把音频转成文本字幕。识别完成后调整字体、颜色和位置,一般放在画面下方居中。
如果你需要画面中的角色真正“开口说话”,就要用即梦的对口型功能。核心逻辑是:先有一张人物正脸图或一段无声视频,再给它配上台词或音频,让嘴型动起来。
对口型功能对素材有硬性要求。上传的图片必须是写实或偏写实风格的单人正脸图,面部无遮挡、光线均匀。侧脸、多人同框、卡通风格过强的图都可能识别失败。
如果你没有现成的人脸,可以在即梦的图片生成里先做一张。提示词写“写实风格,正面半身像,光线均匀,背景简洁”,生成后挑选满意的一张。
在即梦的“视频生成”页面,找到“对口型”按钮。上传你准备好的人脸图片,然后在文本框里输入你要角色说的台词,或者直接上传一段录音文件。
选择音色。即梦提供了多种音色可选,比如“知性女声”“沉稳男声”。如果你之前创建过自定义音色,也可以在这里选用。
即梦的对口型有“标准模式”和“生动模式”两种。标准模式只驱动嘴部,适合严肃的讲解内容。生动模式会额外加入眨眼、轻微点头等微表情,适合更自然的对话场景。
点击生成后等待视频完成。生成的口型视频时长和你的音频或文本长度基本对齐,注意视频生成时长和配音试听时长尽量保持一致。
如果你生成的是多个镜头的解说(比如分段讲解),需要把几段对口型视频都导出,在剪映里按顺序拼接。然后同样用“识别字幕”功能给解说加上字幕,调整音量和背景音乐。
“用人脸”这件事,在即梦和豆包里其实是两套不同的玩法。即梦强在把一张人脸“固定”成可复用的角色,适合做系列短片;豆包(See...
2026-09-26“主题”在即梦里有两种常见用法:一种是梦境主题定制,用来生成有特定情绪氛围的画面;另一种是Agent 模式里的故事风格选择,...
2026-09-26在即梦里“定义风格”其实有几种不同的做法,取决于你手头有什么素材、想要多高的控制精度。最简单的用内置预设,最灵活的用参...
2026-09-26“主体角色”功能的核心价值是让同一个角色在不同画面里保持长相稳定。但即梦的“主体角色”其实分两条路:一条是创建数字分身(...
2026-09-27“主体角色”功能的核心价值是让同一个角色在不同画面里保持长相稳定。但即梦的“主体角色”其实分两条路:一条是创建数字分身(...
2026-09-27