如何生成 AI 图片、视频、音频?
NadouPro 的图片、视频、音频三大功能构成影视创作的核心生产力。从角色设定图、分镜画面,到动态视频片段,再到配乐和角色配音,三大功能覆盖了影视制作中视觉与听觉素材的完整生成链路。
以下功能均可在自由画布或影视创作工作台中通过添加对应节点使用,以下为各功能详细说明。
1 有哪些图片生成功能
NadouPro 提供多种图片生成与编辑功能,覆盖从文生图到精细修图的全链路。在自由画布或影视创作工作台中添加图片节点后,可在功能面板选择对应模式,支持文生图、融图、打光、多视角等基础生成,以及摄影参数、人像质感增强、面部精修、720°全景图、多宫格等高阶编辑。
支持模型:Seedream 5.0 Pro(影视级画面)、GPT Image 2(超写实照片,精准文字与排版)、Nano Banana 2(极速出图,文本渲染好,一致性更强)、Nano Banana Pro(多图融合,指令精准)、可灵 O1(基础到高阶全链路编辑)、Midjourney 8(高级审美,原生高清)
具体模型详见第十二章-NadouPro 模型怎么选?——图片/视频/音频模型速查【图片模型】
1.1 基础功能
1.1.1 文生图
输入文字描述生成图片,是最基础的图片创作方式。适合生成分镜画面、角色概念图、场景设计图、海报等视觉素材。在图片节点中选择"文生图",输入提示词并选择模型即可生成。

1.1.2 融图模式
参考多张图片,融合生成最终图像。适合需要结合多个角色、场景或风格元素进行创作的场景,比如将不同角色的特征融合为一张新图。在图片节点中选择"融图模式",上传参考图并输入描述即可。

1.1.3 打光
针对已有图片二次打光,通过调整光源位置、亮度、颜色等参数改变画面氛围。适合在已有图片基础上调整情绪基调,比如将白天场景改为夜景,或增强戏剧性光影。在图片节点中选择"打光"模式,可设置具体参数。


1.1.4 多视角
改变图片的摄影机角度,生成多方位视角。适合需要展示同一场景或角色不同角度的场景,比如角色侧面、背面或俯仰视角。在图片节点中选择"多视角"模式,可设置具体参数。


1.2 高阶功能
1.2.1 图片编辑
包含消除、抠图、重绘、裁剪、标注、宫格切分

1.2.2 色卡
在图片节点点击【色卡】,可保存图片色卡。


1.2.3 720°全景图生成
一键生成全景图,用于场景多角度一致性控制。生成后可在 3D 导演台中使用,实现沉浸式空间探索和多机位调度。在图片节点中选择【全景生成】模式,输入场景描述即可。
- 入口及使用步骤:打开【画布】-点击任一图片节点-【全景生成】或打开【工作台】-【主体】-【全景生成】即可轻松定制场景。

1.2.4 多宫格图片生成
多宫格图片生成功能可以一次性生成多个视角或状态的图片,确保角色/场景的一致性:
| 宫格类型 | 用途 | 说明 |
|---|---|---|
| 角色三视图 | 角色正面/侧面/背面设定 | 确保角色在不同镜头中一致 |
| 表情九宫格 | 9 种表情状态 | 丰富角色表演 |
| 场景九宫格 | 同一场景的 9 个角度 | 构建完整空间 |
| 多机位九宫格 | 同一场景不同机位 | 影视镜头设计 |
| 分镜 15 宫格 | 15 格分镜画面 | 快速预览叙事节奏 |
| 创意 25 宫格 | 25 格创意组合 | 大规模创意探索 |
适合快速生成角色设定集、分镜草案或创意素材库。
1.2.5 摄影参数设置
摄影参数用于在生图时直接控制镜头视角、景深关系、色彩基础和镜头光学质感。焦距和景深决定镜头语言,色彩科学决定画面底色,镜头组用于选择不同电影镜头系列的成像气质。提供 300+ 预设组合,包括焦距、景深、胶片风格等专业摄影参数。适合追求影视级画面质感的创作者,通过调整参数模拟不同镜头和胶片效果。
入口:文生图、融图模式下,选择Nano Banana 2/Nano Banana Pro/GPT Image 2模型,即可使用摄影参数功能。

具体焦距、景深、色彩空间、镜头组信息请查看摄影参数使用指南:
1.2.6 人像质感增强
对图片中的人物进行质感优化,包括皮肤纹理细化、面部瑕疵修复、画面锐度提升。仅图片(AI生成/自定义)节点适用。适合提升写实人像的真实感和精致度。

可调参数
皮肤纹理细化:增强皮肤微观纹理,使肌肤质感更真实自然
面部瑕疵修复:自动识别并修复面部瑕疵,如斑点、痘印等
画面锐度提升:提升整体画面清晰度和边缘锐度
油光抑制:减少全图高光油亮感
背景融合:使人物与背景自然融合

1.2.7 面部精修
通过指令编辑和参数微调对角色面部进行精细调整。仅图片(AI生成/自定义)节点适用。适合对角色面部特征、表情、妆容等进行精确控制的场景。


【参数微调】功能可调整面部、眉毛、眼睛等面部细节。

2 有哪些视频生成功能
NadouPro 提供多种视频生成与编辑功能,覆盖从文生视频到专业戏份生成的全链路。在自由画布或影视创作工作台中添加视频节点后,可在功能面板选择对应模式,支持文生视频、首尾帧、多参考、动作控制等生成模式,以及智能擦除、超清插帧等编辑能力,所有视频模型均支持音画同步。。所有视频模型均支持音画同步。
支持模型:Seedance 2.5(量质双优,影像更精致)、Seedance 2.0(4K,高品质多镜)、Happy Horse 1.1(更强动态表现力)、可灵 3.0 Omni 4K(多模态输入)、MiniMax H3 2K(多镜同出,性价比高)、Seedance 2.0 mini(极速出片)、Veo 3.1 Preview(4K 超高清)、Gemini Omini Flash(多模态全能)
具体模型详见第十二章-NadouPro 模型怎么选?——图片/视频/音频模型速查【视频模型】
2.1 基础功能
2.1.1 文生视频
输入文字描述直接生成 1-15 秒的视频片段。是最基础的视频创作方式,适合快速生成动态画面、验证创意方向。在视频节点中选择"文生视频",输入提示词并选择模型即可。

2.1.2 首尾帧
通过首帧、尾帧图控制视频片段的生成。上传两张图片作为视频的起始和结束画面,AI 自动生成两帧之间的过渡动画。适合控制视频起止画面、实现镜头衔接。在视频节点 中选择"首尾帧"模式,上传首帧和尾帧图。

2.1.3 多参考
通过多张主体或其他参考图,融合生成视频片段。适合需要保持多个角色或场景一致性的视频创作。在视频节点中选择"多参考"模式,上传参考图并输入描述。

2.1.4 视频编辑
对已有视频进行元素编辑,包括修改画面氛围、延长视频时长等。适合在已生成视频基础上进行局部调整和优化。在视频节点中选择"视频编辑"模式,上传目标视频并输入编辑指令。

2.1.5 动作控制
迁移视频中人物的面部表情和肢体动作到生成视频中。上传参考视频或人物图片,AI 将提取动作并应用到目标角色。适合让角色执行特定动作(如行走、挥手、舞蹈等)的场景。

2.2 高阶功能
2.2.1 智能擦除
智能擦除可去除视频中不需要的元素或对象,适合清理画面中的穿帮物品、水印或多余人物。在视频节点中选择"智能擦除"功能,框选需要擦除的区域即可。



2.2.2 裁剪
对视频长度进行裁剪。


2.2.3 超清
对视频进行超分辨率处理,提升画面清晰度和细节表现。适合将低分辨率素材提升为高清版本。

2.2.4 超清插帧
自动超分辨率与插帧,提升视频分辨率和清晰度。适合将低分辨率素材提升为高清或超清版本。

3 有哪些音频使用功能
NadouPro提供音频生成功能,覆盖配音生成和音乐创作。在自由画布或影视创作工作台中添加音频节点后,可在功能面板选择对应模式,支持生成歌曲、生成伴奏、台词配音和音色转换四种模式,解决配乐创作与角色配音两大需求。。
支持模型:Mureka V9(精准理解创作意图,高完成度成品)、Mureka V8(强化旋律与人声表现,稳定生成结构完整的高品质歌曲)、Nadou TTS(支持多语种台词配音)、Nadou VC(支持多语种音色转换)
具体模型详见第十二章-NadouPro 模型怎么选?——图片/视频/音频模型速查【音频模型】
3.1 音乐制作
3.1.1 生成歌曲
通过文本描述指定音乐风格、情绪、乐器等参数,以及歌词信息,即可获得一首完整的歌曲。

3.1.2 生成伴奏
通过文本描述指定音乐风格、情绪、乐器等参数,AI 自动生成对应伴奏。

3.2 配音生成
3.2.1 台词配音
输入角色台词文本,AI 自动生成带有情感表达的语音配音。支持选择不同音色和语言风格,适合为角色添加对白。在音频节点中选择"台词配音"模式,输入台词文本并选择音色即可。

3.2.2 音色转换
将已有音频的音色转换为目标音色,保持语音内容和节奏不变。适合将配音替换为不同角色的声音。


3.2.3 文生音色
还可以创造属于自己的音色用于台词配音和音色转换。选择语种,用自然语言描述声音的性别、年纪、语速、语调等情况,即可生成专属音色。



4 常见问题
Q:图片生成和视频生成分别消耗多少积分?
不同模型和任务的积分消耗不同,一般图片生成消耗较低,视频生成消耗较高。具体以平台页面展示为准。
Q:摄影参数功能在哪些模型下可用?
摄影参数功能在文生图、融图模式下,选择Nano Banana 2、Nano Banana Pro 或GPT Image 2 模型时即可使用。
Q:全景图生成后可以在哪里使用?
全景图生成后可在 3D 导演台中使用,实现沉浸式空间探索和多机位调度。
Q:音频功能支持哪些创作模式?
音频功能支持生成歌曲、生成伴奏、台词配音和音色转换四种模式,覆盖从配乐创作到角色配音的常见需求。