如何生成 AI 圖片、影片、音訊?
NadouPro 的圖片、影片、音訊三大功能構成影視創作的核心生產力。從角色設定圖、分鏡畫面,到動態影片片段,再到配樂和角色配音,三大功能覆蓋了影視製作中視覺與聽覺素材的完整生成鏈路。
以下功能均可在自由畫布或影視創作工作臺中透過新增對應節點使用,以下為各功能詳細說明。
1 有哪些圖片生成功能
NadouPro 提供多種圖片生成與編輯功能,覆蓋從文生圖到精細修圖的全鏈路。在自由畫布或影視創作工作臺中新增圖片節點後,可在功能面板選擇對應模式,支援文生圖、融圖、打光、多視角等基礎生成,以及攝影參數、人像質感增強、面部精修、720°全景圖、多宮格等高階編輯。
支援模型:Seedream 5.0 Pro(影視級畫面)、GPT Image 2(超寫實照片,精準文字與排版)、Nano Banana 2(極速出圖,文本渲染好,一致性更強)、Nano Banana Pro(多圖融合,指令精準)、可靈 O1(基礎到高階全鏈路編輯)、Midjourney 8(高級審美,原生高清)
具體模型詳見NadouPro 模型怎麼選?——圖片/影片/音訊模型速查【圖片模型】
1.1 基礎功能
1.1.1 文生圖
輸入文字描述生成圖片,是最基礎的圖片創作方式。適合生成分鏡畫面、角色概念圖、場景設計圖、海報等視覺素材。在圖片節點中選擇「文生圖」,輸入提示詞並選擇模型即可生成。

1.1.2 融圖模式
參考多張圖片,融合生成最終圖像。適合需要結合多個角色、場景或風格元素進行創作的場景,比如將不同角色的特徵融合為一張新圖。在圖片節點中選擇「融圖模式」,上傳參考圖並輸入描述即可。

1.1.3 打光
針對已有圖片二次打光,透過調整光源位置、亮度、顏色等參數改變畫面氛圍。適合在已有圖片基礎上調整情緒基調,比如將白天場景改為夜景,或增強戲劇性光影。在圖片節點中選擇「打光」模式,可設定具體參數。


1.1.4 多視角
改變圖片的攝影機角度,生成多方位視角。適合需要展示同一場景或角色不同角度的場景,比如角色側面、背面或俯仰視角。在圖片節點中選擇「多視角」模式,可設定具體參數。


1.2 高階功能
1.2.1 圖片編輯
包含消除、摳圖、重繪、裁剪、標註、宮格切分

1.2.2 色卡
在圖片節點點選【色卡】,可儲存圖片色卡。


1.2.3 720°全景圖生成
一鍵生成全景圖,用於場景多角度一致性控制。生成後可在 3D 導演臺中使用,實現沉浸式空間探索和多機位調度。在圖片節點中選擇【全景生成】模式,輸入場景描述即可。
- 入口及使用步驟:打開【畫布】-點選任一圖片節點-【全景生成】或打開【工作臺】-【主體】-【全景生成】即可輕鬆自訂場景。

1.2.4 多宮格圖片生成
多宮格圖片生成功能可以一次性生成多個視角或狀態的圖片,確保角色/場景的一致性:
| 宮格類型 | 用途 | 說明 |
|---|---|---|
| 角色三視圖 | 角色正面/側面/背面設定 | 確保角色在不同鏡頭中一致 |
| 表情九宮格 | 9 種表情狀態 | 豐富角色表演 |
| 場景九宮格 | 同一場景的 9 個角度 | 構建完整空間 |
| 多機位九宮格 | 同一場景不同機位 | 影視鏡頭設計 |
| 分鏡 15 宮格 | 15 格分鏡畫面 | 快速預覽敘事節奏 |
| 創意 25 宮格 | 25 格創意組合 | 大規模創意探索 |
適合快速生成角色設定集、分鏡草案或創意素材庫。
1.2.5 攝影參數設定
攝影參數用於在生圖時直接控制鏡頭視角、景深關係、色彩基礎和鏡頭光學質感。焦距和景深決定鏡頭語言,色彩科學決定畫面底色,鏡頭組用於選擇不同電影鏡頭系列的成像氣質。提供 300+ 預設組合,包括焦距、景深、膠片風格等專業攝影參數。適合追求影視級畫面質感的創作者,透過調整參數模擬不同鏡頭和膠片效果。
入口:文生圖、融圖模式下,選擇 Nano Banana 2/Nano Banana Pro/GPT Image 2 模型,即可使用攝影參數功能。

具體焦距、景深、色彩空間、鏡頭組資訊請查看攝影參數使用指南:
1.2.6 人像質感增強
對圖片中的人物進行質感優化,包括皮膚紋理細化、面部瑕疵修復、畫面銳度提升。僅圖片(AI 生成/自訂)節點適用。適合提升寫實人像的真實感和精緻度。

可調參數
皮膚紋理細化:增強皮膚微觀紋理,使肌膚質感更真實自然
面部瑕疵修復:自動識別並修復面部瑕疵,如斑點、痘印等
畫面銳度提升:提升整體畫面清晰度和邊緣銳度
油光抑制:減少全圖高光油亮感
背景融合:使人物與背景自然融合

1.2.7 面部精修
透過指令編輯和參數微調對角色面部進行精細調整。僅圖片(AI 生成/自訂)節點適用。適合對角色面部特徵、表情、妝容等進行精確控制的場景。


【參數微調】功能可調整面部、眉毛、眼睛等面部細節。

2 有哪些影片生成功能
NadouPro 提供多種影片生成與編輯功能,覆蓋從文生影片到專業戲份生成的全鏈路。在自由畫布或影視創作工作臺中新增影片節點後,可在功能面板選擇對應模式,支援文生影片、首尾幀、多參考、動作控制等生成模式,以及智慧擦除、超清插幀等編輯能力,所有影片模型均支援音畫同步。
支援模型:Seedance 2.5(量質雙優,影像更精緻)、Seedance 2.0(4K,高品質多鏡)、Happy Horse 1.1(更強動態表現力)、可靈 3.0 Omni 4K(多模態輸入)、MiniMax H3 2K(多鏡同出,性價比高)、Seedance 2.0 mini(極速出片)、Veo 3.1 Preview(4K 超高清)、Gemini Omni Flash(多模態全能)
具體模型詳見NadouPro 模型怎麼選?——圖片/影片/音訊模型速查【影片模型】
2.1 基礎功能
2.1.1 文生影片
輸入文字描述直接生成 1-15 秒的影片片段。是最基礎的影片創作方式,適合快速生成動態畫面、驗證創意方向。在影片節點中選擇「文生影片」,輸入提示詞並選擇模型即可。

2.1.2 首尾幀
透過首幀、尾幀圖控制影片片段的生成。上傳兩張圖片作為影片的起始和結束畫面,AI 自動生成兩幀之間的過渡動畫。適合控制影片起止畫面、實現鏡頭銜接。在影片節點中選擇「首尾幀」模式,上傳首幀和尾幀圖。

2.1.3 多參考
透過多張主體或其他參考圖,融合生成影片片段。適合需要保持多個角色或場景一致性的影片創作。在影片節點中選擇「多參考」模式,上傳參考圖並輸入描述。

2.1.4 影片編輯
對已有影片進行元素編輯,包括修改畫面氛圍、延長影片時長等。適合在已生成影片基礎上進行局部調整和優化。在影片節點中選擇「影片編輯」模式,上傳目標影片並輸入編輯指令。

2.1.5 動作控制
遷移影片中人物的面部表情和肢體動作到生成影片中。上傳參考影片或人物圖片,AI 將提取動作並套用到目標角色。適合讓角色執行特定動作(如行走、揮手、舞蹈等)的場景。

2.2 高階功能
2.2.1 智慧擦除
智慧擦除可去除影片中不需要的元素或物件,適合清理畫面中的穿幫物品、浮水印或多餘人物。在影片節點中選擇「智慧擦除」功能,框選需要擦除的區域即可。



2.2.2 裁剪
對影片長度進行裁剪。


2.2.3 超清
對影片進行超解析度處理,提升畫面清晰度和細節表現。適合將低解析度素材提升為高清版本。

2.2.4 超清插幀
自動超解析度與插幀,提升影片解析度和清晰度。適合將低解析度素材提升為高清或超清版本。

3 有哪些音訊使用功能
NadouPro 提供音訊生成功能,覆蓋配音生成和音樂創作。在自由畫布或影視創作工作臺中新增音訊節點後,可在功能面板選擇對應模式,支援生成歌曲、生成伴奏、台詞配音和音色轉換四種模式,解決配樂創作與角色配音兩大需求。
支援模型:Mureka V9(精準理解創作意圖,高完成度成品)、Mureka V8(強化旋律與人聲表現,穩定生成結構完整的高品質歌曲)、Nadou TTS(支援多語種台詞配音)、Nadou VC(支援多語種音色轉換)
具體模型詳見NadouPro 模型怎麼選?——圖片/影片/音訊模型速查【音訊模型】
3.1 音樂製作
3.1.1 生成歌曲
透過文本描述指定音樂風格、情緒、樂器等參數,以及歌詞資訊,即可獲得一首完整的歌曲。

3.1.2 生成伴奏
透過文本描述指定音樂風格、情緒、樂器等參數,AI 自動生成對應伴奏。

3.2 配音生成
3.2.1 台詞配音
輸入角色台詞文本,AI 自動生成帶有情感表達的語音配音。支援選擇不同音色和語言風格,適合為角色添加對白。在音訊節點中選擇「台詞配音」模式,輸入台詞文本並選擇音色即可。

3.2.2 音色轉換
將已有音訊的音色轉換為目標音色,保持語音內容和節奏不變。適合將配音替換為不同角色的聲音。


3.2.3 文生音色
還可以創造屬於自己的音色用於台詞配音和音色轉換。選擇語種,用自然語言描述聲音的性別、年紀、語速、語調等情況,即可生成專屬音色。



4 常見問題
Q:圖片生成和影片生成分別消耗多少積分?
不同模型和任務的積分消耗不同,一般圖片生成消耗較低,影片生成消耗較高。具體以平台頁面展示為準。
Q:攝影參數功能在哪些模型下可用?
攝影參數功能在文生圖、融圖模式下,選擇 Nano Banana 2、Nano Banana Pro 或 GPT Image 2 模型時即可使用。
Q:全景圖生成後可以在哪裡使用?
全景圖生成後可在 3D 導演臺中使用,實現沉浸式空間探索和多機位調度。
Q:音訊功能支援哪些創作模式?
音訊功能支援生成歌曲、生成伴奏、台詞配音和音色轉換四種模式,覆蓋從配樂創作到角色配音的常見需求。