🔥LIMITED OFFER
01:58:23
GET 50% OFF
全場景AI音訊

用 Seed Audio 1.0 導演整個音效場景。

超越單一語音軌道,使用 Seed Audio 1.0。描述說話者、情緒、空間、音樂與音效事件,作為一份簡潔的製作腳本——然後前往 SeedAudio.co 生成結果。

外部生成器 · 開啟 SeedAudio.co

製作層級
製作層級
場景腳本

兩名偵探在雨淋的小巷中低語。保持雙方聲音內斂且靠近。加入遠方車流、低懸疑背景音樂、濕漉漉的腳步聲,然後一個金屬門砰然關上。

對話

2 位說話者 · 內斂

環境音

雨 · 車流 · 小巷

音樂

低懸疑背景音樂

音效

腳步聲 · 關門聲

提示中所描述層級的視覺對應——非即時生成器。

1 則提示

導演完整場景

最多 3 個

可選音訊參考

1 張圖片

作為替代參考

約 2 分鐘

單次輸出最長時間

實用區別

一份製作腳本,而非一段文字。

傳統的文字轉語音朗讀文字。Seed Audio 1.0 圍繞語音、時間、地點、音樂與事件之間的關係而設計——當輸出應該像一個場景而非孤立的旁白時尤為實用。

傳統TTS

  • 一份腳本 → 一條語音軌道
  • 環境音與效果事後添加
  • 說話者切換常需手動編輯

場景級生成

  • 多位說話者共享同一方向
  • 情緒與節奏包含在提示中
  • 環境音、音樂與效果跟隨場景

你可導演的元素

四個決策決定初版。

讓每個決策具體化。模型需要猜測的部分更少,混音需要調整時你也有更明確的目標。

01

說話者與表達

指定說話者人數、語言、聲音質感、情緒強度、節奏與清晰度優先級。僅在聲音身份或風格確實重要時使用參考。

02

地點與氛圍

用一個清晰的環境音背景設定聲學空間:安靜錄音室、雨街、擁擠市場、森林邊緣、車內或其他特定環境。

03

音樂方向

描述音樂的角色而非堆疊類型。說明情緒、樂器編制、強度以及背景音樂應何時進入或淡出。

04

按播放順序的事件

僅放置重要聲音——腳步聲、通知音、門聲、呼吸聲、撞擊聲或結束提示——按照聽者應聽到的順序。

可重複的工作流程

像音訊導演一樣撰寫場景。

最安全的提示應足夠簡短以便遵循,又足夠具體以便搭建場景。分四個步驟建立,然後先修正最混亂的層級。

  1. 01

    設定場景框架

    從格式、設定、聽眾、語言、情緒與大約時長開始。這確立了音訊應達到的目的。

  2. 02

    編排人聲

    定義說話者角色並撰寫對話或旁白。將情緒與節奏提示放在它們影響的台詞旁邊。

  3. 03

    僅添加必要層級

    選擇一個環境音背景、一個音樂方向以及少數音效事件。更多層級並不一定會創造更豐富的結果。

  4. 04

    聆聽、隔離、修正

    如果語音被掩蓋或場景感覺擁擠,一次移除或柔化一個層級。將要求的時長視為指引,並為最終修剪留出空間。

適用情境

在最終混音前用聲音建立世界。

Seed Audio 1.0 在語音與情境需要同時呈現時最為實用。它可以加速探索,而最終製作仍受益於編輯與人工審查。

短片預覽

在畫面鎖定前安排對話、環境音、擬音與音樂,以便評估場景的節奏與情緒形狀。

廣告與社群概念

草擬在地化廣告、產品時刻、活動鉤子與語音主導的社群短片,無需分別組裝每個音訊層級。

遊戲與互動媒體

在投入最終錄製流程前,探索角色台詞、環境循環、UI時刻與過場動畫的方向。

播客與學習

製作主持人對話、情境式課程、引導解說與章節開場的原型,包含節奏與背景質感。

提示結構

按照聽者應聽到的順序書寫。

時間軸比標籤雲更容易遵循。使用此緊湊結構作為起點,然後刪除場景不需要的任何方向。

prompt-brief.txt提示結構
01場景

創建一段 35 秒的英文廣播劇場景,背景為午夜時分的雨淋小巷。

02聲音

兩位偵探低語,帶有壓抑的緊張感;保持每句台詞清晰且靠近。

03環境音

使用持續的細雨、遠方車流,以及狹窄的戶外聲學空間。

04音樂

添加低懸疑背景音樂,保持在對話下方,並在最後一個節拍前淡出。

05事件

在第二句台詞後放置兩次濕漉漉的腳步聲,然後以一個金屬門砰然關上作為結束。

如果結果聽起來雜亂,先移除一個層級,再添加更多細節。

生成之前

了解初稿的界限。

場景生成是探索方向的快速方式,並非最終成品的承諾。在花時間優化提示之前,設定正確的期望。

時間僅為近似值

要求的時長與事件位置引導輸出,但精確到幀的編輯可能仍需要在音訊或視訊編輯器中修剪。

密集提示可能模糊混音

過多角色、效果、音樂變化或情緒節拍可能相互競爭。從窄範圍開始,僅在核心場景運作良好後再增加複雜性。

專用音樂工具可能更適合

在音樂支援場景時使用 Seed Audio 1.0。如果歌曲本身是主要交付成果,則音樂優先的工作流程可能更合適。

參考素材需獲得許可

僅上傳你擁有使用權的音訊與圖片。避免模仿公眾人物或重現受保護的角色與聲音。

實用解答

常見問題

什麼是 Seed Audio 1.0?

Seed Audio 1.0 被呈現為場景級 AI 音訊模型,可共同導演語音、表達、環境音、背景音樂與音效。此頁面為獨立指南,並連結至 SeedAudio.co 進行生成。

Seed Audio 1.0 與文字轉語音有何不同?

文字轉語音通常將腳本轉換為語音軌道。Seed Audio 1.0 專為更廣泛的聲學場景設計,其中說話者互動、環境、音樂、時間與效果可在同一份製作腳本中描述。

我可以使用音訊或圖片參考嗎?

SeedAudio.co API 文件說明支援最多三個音訊參考或一個圖片參考。這些參考類型無法在同一個請求中組合,且每個上傳的素材應獲得使用許可。

我可以在這個頁面上生成音訊嗎?

不可以。此頁面僅用於介紹 Seed Audio 1.0,不提供生成器功能。主要按鈕會開啟 SeedAudio.co,你可以在那裡直接查看帳號需求、目前的設定項目、價格與生成服務的提供狀態。

Seed Audio 1.0 是開源的嗎?

請勿將 Seed Audio 1.0 視為開源或開放權重版本。當前存取方式是透過託管服務與 API。

從腳本到初版

給整個場景一個聲音。

從專注的製作腳本開始,保持層級有目的性,準備好生成時再前往 SeedAudio.co。

試用 Seed Audio 1.0

你將離開 Nanabanana 並開啟 SeedAudio.co。

研究基礎: 功能與工作流程說明已參照 SeedAudio.co 產品文件、其提示指南與 API 參考、ByteDance Seed 的公開模型索引,以及近期的創作者討論。服務控制項可能有所變更。

研究基礎