🔥LIMITED OFFER
01:58:23
GET 50% OFF
フルシーンAIオーディオ

Seed Audio 1.0でサウンドシーン全体を演出。

単一のボイストラックを超えて。Seed Audio 1.0では、スピーカー、感情、部屋、音楽、サウンドイベントを1つのコンパクトな制作ブリーフとして記述。その後、SeedAudio.coに進んで結果を生成します。

外部生成 · SeedAudio.coを開く

制作レイヤー
制作レイヤー
シーンブリーフ

雨に濡れた路地で、2人の刑事がささやく。両方の声を抑え気味で近くに保つ。遠くの交通音、低めのサスペンスベッド、濡れた足音、最後に金属のドアのバタンという音を加える。

対話

2人 · 抑え気味

アンビエンス

雨 · 交通 · 路地

音楽

低めのサスペンスベッド

SFX

足音 · ドアのバタン

プロンプトで記述されたレイヤーの視覚的マップ—ライブ生成器ではありません。

1プロンプト

シーン全体を指示

最大3つ

オプションのオーディオ参照

1画像

代替参照として

約2分

最大単一出力

有用な区別

単なるコピーではなく、制作ブリーフ。

従来のテキスト読み上げは言葉を読み上げます。Seed Audio 1.0は、声、タイミング、場所、音楽、イベント間の関係を考慮して設計されており、出力が孤立したナレーションではなくシーンのように感じられる場合に有用です。

従来のTTS

  • 1つのスクリプトが1つのボイストラックに
  • アンビエンスや効果音は後から追加
  • スピーカーの交代は手動で組み立てが必要なことが多い

シーンレベル生成

  • 複数のスピーカーが1つの指示を共有
  • 感情やペーシングはプロンプトに含める
  • アンビエンス、音楽、効果音はシーンに従う

指示できること

4つの決定が最初のカットを形作る。

各決定を具体的に。モデルの推測が減り、ミックスに手を加える必要がある場合に明確な目標ができます。

01

スピーカーと話し方

スピーカーの人数、言語、声の質感、感情の強さ、ペーシング、明瞭度の優先順位を指定。声の同一性やスタイルが本当に重要な場合のみ参照を使用。

02

場所と雰囲気

1つの明確なアンビエンスベッドで音響空間を設定:静かなスタジオ、雨の通り、混雑した市場、森の端、車内、または他の特定の環境。

03

音楽の方向性

ジャンルを積み重ねるのではなく、音楽の役割を記述。雰囲気、楽器編成、強度、ベッドの入り方やフェードアウトのタイミングを指定。

04

再生順のイベント

重要な音のみを配置—足音、通知音、ドア、息づかい、衝撃音、終了キューなど—リスナーが聞く順番で。

繰り返し可能なワークフロー

オーディオディレクターのようにシーンを書く。

最も安全なプロンプトは、短くて追いやすく、具体的でステージング可能なものです。4つのパスで構築し、最もノイズの多いレイヤーから修正します。

  1. 01

    シーンを定義する

    フォーマット、設定、対象者、言語、ムード、おおよその時間を指定。これにより、オーディオが果たすべき役割が決まります。

  2. 02

    声を配置する

    スピーカーの役割を定義し、対話やナレーションを書く。感情やペーシングの合図は、影響を与える行の横に置く。

  3. 03

    必須レイヤーのみ追加

    1つのアンビエンスベッド、1つの音楽方向、少数のサウンドイベントを選択。レイヤーが多いほど豊かな結果になるとは限りません。

  4. 04

    聞いて、分離して、修正

    音声が埋もれている、またはシーンが混雑している場合は、一度に1レイヤーずつ削除または弱める。要求された時間をガイドとして扱い、最終的なトリミングの余地を残す。

適している場面

最終ミックスの前に、世界観を音で確立する。

Seed Audio 1.0は、声とコンテキストを同時に届ける必要がある場合に最も有用です。探索を加速できますが、最終的な制作には編集と人間による確認が依然として有益です。

短編映画のプリビジュアライゼーション

ピクチャーロック前に対話、アンビエンス、フォーリー、音楽をブロックし、リズムと感情的な形状を評価。

広告やソーシャルコンセプト

ローカライズされたスポット、プロダクトモーメント、キャンペーンフック、音声主導のソーシャルクリップを、各オーディオレイヤーを個別に組み立てずにドラフト。

ゲームやインタラクティブメディア

キャラクターバーク、環境ループ、UIモーメント、カットシーンの方向性を、最終的な録音パイプラインにコミットする前に探索。

ポッドキャストや学習

ホストのやり取り、シナリオベースのレッスン、ガイド付き解説、章のオープニングを、ペーシングや背景テクスチャを含めてプロトタイプ。

プロンプトの構造

リスナーが聞く順序で書く。

タイムラインはタグのクラウドよりも追跡しやすい。このコンパクトな構造を出発点として、シーンに不要な指示は削除してください。

prompt-brief.txtプロンプトの構造
01シーン

真夜中の雨の路地で、35秒の英語ラジオドラマシーンを作成。

02

2人の刑事が抑えられた緊張感でささやく;すべてのセリフを明確かつ近くに保つ。

03アンビエンス

一定の小雨、遠くの交通音、狭い屋外の音響空間を使用。

04音楽

対話の下に留まり、最後のビートの前にフェードアウトする低めのサスペンスベッドを追加。

05イベント

2番目のセリフの後に濡れた足音を2つ配置し、最後に金属のドアのバタン音で終わる。

結果が濁っている場合は、詳細を追加する前に1つのレイヤーを削除してみてください。

生成する前に

初稿でできることの限界を知る。

シーン生成は方向性を探る迅速な方法ですが、最終マスターを約束するものではありません。プロンプトを洗練する前に適切な期待を設定しましょう。

タイミングはおおよそ

要求された長さとイベント配置は出力をガイドしますが、フレーム単位の編集はオーディオ編集ソフトでのトリミングが必要になる場合があります。

情報を詰め込みすぎるとミックスが濁る

キャラクター、効果音、音楽の変更、感情のビートが多すぎると競合します。コアシーンが機能するまでは狭く始め、複雑さは後から追加してください。

専用の音楽ツールが適している場合もある

音楽がシーンをサポートする場合はSeed Audio 1.0を使用。曲自体が主要な成果物である場合は、音楽ファーストのワークフローがより適している可能性があります。

参照には許可が必要

使用権限のあるオーディオと画像のみをアップロード。公共の人物になりすましたり、保護されたキャラクターや声を再現したりしないでください。

実用的な回答

よくある質問

Seed Audio 1.0とは何ですか?

Seed Audio 1.0は、スピーチ、話し方、アンビエンス、背景音楽、効果音をまとめて指示できるシーンレベルのAIオーディオモデルとして紹介されています。このページは独立したガイドであり、生成のためにSeedAudio.coにリンクしています。

Seed Audio 1.0とテキスト読み上げの違いは何ですか?

テキスト読み上げは通常、スクリプトをボイストラックに変換します。Seed Audio 1.0はより広範な音響シーン向けに設計されており、スピーカーの相互作用、環境、音楽、タイミング、効果音を同じ制作ブリーフで記述できます。

オーディオや画像の参照を使用できますか?

SeedAudio.coのAPIドキュメントでは、最大3つのオーディオ参照または1つの画像参照のサポートが説明されています。これらの参照タイプを同じリクエストで組み合わせることはできず、アップロードされたすべてのアセットは許可を得て使用する必要があります。

このページでオーディオを生成できますか?

いいえ。このページは解説用のランディングページであり、生成機能はありません。メインボタンからSeedAudio.coを開き、アカウント要件、現在の設定項目、料金、生成機能の提供状況を直接確認できます。

Seed Audio 1.0はオープンソースですか?

Seed Audio 1.0をオープンソースまたはオープンウェイトリリースとして扱わないでください。現在のアクセスはホストサービスおよびAPIを通じて提供されています。

ブリーフから最初のカットへ

シーン全体に声を与える。

焦点を絞った制作ブリーフから始め、レイヤーを意図的に保ち、生成の準備ができたらSeedAudio.coに進んでください。

Seed Audio 1.0を試す

Nanabananaから離れ、SeedAudio.coを開きます。

研究基盤: 機能とワークフローノートは、SeedAudio.coの製品ドキュメント、そのプロンプトガイドとAPIリファレンス、ByteDance Seedの公開モデルインデックス、および最近のクリエイターの議論を参照して確認されました。サービスコントロールは変更される場合があります。

研究基盤