Suno Speech(ベータ)の使い方:ナレーション・朗読・AI ボイスオーバーを BGM 付きで 1 本のトラックに

Suno Speech は、話し声とその BGM を同時に生成する Suno の新しいベータ機能です。Simple モードと Advanced モードの違い、Vocal Gender・Background music・Variety の使い方、プロンプト例、ベータ版の弱点、まだ発表されていない点をまとめました。

Suno Speech(ベータ)の使い方:ナレーション・朗読・AI ボイスオーバーを BGM 付きで 1 本のトラックに

2026 年 10 月 1 日、Suno は Speech(ベータ) を Web・iOS・Android のすべてのユーザーに公開しました。歌ではなく「話す」ための、Suno 初の機能です。アイデアを入力するか台本を貼り付け、声と音楽のイメージを書くと、話し声とそのサウンドトラックが 1 本のトラックとして同時に生成されます。Suno はこれを「声と音楽をひとつのまとまったトラックとして生成する初めてのオーディオモデル」と呼んでいます。

要点を先にまとめると、Suno Speech は作曲家が内蔵された AI ナレーション(ボイスオーバー)ツールです。Simple モードでは一文のアイデアから台本まで Suno が書き、Advanced モードでは自分の台本を指定したスタイルで読み上げます。BGM は初期設定でオンですが、オフにすればナレーションだけを作れます。1 テイクの長さは最大約 8 分。クレジット消費量、対応言語、API はまだ公表されておらず、Suno 自身もベータ版にはまだ粗さがあるとはっきり書いています。

以下の情報源:Chief Product Officer の Jack Brody による Suno の発表記事、10 月 1 日のリリースノート、Suno 公式チュートリアル動画 How to Use Suno Speech (Beta)(本記事の画面写真はこの動画から引用)、The Verge の報道、そして X 上の反応です。Suno が公表していない点は、推測せずその旨を書きます。当サイトは独立した Suno ダウンロードツールで、Suno とは提携していません。

Suno Speech の発表画像。SPEECH ラベル付きのカードとして Sunset Calmness(瞑想、やわらかい声)、Go Team!(元気なチアリーダー)、Digitale Roboto(イタリアのロボット、90 年代のビープ・ポップ)、Scottish Catter(スコットランドの雑談、パブ、バグパイプ)、Grocery Lists(ハープシコード付きのヴィクトリア朝英語)が並ぶ
Suno の発表画像。カード 1 枚が Speech のトラック 1 本で、タイトルの下に声と音楽が短く書かれています。画像:Suno

Suno Speech の概要

Suno Speech(ベータ)
公開日 2026 年 10 月 1 日。少人数で 1 か月テストした後、オープンベータとして公開
使える場所 suno.com と Suno の iOS/Android アプリの Create → Speech
対象ユーザー Suno によれば全員。プランによる制限は発表されていない
生成されるもの 話し声とオリジナル BGM を 1 本のトラックで。BGM はオフにできる
モード Simple(アイデアを説明する)と Advanced(Custom script+Style of speech)
設定項目 Vocal Gender(Male/Female)、Background music(On/Off)、Variety スライダー
長さ 1 テイク最大約 8 分
未発表 1 テイクあたりのクレジット、対応言語、API、自分の Voice をナレーターに使えるか

Suno Speech で何ができるのか

今の AI ナレーション制作は、たいてい 2 つの作業に分かれています。テキスト読み上げ(TTS)ツールで台本を読ませ、音楽ツールやストック音源で BGM を用意し、編集ソフトで両方を並べて音量を調整する。Suno Speech はこれを 1 回で済ませます。BGM が声と一緒に生成されるので、語りが盛り上がれば音楽も膨らみ、ナレーターがゆっくりになれば音楽も引く、という動きができます。ただ下で一定の音量で流れているだけ、にはなりにくいのです。

Suno の売り込み方は遊び心たっぷりです。リリースノートには「やさしいピアノに乗せたおやすみの読み聞かせ、スタジアムドラムに乗せた檄、ASMR の買い物リスト」とあります。発表記事で Brody は、開発中にチームが作ったものとして、友人のメッセージを「やたらと大げさなドラマチック朗読」にしたもの、何気ないボイスメモに「無駄に壮大な劇伴」を付けたもの、瞑想、詩、励ましの言葉、子ども向けの寝る前のお話を挙げています。公式チュートリアルでは、博物館の音声ガイド、駅の構内アナウンス、スポークンワード作品、試験勉強用の解説といった実用的な例も紹介されています。

なお、Suno が音声モデルを作るのはこれが初めてではありません。歌に全面的に舵を切る前の 2023 年に、オープンソースの音声合成モデル Bark を公開しています。Speech は、Suno アプリそのものに組み込まれた初めての音声モデルです。

Web での Suno Speech の使い方

suno.com/create を開きます。左側のパネルに Songs・Speech・Sounds の 3 つのタブが並んでいるので、Speech をクリックします。パネルには赤い BETA バッジが付き、上部で Simple と Advanced を切り替えます。

Simple モード:完成形のアイデアを説明する

Suno の Create パネルで Speech タブが選ばれ、Simple モードが有効になっている。BETA バッジがあり、プロンプト欄に A museum audio guide explaining an obviously fake と入力されている
Create → Speech → Simple。ひとつのプロンプトで内容・声・音楽をまとめて指示します。

Simple モードでは、何を話すか、誰が話すか、下で何が流れるかを 1 つのプロンプトに書きます。台本を書くのは Suno です。チュートリアルでは、スヌーズボタンの発明という明らかに架空の展示を紹介する博物館の音声ガイドを、「落ち着いた真面目なナレーター、少しドラマチックに、下にエレガントなオーケストラ」と指示しています。すると Suno は「Welcome to Gallery 7. Please stand a respectful distance from the glass…」で始まるナレーション全体と、それに合ったオーケストラの劇伴を返してきます。チュートリアルの結果は 5 分強で、曲の生成と同じく 1 回のリクエストで 2 テイクが返ってきます。

The Verge が挙げた例「a pirate captain rallying his crew(船員を奮い立たせる海賊船長)」を見ると、入力はこれだけで足りることがわかります。

Advanced モード:自分の台本と演出

Advanced モードの Suno Speech。Custom script 欄に Write or paste your speech、Style of speech 欄に Describe the delivery: tone, pacing, mood and setting と表示され、右側のライブラリに The Snooze Button の Speech テイク 2 本(5:13 と 5:19)が並んでいる
Advanced モードではプロンプトが 2 つに分かれます。Custom script が言葉、Style of speech が話し方です。

話す内容がもう決まっているなら Advanced に切り替えます。入力欄は 2 つです。

  • Custom script:「Write or paste your speech(スピーチを書くか貼り付ける)」。Suno が読み上げるテキストです。
  • Style of speech:「Describe the delivery: tone, pacing, mood and setting(話し方を説明:トーン、テンポ、ムード、場面)」。演技の演出を書く欄で、BGM がオンなら音楽の指示もここに書きます。

チュートリアルでいちばんわかりやすいのは、短いアナウンスの台本を固定して、スタイルだけを変える例です。「落ち着いたプロの駅員アナウンス、ゆっくり一定のテンポ、完全に真面目に」と書くと、「Attention passengers, the 6:42 train to nowhere in particular is now boarding on platform 9.」が淡々と読まれます。スタイルを「プロらしさを保とうとしつつだんだん慌てていくアナウンサー。最初は冷静で、一文ごとに速く、苛立ってくる」に変えると、同じ言葉がまったく違う演技で返ってきます。

台本の書き方について Suno のアドバイスはシンプルです。普通の話し言葉として、ふつうの段落で書くこと。 曲を作るときのような歌詞の書式や、[Verse] や [Chorus] のような角かっこのセクションタグは要りません。

Advanced の設定:Vocal Gender・Background music・Variety

Suno Speech の Advanced セクション。Vocal Gender(Male と Female)、Background music(Off と On、On が選択済み)、Normal に設定された Variety スライダーの 3 行
Advanced の下にある 3 つの設定。Background music は初期設定で On です。
  • Vocal Gender:Male か Female。初期状態ではどちらも選ばれていないので、性別にこだわるときだけ指定すれば十分です。
  • Background music:初期設定は On。動画に自分で音楽を付ける場合のナレーション、セリフ、説明音声など、音楽がすでにある場面では Off にしてクリーンな音声だけを作ります。
  • Variety:テイクごとのばらつきの大きさ。初期値は Normal です。左に寄せるとより安定した読み、右に寄せるとより意外性のある読みになります。

iPhone・Android での Suno Speech

Suno モバイルアプリで上部に Speech が選ばれ、Backing music on のチップと Script・Tone のチップがあり、プロンプトに I have a test tomorrow. Explain osmosis to me like a p と入力されている
モバイルでは同じ設定が Backing music・Script・Tone のチップとして表示されます。

Speech はモバイルアプリでも使えます。表示されない場合は、Suno が X の告知で書いているとおり「アプリを最新版に更新」してください。アプリでは Create 上部のメニューから Speech を選び、Advanced の項目がチップになります。Backing music on(× で外せます)、Script、Tone の 3 つです。チュートリアルのモバイル例は勉強用で、「明日テストがある。忍耐強い家庭教師のように浸透(osmosis)を説明して。まず簡単なたとえから始めて、テスト用に覚えやすい短い説明をして」と入力し、復習ノートを通学中に聞ける音声にしています。

Suno Speech のプロンプト例

Suno 自身の例と同じく、「何の作品か → 声 → 音楽」の順に書いています。

寝る前の読み聞かせ(Simple モード)

A two-minute bedtime story about a fox who learns to share fireflies. Soft, warm storyteller voice with a gentle smile in it, slow pace. Quiet piano and soft night pads underneath, lullaby tempo.

檄・スピーチ(Simple モード)

A coach’s half-time pep talk to a team that is losing 2–0. Loud, rallying, building to a shout. Stadium drums and brass that grow with every line.

自分の台本(Advanced モード)

Custom script: 読ませたい言葉を短い段落で貼り付ける。

Style of speech: Warm adult narrator, intimate and conversational, steady pace, clear pronunciation. Sparse felt piano underneath, voice forward in the mix, gentle ending.

BGM なしのクリーンなナレーション(Advanced モード)

Background music: Off。Variety: いちばん左。

Style of speech: Neutral, friendly product-demo narrator, medium pace, clear diction. No background music.

日本語の台本やプロンプトにどこまで対応するかは、Suno がまだ言語リストを公表していないため不明です。日本語で使う場合は、短い台本で試してから本番に進むのが安全です。

うまく作るコツ

  • 内容だけでなく話し方を演出する。 Suno のプレースホルダーが求めているのは、トーン・テンポ・ムード・場面の 4 つです。「ドラマチックに」より「落ち着いて始まり、だんだん速く、最後は息を切らす」のほうが効きます。
  • 台本は話し言葉の形にする。 短い文、息継ぎの位置に句読点、考えの区切りで段落を分ける。韻や繰り返しのフレーズがあると、リズミカルで半分歌うような読みに引っ張られることがあります。
  • スタイルは短い台本で先に試す。 駅のアナウンスの例のとおり、同じ言葉でも聞こえ方はまるで変わります。5 分の台本を貼る前に、数行でスタイルを固めましょう。
  • 台本と照らし合わせて聞く。 人名、数字、正確さが必要な言葉は公開前に確認してください。これは創作ツールであって、一字一句正確な TTS エンジンではありません。
  • 声だけにしたいときは指示を重ねる。 基本は Background music を Off にすること。aireiter が紹介した初期のコミュニティの工夫では、それでも音楽が入り込むことがあったため、Variety をいちばん左にし、スタイル(Tone)欄に「No background music.」と書き足しています。保証ではなく回避策として扱ってください。
  • 実在の人物をまねない。 許可のない人の名前を挙げるのではなく、年齢、声質、なまり、態度で声を説明しましょう。

ベータ版でまだうまくいかないこと(Suno 自身の説明)

Suno はこの点でかなり率直です。Brody は「ベータは本当にベータです。ときどきイギリス英語のアクセントがオーストラリアまで旅して戻ってきます。ドラマチックな間は、とてもドラマチックになることがあります」と書いています。途中でアクセントが変わる、間が長すぎる、意図と違う読み方をする、といったテイクは一定の割合で出ると考えておきましょう。2 テイク作って良いほうを選ぶのも作業のうちです。

Suno がまだ公表していないこと:

  • クレジット消費量。 発表記事にもリリースノートにも、1 テイクの価格や、無料プランと有料プランで上限が違うかは書かれていません。残高は Create 画面に表示されるので、長い台本をまとめて作る前に確認してください。
  • 対応言語。 対応言語のリストは公表されていません。
  • 自分の声。 Suno には別機能の Voices があり、本人確認した自分の声で曲を歌わせられます。ただ、保存した Voice を Speech のナレーターに使えるとは、Suno はどこにも書いていません。
  • API。 Speech は Suno の他の機能と同じく、Web とアプリだけです。開発者にとっての意味は Suno API の解説にまとめています。
  • Speech 独自の権利。 Speech 専用の規約はありません。Suno の一般ルールでは、商用利用は有料プランで作ったものに付き、無料プランの作品は個人利用に限られます。詳しくは法律ガイドをどうぞ。

Suno Speech と音声合成(TTS)ツールの違い

Suno Speech と ElevenLabs のようなツールは、解決する問題が違います。演技と音楽がセットで意味を持つもの、たとえば寝る前のお話、詩、瞑想、予告編、乾杯のあいさつ、キャラクターもの、グループチャットのドラマチック朗読なら Suno Speech。数百本のクリップで同じ声、正確なタイミング、一字一句正しい発音、API が必要なもの、たとえば製品チュートリアル、オーディオブック、アクセシビリティ、アプリ組み込みなら専用の TTS ツールです。併用もできます。BGM 付きの版は Suno で作り、正確さが必要な部分には TTS の素の読みを使う、という分け方です。

X での反応

Suno 自身の X での告知は短いものでした。「Speech is now in Beta. Try the first model ever that creates spoken audio with matching background music. Update your app for the latest.(Speech がベータに。BGM 付きの話し声を作る初めてのモデルを試してください。最新版へのアップデートをお忘れなく)」。数時間のうちに AI ニュース系のアカウントが取り上げ、中国語圏の AI 情報発信者 Gorden Sun(@Gorden_Sun)は「歌声を生成できる Suno なら音声生成は自然な流れで、生成された声が BGM とぴったり合うのが特徴」とまとめています。

懐疑的な声もあります。r/SunoAI では、あるユーザーが Suno 自身のデモを「デモとしては心配になるほどひどい」と評しました(上記 aireiter のガイドで引用)。The Verge は、ElevenLabs から Adobe まで AI 音声はすでに競争の激しい分野だと指摘し、今回の発表を Suno が音楽以外へ事業を広げる動きとも見ています。同じ日、CEO の Mikey Shulman は Bloomberg に対し、Suno は前回公表した有料会員 200 万人・売上 3 億ドルを「はるかに超えている」と語りましたが、新しい数字は出していません。

Suno Speech のトラックをダウンロードする

Speech のテイクはワークスペースで曲と並んで表示され、SPEECH ラベルが付き、いいね・ピン留め・共有ボタンも曲と同じです。ファイルとして残すなら、プランに含まれる Suno 公式のダウンロードを使います。Suno から別の発表があるまでは、曲と同じダウンロード上限を前提に考えてください。

Suno Music Downloader は Suno の公開リンクに対応しています。Speech のトラックを公開し、共有リンクが通常の suno.com/song/… ページとして開くなら、そのリンクを貼り付けて、個人利用の視聴用コピーを M4A、MP3、WAV、MP4 で保存できます。Suno へのログインは不要で、ダウンロード枠も消費しません。Speech はまだベータなので、Speech のリンクがツールで読み込めない場合はお知らせください。確認します。

よくある質問

Suno Speech とは何ですか? Suno Speech は、Suno の Create 画面にあるベータ機能で、ナレーション、ボイスオーバー、物語、スピーチなどの話し声を、オリジナルの BGM と一緒に 1 本のトラックとして生成します。2026 年 10 月 1 日に公開され、Suno は声と音楽を同時に作る初めてのオーディオモデルだとしています。

Suno Speech は無料ですか? Suno はベータを Web とモバイルの全員に公開したとしていますが、1 テイクのクレジット消費量や、プランによって上限が違うかはまだ公表していません。クレジット残高は Create 画面に表示されます。

Suno Speech はどうやって使いますか? suno.com またはアプリで Create を開き、Speech を選びます。Simple モードでは作品・声・音楽を 1 つのプロンプトで説明します。Advanced モードでは自分の文章を Custom script に貼り付け、話し方を Style of speech に書き、必要に応じて Vocal Gender、Background music、Variety を設定します。

BGM なしのナレーションは作れますか? 作れます。Advanced モードで Background music をオフにするか、モバイルで Backing music のチップを外します。ベータ中はそれでも音楽が入ることがあったため、スタイル欄に「No background music.」と書き、Variety を下げる人もいます。

Suno Speech のトラックはどのくらいの長さにできますか? Suno のチュートリアルによると、1 テイク最大約 8 分です。

自分の声を Suno Speech で使えますか? Suno はそう発表していません。自分の声は、曲向けの別機能 Voices で使うもので、保存した Voice が Speech のナレーターになれるとは書かれていません。

Suno Speech に API はありますか? ありません。Suno の他の機能と同じく、Speech は Web と iOS/Android アプリだけで使えます。

Suno Speech は TTS の代わりになりますか? すべてには使えません。音楽が作品の一部になる、短く表現力のある作品で最も力を発揮します。長く、一字一句正確で、再現性が必要なナレーションには、専用の TTS ツールのほうが予測しやすく、Suno 自身もベータ版ではアクセントや間が揺れると注意しています。

Suno Music Downloader で Suno Speech のトラックをダウンロードできますか? このツールは Suno の公開リンクを読み込みます。公開された Speech のトラックが通常の suno.com/song ページとして開けば、曲と同じように保存できます。Speech は始まったばかりのベータなので、Speech のリンクが使えない場合はお知らせください。

Suno が Speech の料金、対応言語などを発表したら、この記事を更新します。

← 記事一覧