Suno Speech(베타) 사용법: AI 내레이션·보이스오버·낭독을 배경음악과 함께 하나의 트랙으로
Suno Speech는 말하는 목소리와 배경음악을 동시에 생성하는 Suno Create 페이지의 새 베타 기능입니다. Simple 모드와 Advanced 모드의 차이, Vocal Gender·Background music·Variety 설정, 프롬프트 예시, 베타의 알려진 한계, 아직 발표되지 않은 내용을 정리했습니다.

2026년 10월 1일, Suno가 Speech(베타)를 웹·iOS·Android의 모든 사용자에게 공개했습니다. 노래가 아니라 ‘말하기’를 위한 Suno의 첫 기능입니다. 아이디어를 입력하거나 대본을 붙여 넣고, 원하는 목소리와 음악을 설명하면 말하는 연기와 그 사운드트랙이 하나의 트랙으로 함께생성됩니다. Suno는 이를 “목소리와 음악을 하나의 일관된 트랙으로 함께 생성하는 최초의 오디오 모델"이라고 부릅니다.
요약하면 Suno Speech는 작곡가가 내장된 AI 보이스오버(내레이션) 도구입니다. Simple 모드는 한 줄짜리 아이디어로 대본까지 Suno가 써 주고, Advanced 모드는 내가 쓴 대본을 지정한 스타일로 읽어 줍니다. 배경음악은 기본으로 켜져 있지만 끄면 깨끗한 내레이션만 만들 수 있습니다. 한 테이크는 최대 약 8분입니다. 크레딧 소모량, 지원 언어, API는 아직 공개되지 않았고, Suno 스스로도 베타에 아직 거친 부분이 있다고 분명히 밝혔습니다.
아래 내용의 출처: Chief Product Officer Jack Brody가 쓴 Suno의 발표 글, 10월 1일 릴리스 노트, Suno 공식 튜토리얼 영상 How to Use Suno Speech (Beta)(이 글의 화면 캡처는 이 영상에서 가져왔습니다), The Verge의 보도, 그리고 X에서의 반응입니다. Suno가 밝히지 않은 내용은 추측하지 않고 그렇다고 적었습니다. 이 사이트는 독립적인 Suno 다운로드 도구이며 Suno와 제휴 관계가 없습니다.

Suno Speech 한눈에 보기
| Suno Speech(베타) | |
|---|---|
| 출시 | 2026년 10월 1일. 소규모 그룹과 한 달간 테스트한 뒤 오픈 베타로 공개 |
| 사용 위치 | suno.com과 Suno iOS·Android 앱의 Create → Speech |
| 사용 대상 | Suno에 따르면 모든 사용자. 요금제 제한은 발표되지 않음 |
| 생성 결과 | 말하는 목소리와 오리지널 배경음악을 하나의 트랙으로. 음악은 끌 수 있음 |
| 모드 | Simple(아이디어 설명)과 Advanced(직접 쓴 대본 + 말하기 스타일) |
| 설정 | Vocal Gender(Male / Female), Background music(On / Off), Variety 슬라이더 |
| 길이 | 테이크당 최대 약 8분 |
| 아직 미발표 | 테이크당 크레딧, 지원 언어, API, 내 Voice를 내레이터로 쓸 수 있는지 |
Suno Speech는 실제로 무엇을 하나
지금의 AI 보이스오버 작업은 대개 두 단계입니다. 텍스트 음성 변환(TTS) 도구가 대본을 읽고, 음악 도구나 스톡 라이브러리가 배경을 채우고, 누군가 편집기에서 둘을 맞추고 볼륨을 조절합니다. Suno Speech는 이 두 가지를 한 번에 합니다. 음악이 목소리와 함께 생성되기 때문에, 연기가 극적으로 고조되면 음악도 커지고 내레이터가 느려지면 음악도 물러섭니다. 밑에서 같은 볼륨으로 계속 흐르기만 하는 것이 아닙니다.
Suno는 장난스러운 예시로 이 기능을 소개합니다. 릴리스 노트에는 “부드러운 피아노 위의 잠자리 동화, 경기장 드럼 위의 열정적인 연설, ASMR 장보기 목록 등"이라고 적혀 있습니다. 발표 글에서 Brody는 개발 중 팀이 만든 것들로, 친구의 문자를 “터무니없이 과하게 제작한 극적인 낭독"으로 만든 것, 평범한 음성 메모에 “쓸데없이 웅장한 배경음악"을 붙인 것, 명상, 시, 격려의 말, 아이들을 위한 잠자리 이야기를 꼽습니다. Suno 튜토리얼에는 박물관 오디오 가이드, 기차역 안내 방송, 스포큰 워드 작품, 시험 공부용 설명 같은 실용적인 예도 나옵니다.
Suno의 첫 음성 모델도 아닙니다. 노래에 전념하기 전인 2023년에 Suno는 오픈소스 음성 합성 모델 Bark를 공개했습니다. Speech는 Suno 앱 자체에 들어간 첫 음성 모델입니다.
웹에서 Suno Speech 사용하는 법
suno.com/create를 엽니다. 왼쪽 패널에 이제 Songs, Speech, Sounds세 개의 탭이 있습니다. Speech를 클릭하세요. 패널에 빨간 BETA배지가 붙어 있고, 위쪽에서 Simple과 Advanced를 고릅니다.
Simple 모드: 완성된 아이디어를 설명하기

Simple 모드에서는 무엇을 말하는지, 누가 말하는지, 밑에서 무엇이 흐르는지를 프롬프트 하나에 씁니다. 대본은 내가 아니라 Suno가 씁니다. 튜토리얼에서는 스누즈 버튼의 발명이라는 누가 봐도 가짜인 전시를 소개하는 박물관 오디오 가이드를 “차분하고 진지한 내레이터, 약간 극적으로, 밑에는 우아한 오케스트라 음악"으로 요청합니다. 그러면 Suno는 “Welcome to Gallery 7. Please stand a respectful distance from the glass…“로 시작하는 전체 내레이션과 어울리는 오케스트라 음악을 돌려줍니다. 튜토리얼의 결과물은 5분이 조금 넘고, 노래 생성과 마찬가지로 한 번 요청하면 두 개의 테이크가 나옵니다.
The Verge가 든 예시 “a pirate captain rallying his crew(선원들을 독려하는 해적 선장)“를 보면 입력은 이 정도면 충분하다는 걸 알 수 있습니다.
Advanced 모드: 내 대본, 내 연출

할 말이 이미 정해져 있다면 Advanced로 바꿉니다. 입력 칸은 두 개입니다.
- Custom script: “Write or paste your speech(말할 내용을 쓰거나 붙여 넣기)”. Suno가 연기할 텍스트입니다.
- Style of speech: “Describe the delivery: tone, pacing, mood and setting(전달 방식 설명: 톤, 속도, 분위기, 배경)”. 연기를 연출하는 칸이며, 음악이 켜져 있다면 음악에 대한 지시도 여기에 씁니다.
튜토리얼에서 가장 좋은 시연은 짧은 안내 방송 대본을 그대로 두고 스타일만 바꾸는 것입니다. “차분하고 전문적인 기차역 안내원, 느리고 일정한 속도, 완전히 진지하게"라고 쓰면 “Attention passengers, the 6:42 train to nowhere in particular is now boarding on platform 9.“가 무덤덤하게 읽힙니다. 스타일을 “전문성을 유지하려 애쓰지만 점점 당황하는 안내원. 처음엔 침착하다가 문장마다 빨라지고 짜증이 섞인다"로 바꾸면, 같은 말이 완전히 다른 연기로 돌아옵니다.
대본 작성에 대한 Suno의 조언은 간단합니다. 평소 말하듯, 일반 문단으로 쓰세요. 노래를 만들 때처럼 가사 형식이나 [Verse], [Chorus] 같은 대괄호 섹션 태그는 필요 없습니다.
Advanced 설정: Vocal Gender, Background music, Variety

- Vocal Gender: Male 또는 Female. 기본 화면에서는 아무것도 선택되어 있지 않으니, 성별이 중요할 때만 지정하면 됩니다.
- Background music: 기본값은 On. 직접 음악을 입힐 영상의 내레이션, 대사, 안내 음성처럼 음악이 이미 있는 경우에는 Off로 바꿔 깨끗한 음성만 만듭니다.
- Variety: 테이크마다 얼마나 달라질 수 있는지. 기본값은 Normal입니다. 왼쪽으로 옮기면 더 예측 가능한 낭독, 오른쪽으로 옮기면 더 의외의 낭독이 나옵니다.
iPhone·Android에서 Suno Speech 사용하기

Speech는 모바일 앱에서도 쓸 수 있습니다. 보이지 않는다면 Suno가 X 공지에서 말한 대로 “앱을 최신 버전으로 업데이트"하세요. 앱에서는 Create 상단 메뉴에서 Speech를 고르면 Advanced 항목이 칩으로 바뀝니다. Backing music on(× 를 눌러 제거), Script, Tone세 가지입니다. 튜토리얼의 모바일 예시는 공부용입니다. “내일 시험이 있어. 인내심 있는 과외 선생님처럼 삼투 현상을 설명해 줘. 쉬운 비유로 시작해서 시험 때 기억할 수 있는 짧은 설명을 해 줘"라고 입력해, 복습 노트를 등굣길에 들을 수 있는 음성으로 바꿉니다.
Suno Speech 프롬프트 예시
Suno의 예시처럼 ‘무슨 작품인지 → 목소리 → 음악’ 순서로 썼습니다.
잠자리 동화(Simple 모드)
A two-minute bedtime story about a fox who learns to share fireflies. Soft, warm storyteller voice with a gentle smile in it, slow pace. Quiet piano and soft night pads underneath, lullaby tempo.
열정적인 연설(Simple 모드)
A coach’s half-time pep talk to a team that is losing 2–0. Loud, rallying, building to a shout. Stadium drums and brass that grow with every line.
직접 쓴 대본(Advanced 모드)
Custom script: 읽힐 문장을 짧은 문단으로 붙여 넣기.
Style of speech: Warm adult narrator, intimate and conversational, steady pace, clear pronunciation. Sparse felt piano underneath, voice forward in the mix, gentle ending.
음악 없는 깨끗한 보이스오버(Advanced 모드)
Background music: Off. Variety: 맨 왼쪽.
Style of speech: Neutral, friendly product-demo narrator, medium pace, clear diction. No background music.
Suno는 Speech가 지원하는 언어 목록을 공개하지 않았습니다. 한국어로 쓸 계획이라면 긴 대본을 넣기 전에 짧은 대본으로 먼저 시험해 보세요.
더 좋은 결과를 얻는 팁
- 내용만이 아니라 말하는 방식을 연출하세요. Suno의 안내 문구가 요구하는 것은 톤, 속도, 분위기, 배경 네 가지입니다. “극적으로"보다 “차분하게 시작해 점점 빨라지고 숨이 찬 채로 끝난다"가 훨씬 효과적입니다.
- 대본은 말하는 형태로. 짧은 문장, 숨 쉬는 자리에 문장 부호, 생각이 바뀌는 곳에 문단 나누기. 운율이나 반복되는 후렴구가 있으면 리듬감 있는, 반쯤 노래하는 낭독으로 끌려갈 수 있습니다.
- 스타일은 짧은 대본으로 먼저 시험하세요. 기차역 안내 방송 예시처럼 같은 말도 완전히 다르게 들릴 수 있습니다. 5분짜리 대본을 붙이기 전에 몇 줄로 스타일을 정하세요.
- 대본과 대조하며 들으세요. 이름, 숫자, 정확해야 하는 단어는 공개 전에 확인하세요. 이것은 창작 도구이지, 한 글자도 틀리지 않는 TTS 엔진이 아닙니다.
- 음성만 원하면 신호를 겹치세요. 기본은 Background music을 Off로 두는 것입니다. aireiter가 소개한 초기 커뮤니티 팁은, 그래도 음악이 끼어드는 경우가 있어 Variety를 맨 왼쪽으로 옮기고 스타일(Tone) 칸에 “No background music.“을 덧붙이는 것입니다. 보장이 아니라 우회책으로 생각하세요.
- 실존 인물을 흉내 내지 마세요. 허락받지 않은 사람의 이름을 대는 대신 나이, 음색, 억양, 태도로 목소리를 설명하세요.
Suno가 밝힌 베타의 아직 부족한 점
Suno는 이 부분에서 꽤 솔직합니다. Brody는 “베타는 정말 베타입니다. 가끔 영국 억양이 호주까지 다녀오기도 합니다. 극적인 멈춤이 아주 극적일 수도 있습니다"라고 썼습니다. 대본 중간에 억양이 바뀌거나, 멈춤이 너무 길거나, 의도와 다르게 읽히는 테이크가 일정 비율로 나온다고 생각하세요. 두 테이크를 만들어 더 나은 쪽을 고르는 것도 작업의 일부입니다.
Suno가 아직 공개하지 않은것:
- 크레딧 소모량. 발표 글과 릴리스 노트 어디에도 테이크당 가격이나 무료·유료 요금제의 한도 차이가 나와 있지 않습니다. 잔액은 Create 화면에 표시되니, 긴 대본을 한꺼번에 만들기 전에 확인하세요.
- 지원 언어. 지원 언어 목록은 공개되지 않았습니다.
- 내 목소리. Suno에는 본인 인증한 내 목소리로 노래를 부르게 하는 별도 기능 Voices가 있습니다. 하지만 저장한 Voice를 Speech 내레이터로 쓸 수 있다고 Suno가 밝힌 적은 없습니다.
- API. Speech는 Suno의 다른 기능처럼 웹과 앱에서만 쓸 수 있습니다. 개발자에게 어떤 의미인지는 Suno API 해설에 정리했습니다.
- Speech 전용 권리. Speech만을 위한 약관은 없습니다. Suno의 일반 규칙은 상업적 이용은 유료 요금제에서 만든 결과물에 적용되고, 무료 요금제 결과물은 개인 용도로 한정된다는 것입니다. 자세한 내용은 법률 가이드를 참고하세요.
Suno Speech와 TTS 도구의 차이
Suno Speech와 ElevenLabs 같은 도구는 푸는 문제가 다릅니다. 연기와 음악이 함께 있어야 의미가 있는작업, 예를 들어 잠자리 동화, 시, 명상, 예고편, 건배사, 캐릭터 연기, 단체 채팅방 대화의 극적인 낭독이라면 Suno Speech가 맞습니다. 수백 개의 클립에서 같은 목소리, 정확한 타이밍, 한 글자도 틀리지 않는 발음, API가 필요한 작업, 예를 들어 제품 튜토리얼, 오디오북, 접근성, 앱 연동이라면 전용 TTS 도구가 맞습니다. 함께 쓸 수도 있습니다. 음악이 있는 버전은 Suno로 만들고, 정확해야 하는 부분은 TTS의 담백한 낭독을 쓰는 식입니다.
X에서의 반응
Suno의 X 공지는 짧았습니다. “Speech is now in Beta. Try the first model ever that creates spoken audio with matching background music. Update your app for the latest.(Speech가 베타로 나왔습니다. 어울리는 배경음악과 함께 말하는 오디오를 만드는 최초의 모델을 써 보세요. 앱을 최신 버전으로 업데이트하세요)”. 몇 시간 만에 AI 뉴스 계정들이 이를 다뤘고, 중국어권 AI 정보 공유자 Gorden Sun(@Gorden_Sun)은 노래하는 목소리를 이미 생성하는 회사로서 자연스러운 수순이며 “생성된 목소리가 배경음악과 완벽하게 어울린다는 점이 특징"이라고 정리했습니다.
모두가 설득된 것은 아닙니다. r/SunoAI에서는 한 사용자가 Suno 자체 데모를 “데모치고는 걱정될 만큼 별로"라고 평했고(위에서 링크한 aireiter 가이드에서 인용), The Verge는 ElevenLabs부터 Adobe까지 AI 음성이 이미 경쟁이 치열한 분야라고 지적하며 이번 출시를 Suno가 음악 밖으로 사업을 넓히려는 움직임으로도 읽었습니다. 같은 날 CEO Mikey Shulman은 Bloomberg에 Suno가 마지막으로 공개한 유료 구독자 200만 명, 매출 3억 달러를 “훨씬 넘어섰다"고 말했지만 새로운 수치는 밝히지 않았습니다.
Suno Speech 트랙 다운로드하기
Speech 테이크는 워크스페이스에서 노래 옆에 SPEECH라벨과 함께 표시되며, 좋아요·고정·공유 버튼도 노래와 같습니다. 파일로 보관하려면 요금제에 포함된 Suno 공식 다운로드를 쓰세요. Suno가 따로 발표하기 전까지는 노래와 같은 다운로드 한도를 기준으로 생각하면 됩니다.
Suno Music Downloader는 Suno 공개 링크에서 작동합니다. Speech 트랙을 공개하고 공유 링크가 일반 suno.com/song/… 페이지로 열린다면, 그 링크를 붙여 넣어 개인 감상용 사본을 M4A, MP3, WAV, MP4로 저장할 수 있습니다. Suno 로그인도 필요 없고 다운로드 한도도 쓰지 않습니다. Speech는 아직 베타이므로, Speech 링크가 도구에서 열리지 않으면 알려 주세요. 확인하겠습니다.
자주 묻는 질문
Suno Speech란 무엇인가요? Suno Speech는 Suno Create 페이지의 베타 기능으로, 내레이션, 보이스오버, 이야기, 연설 같은 말하는 오디오를 오리지널 배경음악과 함께 하나의 트랙으로 생성합니다. Suno는 2026년 10월 1일에 이를 출시했고, 목소리와 음악을 동시에 만드는 최초의 오디오 모델이라고 소개합니다.
Suno Speech는 무료인가요? Suno는 베타를 웹과 모바일의 모든 사용자에게 공개했다고 밝혔지만, Speech 테이크 하나에 크레딧이 얼마나 드는지, 요금제별로 한도가 다른지는 아직 공개하지 않았습니다. 크레딧 잔액은 Create 화면에 표시됩니다.
Suno Speech는 어떻게 사용하나요? suno.com이나 앱에서 Create를 열고 Speech를 고릅니다. Simple 모드에서는 작품, 목소리, 음악을 프롬프트 하나로 설명합니다. Advanced 모드에서는 내 글을 Custom script에 붙여 넣고 Style of speech에 전달 방식을 적은 뒤, 필요하면 Vocal Gender, Background music, Variety를 설정합니다.
음악 없이 보이스오버만 만들 수 있나요? 네. Advanced 모드에서 Background music을 끄거나, 모바일에서 Backing music 칩을 제거하세요. 베타 기간에는 그래도 음악이 들어가는 경우가 있어서, 스타일 칸에 “No background music.“을 적고 Variety를 낮추는 사용자도 있습니다.
Suno Speech 트랙은 얼마나 길게 만들 수 있나요? Suno 튜토리얼에 따르면 테이크당 최대 약 8분입니다.
Suno Speech에서 내 목소리를 쓸 수 있나요? Suno는 그렇다고 발표하지 않았습니다. 내 목소리는 노래용 별도 기능인 Voices에서 쓰는 것이며, 저장한 Voice가 Speech 트랙을 내레이션할 수 있다는 내용은 공개된 적이 없습니다.
Suno Speech에 API가 있나요? 없습니다. Suno의 다른 기능처럼 Speech도 웹과 iOS·Android 앱에서만 쓸 수 있습니다.
Suno Speech가 TTS를 대신할 수 있나요? 모든 경우에는 아닙니다. 음악이 결과물의 일부가 되는 짧고 표현력 있는 작품에서 가장 강합니다. 길고, 한 글자도 틀리면 안 되고, 반복 가능해야 하는 내레이션에는 전용 TTS 도구가 여전히 더 예측 가능하며, Suno 스스로도 베타에서는 억양과 멈춤이 흔들릴 수 있다고 경고합니다.
Suno Music Downloader로 Suno Speech 트랙을 다운로드할 수 있나요? 이 도구는 Suno 공개 링크를 읽습니다. 공개된 Speech 트랙이 일반 suno.com/song 페이지로 열린다면 노래처럼 저장할 수 있습니다. Speech는 막 나온 베타이므로 Speech 링크가 작동하지 않으면 알려 주세요.
Suno가 Speech의 요금, 지원 언어 등 변경 사항을 발표하면 이 글을 업데이트하겠습니다.


