Suno Speech (beta): cómo crear locuciones, narraciones y spoken word con IA y música de fondo en una sola pista
Suno Speech es una nueva beta en la página Create de Suno que genera una voz hablada y su música de fondo a la vez. Cómo funcionan los modos Simple y Advanced, los controles Vocal Gender, Background music y Variety, ejemplos de prompts, los límites conocidos de la beta y lo que Suno aún no ha anunciado.

El 1 de octubre de 2026 Suno abrió Speech (beta) a todo el mundo en la web, iOS y Android. Es la primera función de Suno que no va de cantar: escribes una idea o pegas un guion, describes la voz y la música que quieres, y Suno genera una interpretación hablada y su banda sonora juntas, en una sola pista. Suno lo llama “el primer modelo de audio que genera voz y música juntas como una pista cohesionada”.
La versión corta: Suno Speech es una herramienta de locución con IA que trae su propio compositor. El modo Simple escribe el texto por ti a partir de una idea de una línea; el modo Advanced lee tu propio guion con el estilo que describas. La música de fondo viene activada por defecto y se puede apagar para obtener una narración limpia. Una toma puede durar unos ocho minutos. Suno todavía no ha publicado el coste en créditos, la lista de idiomas ni una API, y reconoce abiertamente que la beta aún tiene asperezas.
Fuentes de todo lo que sigue: el anuncio de Suno firmado por su Chief Product Officer, Jack Brody, la nota de versión del 1 de octubre, el vídeo tutorial oficial de Suno How to Use Suno Speech (Beta) (las capturas de la interfaz de este artículo salen de ahí), la cobertura de The Verge y la reacción en X. Cuando Suno no ha dicho algo, lo indicamos en lugar de adivinar. Este sitio es una herramienta independiente para descargar de Suno y no está afiliado a Suno.

Suno Speech de un vistazo
| Suno Speech (beta) | |
|---|---|
| Lanzamiento | 1 de octubre de 2026, como beta abierta tras un mes de pruebas con un grupo reducido |
| Dónde | suno.com y las apps de Suno para iOS y Android, en Create → Speech |
| Quién puede usarlo | Todo el mundo, según Suno; no se ha anunciado ninguna restricción por plan |
| Qué genera | Una voz hablada y música original en una sola pista; la música se puede apagar |
| Modos | Simple (describes la idea) y Advanced (guion propio + estilo de locución) |
| Controles | Vocal Gender (Male / Female), Background music (On / Off), deslizador Variety |
| Duración | Hasta unos 8 minutos por toma |
| Aún sin anunciar | Coste en créditos por toma, idiomas admitidos, API, usar tu propia Voice como narrador |
Qué hace realmente Suno Speech
Hoy la mayoría de las locuciones con IA son dos trabajos. Una herramienta de texto a voz (TTS) lee el guion, una herramienta de música o una biblioteca de stock pone el fondo, y alguien junta las dos cosas en un editor y ajusta los niveles. Suno Speech hace ambas en una sola pasada. Como la banda sonora se genera junto con la voz, puede crecer cuando la interpretación se vuelve dramática y retirarse cuando el narrador baja el ritmo, en lugar de sonar debajo siempre al mismo nivel.
Suno lo presenta con ejemplos juguetones. La nota de versión habla de “cuentos para dormir sobre un piano suave, arengas sobre tambores de estadio, listas de la compra en ASMR y más”. En el anuncio, Brody enumera lo que hizo el equipo mientras lo desarrollaba: mensajes de amigos convertidos en “lecturas dramáticas exageradamente producidas”, notas de voz normales con “bandas sonoras innecesariamente épicas”, meditaciones, poemas, charlas motivacionales y cuentos para sus hijos. El tutorial de Suno añade usos más prácticos: una audioguía de museo, un aviso de estación de tren, una pieza de spoken word y una explicación para estudiar.
Tampoco es el primer modelo de voz de Suno. Antes de volcarse en las canciones, Suno publicó en 2023 Bark, un modelo de texto a voz de código abierto. Speech es el primer modelo de voz integrado en la propia app de Suno.
Cómo usar Suno Speech en la web
Abre suno.com/create. El panel de la izquierda tiene ahora tres pestañas: Songs, Speech y Sounds. Haz clic en Speech. El panel lleva una insignia roja de BETA y arriba eliges entre Simple y Advanced.
Modo Simple: describe la idea terminada

En el modo Simple escribes un único prompt que cubre qué se dice, quién lo dice y qué suena debajo. El guion no lo escribes tú, lo escribe Suno. En el tutorial, el prompt es una audioguía de museo para una exposición evidentemente falsa sobre la invención del botón de repetición de la alarma —“narrador tranquilo y serio, algo dramático, con una elegante música orquestal debajo”— y Suno devuelve una narración completa (“Welcome to Gallery 7. Please stand a respectful distance from the glass…”) con una partitura orquestal a juego. El resultado del tutorial dura algo más de cinco minutos, y la petición devuelve dos tomas, igual que cuando generas una canción.
El ejemplo de The Verge, “a pirate captain rallying his crew” (un capitán pirata arengando a su tripulación), muestra lo poco que hace falta escribir.
Modo Advanced: tu guion, tu dirección

Cambia a Advanced cuando ya sabes exactamente qué hay que decir. Tienes dos cajas:
- Custom script: “Write or paste your speech” (escribe o pega tu texto). Es lo que Suno interpreta.
- Style of speech: “Describe the delivery: tone, pacing, mood and setting” (describe la interpretación: tono, ritmo, ambiente y escenario). Aquí diriges la actuación y, si la música está activada, también la banda sonora.
La mejor demostración del tutorial mantiene un mismo aviso corto y cambia solo el estilo. “Locutor de estación de tren tranquilo y profesional, ritmo lento y medido, totalmente serio” produce una lectura impasible de “Attention passengers, the 6:42 train to nowhere in particular is now boarding on platform 9.” Si cambias el estilo a “locutor cada vez más frenético que intenta seguir siendo profesional; empieza controlado y se acelera y desespera con cada frase”, las mismas palabras vuelven como una interpretación completamente distinta.
El consejo de Suno para el guion es sencillo: escríbelo como se habla, en párrafos normales. No necesitas formato de letra ni etiquetas de sección entre corchetes como [Verse] o [Chorus], como harías con una canción.
Los controles de Advanced: Vocal Gender, Background music y Variety

- Vocal Gender: Male o Female. En la vista inicial no hay ninguno seleccionado, así que solo hace falta cuando el género importa.
- Background music: activado por defecto. Ponlo en Off cuando necesites audio hablado limpio: narración para un vídeo al que pondrás tu propia música, diálogos, instrucciones o cualquier caso en que ya tengas la música.
- Variety: cuánto pueden variar las tomas. Está en Normal por defecto; muévelo a la izquierda para lecturas más previsibles y a la derecha para otras más sorprendentes.
Suno Speech en iPhone y Android

Speech también está en las apps móviles; si no te aparece, el anuncio de Suno en X pide “actualizar la app a la última versión”. En la app eliges Speech en el menú de arriba de Create y los campos de Advanced se convierten en chips: Backing music on (toca la × para quitarlo), Script y Tone. El ejemplo móvil del tutorial es una ayuda para estudiar —“Mañana tengo un examen. Explícame la ósmosis como un profesor paciente. Empieza con una analogía sencilla y luego dame una explicación corta que pueda recordar en el examen”—, que convierte los apuntes en algo que puedes escuchar de camino a clase.
Ejemplos de prompts para Suno Speech
Siguen el patrón de los ejemplos de Suno: primero qué es la pieza, luego la voz y después la música.
Cuento para dormir (modo Simple)
A two-minute bedtime story about a fox who learns to share fireflies. Soft, warm storyteller voice with a gentle smile in it, slow pace. Quiet piano and soft night pads underneath, lullaby tempo.
Arenga (modo Simple)
A coach’s half-time pep talk to a team that is losing 2–0. Loud, rallying, building to a shout. Stadium drums and brass that grow with every line.
Tu propio guion (modo Advanced)
Custom script: pega el texto exacto en párrafos cortos.
Style of speech: Warm adult narrator, intimate and conversational, steady pace, clear pronunciation. Sparse felt piano underneath, voice forward in the mix, gentle ending.
Locución limpia, sin música (modo Advanced)
Background music: Off. Variety: todo a la izquierda.
Style of speech: Neutral, friendly product-demo narrator, medium pace, clear diction. No background music.
Suno no ha publicado qué idiomas admite Speech, así que si vas a usarlo en español, prueba primero con un guion corto antes de lanzarte con uno largo.
Consejos para mejores resultados
- Dirige la interpretación, no solo el contenido. Tono, ritmo, ambiente y escenario son las cuatro cosas que pide el propio texto de ayuda de Suno. “Empieza tranquilo, acelera y termina sin aliento” sirve más que “dramático”.
- Dale al guion forma de habla. Frases cortas, puntuación donde respiraría quien habla, saltos de párrafo entre ideas. Las rimas y los estribillos repetidos pueden empujar al modelo hacia una lectura rítmica, medio cantada.
- Prueba el estilo con un guion corto. El aviso de tren del tutorial demuestra que las mismas palabras pueden sonar totalmente distintas; fija el estilo con unas pocas líneas antes de pegar un guion de cinco minutos.
- Escucha comparando con tu texto. Revisa nombres, cifras y cualquier palabra que deba ser exacta antes de publicar. Es una herramienta creativa, no un motor de texto a voz palabra por palabra.
- Para solo voz, suma señales. El interruptor principal es Background music en Off. Un truco temprano de la comunidad, recogido por aireiter, añade mover Variety del todo a la izquierda y escribir “No background music.” en el campo de estilo o de tono, porque a veces la música se colaba igualmente. Tómalo como un apaño, no como una garantía.
- No imites a personas reales. Describe la voz por edad, textura, acento y actitud en lugar de nombrar a alguien cuya voz no tienes permiso para usar.
Lo que Suno dice que la beta todavía hace mal
Suno es inusualmente franco. “Beta significa beta de verdad”, escribe Brody. “De vez en cuando los acentos británicos se van de paseo a Australia y vuelven. Las pausas dramáticas pueden ser muy dramáticas.” Cuenta con que una parte de las tomas cambie de acento a mitad del guion, alargue demasiado una pausa o lea una palabra de forma distinta a como querías. Generar dos tomas y quedarte con la mejor forma parte del proceso.
Cosas que Suno todavía no ha publicado:
- Coste en créditos. Ni el anuncio ni la nota de versión dan un precio por toma ni dicen si los planes gratuito y de pago tienen límites distintos. La pantalla Create muestra tu saldo; revísalo antes de una tanda de guiones largos.
- Idiomas. No hay una lista publicada de idiomas admitidos.
- Tu propia voz. La función aparte Voices te permite cantar canciones con tu propia voz verificada. Nada de lo que ha publicado Suno dice que una Voice guardada pueda usarse como narrador en Speech.
- Una API. Speech está solo en la web y en las apps, como el resto de Suno. Nuestra explicación sobre la API de Suno cuenta qué implica eso para desarrolladores.
- Derechos específicos de Speech. Suno no ha publicado condiciones aparte para Speech. Su regla general es que el uso comercial va con lo creado en un plan de pago, y lo creado en el plan gratuito es para uso personal; nuestra guía legal entra en detalle.
Suno Speech frente a una herramienta de texto a voz
Suno Speech y herramientas como ElevenLabs resuelven problemas distintos. Elige Suno Speech cuando la interpretación y la música van juntas: cuentos para dormir, poemas, meditaciones, tráileres, brindis, piezas de personaje, lecturas dramáticas del chat del grupo. Elige una herramienta de TTS dedicada cuando necesites la misma voz en cientos de clips, tiempos exactos, pronunciación perfecta o una API: tutoriales de producto, audiolibros, accesibilidad, apps. También pueden convivir: haz en Suno la versión con música y guarda una lectura seca de TTS para lo que tenga que ser preciso.
Qué se dice en X
El anuncio de Suno en X fue breve: “Speech is now in Beta. Try the first model ever that creates spoken audio with matching background music. Update your app for the latest.” (“Speech ya está en beta. Prueba el primer modelo que crea audio hablado con música de fondo a juego. Actualiza tu app”). Las cuentas de noticias de IA lo recogieron en pocas horas; el divulgador chino de IA Gorden Sun (@Gorden_Sun) lo resumió como un paso natural para una empresa que ya genera voces cantadas, con el atractivo de que “la voz generada encaja perfectamente con la música de fondo”.
No todo el mundo quedó convencido. En r/SunoAI un usuario calificó la propia demo de Suno de “preocupantemente mala” (citado en la guía de aireiter enlazada arriba), y The Verge recordó que la voz con IA es un terreno muy concurrido, de ElevenLabs a Adobe, y vio el lanzamiento en parte como una forma de diversificarse más allá de la música. Ese mismo día, el CEO Mikey Shulman dijo a Bloomberg que Suno ya está “muy por encima” de los 2 millones de suscriptores y 300 millones de dólares de ingresos que había comunicado por última vez, aunque no dio una cifra nueva.
Descargar pistas de Suno Speech
Las tomas de Speech aparecen en tu espacio de trabajo junto a tus canciones, con la etiqueta SPEECH y los mismos botones de me gusta, fijar y compartir. Para guardar un archivo, usa la descarga oficial de Suno de tu plan; mientras Suno no diga otra cosa, cuenta con los mismos límites de descarga que para las canciones.
Suno Music Downloader funciona con enlaces públicos de Suno. Si publicas una pista de Speech y su enlace abre una página normal suno.com/song/…, pégalo y podrás guardar una copia para escuchar en M4A, MP3, WAV o MP4 para uso personal, sin iniciar sesión en Suno y sin gastar tu cupo de descargas. Speech sigue en beta, así que si un enlace de Speech no carga en la herramienta, avísanos y lo revisamos.
Preguntas frecuentes
¿Qué es Suno Speech? Suno Speech es una función beta de la página Create de Suno que genera audio hablado —narraciones, locuciones, cuentos, discursos— junto con música de fondo original en una sola pista. Suno la lanzó el 1 de octubre de 2026 y la presenta como el primer modelo de audio que crea voz y música a la vez.
¿Suno Speech es gratis? Suno dice que la beta está abierta a todo el mundo en web y móvil, pero no ha publicado cuántos créditos cuesta una toma de Speech ni si los límites cambian según el plan. Tu saldo de créditos aparece en la pantalla Create.
¿Cómo se usa Suno Speech? Abre Create en suno.com o en la app y elige Speech. En el modo Simple, describe la pieza, la voz y la música en un solo prompt. En el modo Advanced, pega tu texto en Custom script, describe la interpretación en Style of speech y ajusta Vocal Gender, Background music y Variety si lo necesitas.
¿Puede Suno Speech hacer una locución sin música? Sí. Apaga Background music en el modo Advanced o quita el chip Backing music en el móvil. Algunos usuarios añaden además “No background music.” en el estilo y bajan Variety, porque durante la beta a veces se colaba música.
¿Cuánto puede durar una pista de Suno Speech? Hasta unos ocho minutos por toma, según el tutorial de Suno.
¿Puedo usar mi propia voz en Suno Speech? Suno no lo ha dicho. Las voces personales forman parte de la función aparte Voices para canciones, y nada de lo publicado indica que una Voice guardada pueda narrar una pista de Speech.
¿Suno Speech tiene API? No. Como el resto de Suno, Speech solo está disponible en la web y en las apps de iOS y Android.
¿Suno Speech sirve para sustituir al texto a voz? No para todo. Funciona mejor en piezas cortas y expresivas en las que la música forma parte del resultado. Para narraciones largas, exactas o repetibles, una herramienta de TTS dedicada sigue siendo más predecible, y la propia Suno avisa de que en la beta los acentos y las pausas pueden variar.
¿Puedo descargar pistas de Suno Speech con Suno Music Downloader? La herramienta lee enlaces públicos de Suno. Una pista de Speech publicada que se abra como una página normal de suno.com/song se puede guardar como una canción; Speech es nuevo y está en beta, así que avísanos si un enlace de Speech no funciona.
Actualizaremos este artículo cuando Suno publique precios, idiomas u otros cambios en Speech.


