In this topic: Browse all Getting Started articles
Tutoriales de música con IASuno Speech (beta): voz hablada y música en una sola toma

Suno Speech es la beta pública de Suno AI que se abrió el 1 de octubre de 2026: genera voz hablada y banda sonora original en una sola pista cohesionada, no un export de TTS que luego pegas al BGM. Lo encuentras en Create → Speech. Esta guía cubre la entrada, Simple frente a Advanced, qué trabajos encajan y qué rarezas de beta conviene asumir antes de publicar.
Los hechos siguen la entrada Introducing Speech (beta) y las release notes de Suno. Las etiquetas pueden cambiar. suno.skin es un explicador independiente, no Suno, Inc. Si necesitas camas instrumentales bajo un locutor humano, usa la guía de intro de podcast: es otro flujo de trabajo.
Para qué sirve Suno Speech
El camino clásico son dos fases: texto a voz en una pista y luego buscar o generar una cama y bajar niveles en un editor. Speech beta junta «qué se dice» y «qué ambiente transmite» en una sola generación, para que ritmo y mood nazcan juntos. Los ejemplos oficiales incluyen cuentos para dormir con piano suave, arengas con tambores de estadio, listas de la compra en modo ASMR y lecturas dramáticas de textos cotidianos.
- Encaja bien: recitados de poesía, meditación guiada, cuentos infantiles, VO corto con cama, aperturas de evento
- Encaja mal: un pop completo con estribillo cantado — eso sigue en Create de canción, no en Speech
- Solo narración limpia: desactiva la música de fondo y conserva la voz
- Duración: la cobertura pública suele citar unos ocho minutos por toma; parte guiones más largos
Entrada: elige Speech dentro de Create
Disponible en web, iOS y Android. Abre Create y elige Speech junto a la generación habitual de canciones. Escribe lo que debe decirse — o la escena que quieres — y describe voz y estilo musical. La beta está abierta para todos; Suno insiste en que beta es beta y seguirá iterando con el feedback.
- Abre Create y cambia a Speech
- Simple: describe la escena en lenguaje llano (p. ej. «un capitán pirata arenga a la tripulación antes de la tormenta»)
- Advanced: pega un guion terminado y ajusta género de voz, estilo de entrega y variedad de generación
- Silencia la música cuando necesites un voice-over seco
- Revisa la toma completa: deriva de acento, pausas teatrales, música que tape el habla
- Genera dos o tres versiones antes de gastar una descarga

Simple vs Advanced: elige el modo
Simple sirve para tantear sensación cuando el guion no está cerrado — quieres oír «voz cálida y suave + piano de luz nocturna» antes de fijar palabras. Advanced es para copy bloqueado: locuciones de marca, guiones de meditación, aperturas de programa — cuando el texto no puede variar, mételo en el cuadro de guion y aprieta los controles de voz.
- Simple: brief de una línea; el modelo inventa fraseo y banda sonora
- Advanced: guion propio más género / estilo / variedad; las palabras son tuyas
- Silenciar música: úsalo cuando solo necesites la pista de voz
- Cambia una variable por pasada: fija el texto, luego la voz, luego la densidad de la cama
Prompts de escena listos para pegar
Cuatro arranques que puedes renombrar. Para estética de sueño y meditación aún puedes tomar prestado el gusto de cama de la guía de meditación y sueño, pero aquí Speech pronuncia las palabras en la misma toma.
- Cuento para dormir (Simple): narrador grave y suave; un zorro perdido encuentra su hogar en el bosque; piano suave y cuerdas muy ligeras; pulso lento; sin tambores bruscos
- Meditación guiada (guion Advanced): indicaciones breves de respiración en segunda persona; voz calmada, algo lenta; música: banda suave, espacio para la voz guiada, sin caídas bruscas
- VO corto (Advanced): fija el nombre de marca en las dos primeras líneas; música baja y clara respecto a las bandas de voz; decide después si silencias y recortas VO seco
- Apertura hype (Simple): tambores de estadio y energía apilada, firme sin gritar; prueba primero en 60–90 segundos
Expectativas beta: deriva de acento y pausas largas
El propio aviso de Suno: un acento británico puede derivar hacia australiano y volver; las pausas dramáticas pueden ser muy dramáticas. Es comportamiento beta, no un prompt fallido. Mitigaciones: regenera el mismo guion varias veces; coloca nombres propios críticos al inicio o al final de frases cortas; escucha la toma entera antes de uso comercial — no solo los primeros quince segundos.
- Acento inestable: acorta frases, baja variedad o retoca género/estilo
- Pausas demasiado largas: quita puntos suspensivos y guiones apilados que fuerzan suspense
- Música sobre el habla: silencia y repite, o pide música bajo voz / banda escasa
- Necesitas estribillo cantado: sal de Speech; usa Create de canción y la guía de modelos v6
Speech vs modo canción vs locutor + cama
Mantén tres carriles claros. Speech: el modelo habla, con banda sonora opcional en la misma pista. Create de canción: melodía y letra cantada. Locutor + cama separados: grabas (o contratas) la voz y la acompañas con una intro de podcast o BGM corto — voz y música siguen editables por separado. Planes y cuotas siguen la guía Free vs Pro.
El alcance de funciones sigue las entradas oficiales de Suno. Este sitio es un explicador independiente, no asesoramiento legal ni documentación oficial.
Leer el anuncio oficial de SpeechPrueba Suno Speech primero con un guion de 60 segundos — revisa acento y pausas antes de silenciar o conservar la cama.
Probar SpeechSuno AI Equipo
Editor de música IA · Suno AI y texto a música
Nuestro equipo editorial prueba Suno AI a diario: actualizaciones, técnicas de prompts y flujos de trabajo reales.
Artículos relacionados
¿Listo para comenzar tu viaje de creación musical con IA?
🚀 Empieza a crear ahora

