Nodos de Audio: Crea todo tu flujo de trabajo de audio en un solo Space

El audio siempre ha sido el paso más frustrante del proceso creativo. No porque las herramientas sean malas, sino porque están todas desperdigadas: el guión está en un doc, la locución se hace en una herramienta de síntesis, la música se saca de una plataforma de licencias y los efectos de sonido, de alguna carpeta perdida del escritorio. Para cuando tienes todo reunido, has usado cinco herramientas distintas y has perdido el hilo un par de veces por el camino.

Los nodos de audio de Spaces forman parte del propio flujo de trabajo. Soportan inputs, generan audio y lo pasan al siguiente nodo, todo sin salir de la herramienta.

Abrir Spaces

¿Qué son los nodos de audio en Spaces?

Hay tres nodos, Locución, Generar música y Efectos de sonido, que integran la generación de audio directamente en el canvas de Spaces. Funcionan con la misma lógica que el resto de nodos: reciben texto como input  o entrada, generan audio y se conectan a otros nodos, como Texto, Generar vídeo y Combinar vídeo.

Cuando el flujo de trabajo está fragmentado, cada variación se cobra su precio: otro export, otro import, otra mezcla manual. En Spaces, ese problema se resuelve en segundos: actualizas el prompt, vuelves a ejecutar y el flujo se encarga del resto.

Descubre los tres nodos de audio disponibles

  • Locución convierte texto en narración natural con cientos de voces disponibles, con la tecnología de ElevenLabs y Google. Te da la opción de controlar la velocidad, la estabilidad y la similitud de voz y genera hasta 10 resultados por ejecución, para que puedas quedarte con el que mejor encaje.
  • Generar música crea composiciones originales a partir de un prompt a través de los motores Google Lyria y ElevenLabs Music. Genera hasta 30 segundos de audio y hasta 10 variaciones por ejecución, sin preocuparte por licencias ni derechos de autor.
  • Efectos de sonido genera cualquier efecto a partir de una descripción en texto, con control sobre la duración, el modo bucle para sonidos ambientales continuos y el Prompt Influence, que determina con qué literalidad interpreta el modelo tus instrucciones.

Qué puedes hacer con los nodos de audio

  1. Escribe el prompt directamente dentro del nodo

La forma más directa de empezar: abres el nodo, escribes tu descripción o guión y generas, sin nodos intermedios ni pasos de más. Cada nodo tiene su propio input: un guión para la Locución, una descripción musical para el Generador de música, y una descripción del sonido para los Efectos de sonido.

  1. Lanza varios prompts y obtén un set de audios de una sola vez

En lugar de conectar un texto fijo al nodo, puedes conectar una lista de prompts para que el nodo los procese todos en una sola ejecución. Si tienes 8 escenas que necesitan efectos distintos, describe las 8 en nodo Lista para que las genere de una sentada. Lo mismo con la música: descripciones de escena producen 3 pistas a la vez, sin pasos intermedios.

  1. Deja que el Asistente te ayude con el prompt

A diferencia de caja de prompts normal, el nodo Asistente es un modelo de lenguaje que entiende el contexto. Le das una referencia (una imagen, un vídeo, un archivo de audio o un texto) y él lo analiza, lo interpreta y genera el prompt ideal para el nodo de audio siguiente. Así no tendrás que escribir nada a mano ni andar saltando entre herramientas.

Para el nodo Locución, el Asistente puede redactar el guión a partir de un briefing o de una imagen de producto. Para el nodo Generar música, puede describir el ambiente en términos musicales precisos a partir del vídeo que le pases. Para el nodo Efectos de sonido, puede traducir una escena, visual o sonora, en una descripción técnica del sonido. Y cuando necesites generar a escala, el Asistente puede hacer una lista de prompts. Así obtendrás múltiples pistas de audio.

  1. Usa un audio de referencia para generar variaciones

Si tienes un audio de referencia que captura exactamente el ambiente que buscas, o un efecto que quieres replicar con variaciones, puedes conectarlo directamente al Asistente y pedirle que analice y describa su estilo. Esa descripción pasa al nodo generador, donde la IA interpreta el sonido, lo traduce al lenguaje natural y produce un audio nuevo: distinto del original, pero coherente con él.

  1. Combina tu audio y tus clips en un vídeo terminado

El nodo Combinador de vídeo toma uno o varios clips y una pista de audio y los ensambla en un vídeo terminado: une los clips en secuencia según el orden que prefieras y coloca el audio encima en una sola ejecución. Piénsalo como el paso final: metes todo lo que has generado previamente (clips, música, locución) y obtienes un vídeo totalmente terminado.

Los mejores casos de uso

Estos nodos encajan de forma natural en todo tipo de producciones. Estos son los casos donde mejor funcionan:

  • Localización de anuncios a escala: genera todas las versiones de una locución en distintos idiomas en un solo lote, manteniendo la misma estructura de guión en todos los outputs.
  • Música original para contenido de marca: crea pistas de música de fondo personalizadas para demos de producto, anuncios en redes y vídeos de campaña, sin pagar licencias ni tirar de bibliotecas de stock.
  • Diseño sonoro por escena: produce efectos a medida para cada momento de un cortometraje, un vídeo de producto o un tutorial, todo desde un único nodo Lista conectado a Efectos de sonido.
  • Vídeos explicativos con locución: convierte un briefing de producto o una landing page en un vídeo narrado pasando el texto a un nodo de Locución y conectando la salida directamente al Combinador de vídeo.
  • Variaciones de audio para A/B testing: genera variaciones en una sola ejecución y comprueba qué versión funciona mejor antes de comprometerte con el montaje final.
  • Contenido formativo y educativo en varios idiomas: produce la misma narración en distintos idiomas y acentos sin necesidad de grabar nada de nuevo.

Si combinas los nodos de audio con el Asistente y un nodo Lista, el alcance se multiplica: un solo flujo de trabajo puede gestionar una serie de contenidos entera en una única ejecución: guiones distintos, ambientes distintos y formatos distintos.

Cómo usar los nodos de audio en Spaces

El prompt es el briefing creativo del modelo. Cuanto más concreto seas, más se acercará el resultado a lo que tienes en mente. Esto es lo que funciona en cada nodo.

  • Para el nodo Locución con ElevenLabs, el modelo v3 responde a etiquetas de audio y puntuación, no solo a descripciones. Usa etiquetas como [urgent], [whispers] o [dramatic] para dar forma al tono, y [breathing] o [laughing] para que la locución suene humana en lugar de aséptica de estudio. Los puntos suspensivos (…) crean pausas naturales y tensión, mientras que un punto fuerza una caída de entonación, útil para líneas informativas o serias. También puedes insertar pausas exactas directamente en el guión: escribir (pause 1.5) genera una pausa real de esa duración en la locución. Evita pasarte con los signos de exclamación, porque pueden empujar al modelo hacia una lectura excesivamente efusiva.

«[urgent] The window closes in three days. Don’t miss it… [flatly] Terms and conditions apply.»

  • Para el nodo de Locución con Google, describe la situación, no solo el tipo de voz. La síntesis de Google responde bien al contexto narrativo y a las instrucciones de estilo directo.

«A racing driver speaking through a low-fidelity intercom, engine noise in the background, slightly breathless. Informative tone, no dramatic inflection.»

  • Para el nodo Generar música con Google Lyria, sé explícito con el género, el tempo, los instrumentos y la función emocional que debe cumplir la pista en tu proyecto.

«Cinematic synthwave, 110 BPM, dark atmosphere, heavy bass and distorted synthesizers, driving rhythm for an action sequence.»

  • Para el nodo Efectos de sonido, especifica si necesitas una textura en bucle o un evento puntual, e incluye siempre la duración. El modelo responde de forma muy distinta según si estás construyendo una capa de fondo o un momento preciso.

«Busy city street ambiance, mid-morning, distant traffic, occasional footsteps on pavement, light wind. Loop-friendly.»

Por qué los nodos de audio hacen Spaces más potente

La mayoría de las herramientas de IA te dan un resultado cada vez. Los nodos de audio de Spaces te permiten construir algo distinto: un sistema en el que el guión, la locución, la música y los efectos conviven en el mismo canvas, conectados y listos para ejecutarse juntos.

El nodo Asistente añade otra capa: dale varias referencias al mismo tiempo (una imagen de producto, una pista de referencia, un briefing) y construye el prompt a partir de todo ello en conjunto, no desde un solo input de forma aislada. Cuanto más contexto metas en el flujo, más afinado será el resultado.

Cuando un compañero abre el Space, no solo ve el vídeo final. Ve cada prompt, cada conexión, cada decisión. El flujo habla por sí solo, no hay nada que explicar ni nada que se quede por el camino.

Empieza por lo sencillo: añade un nodo de Locución a tu Space y escribe tu guión. Las demás conexiones irán surgiendo solas.

Empieza a crear con audio en Spaces

https://freepik.coolkeypoint.com/
0
Used Today
20
Remaining
20 / 20 left today