overview
¿Qué es SeedAudio 2.0?
SeedAudio 2.0 es una herramienta de generación de audio multimodal de IA desarrollada por el equipo Seed de ByteDance que permite a creadores, educadores, especialistas en marketing y equipos de producto generar escenas de audio completas a partir de diversas entradas. Integra diálogos, expresión emocional, música, ambiente y efectos de sonido en un proceso creativo unificado, soportando hasta seis minutos de audio por escena. SeedAudio 2.0 funciona como un espacio de trabajo de audio de IA basado en navegador que transforma direcciones escritas, audio de referencia o video en borradores de audio completos. Seed Audio 1.0 fue lanzado el 20 de julio de 2026, generando escenas de audio completas, incluyendo diálogos de múltiples personajes, efectos de sonido, ambiente y música en una sola pasada, típicamente alrededor de 2 minutos por generación en más de 20 idiomas. Seed TTS 2.0, un motor de texto a voz con contexto de tono con más de 200 voces, fue lanzado en octubre de 2025, junto con Seed-ICL 2.0 para la clonación de voz a partir de aproximadamente 5 segundos de audio. El blog oficial de SeedAudio 2.0, actualizado al 28 de julio de 2026, proporciona actualizaciones de productos y guías de indicaciones.
