overview
O que é SeedAudio 2.0?
SeedAudio 2.0 é uma ferramenta de geração de áudio multimodal de IA desenvolvida pela equipe Seed da ByteDance que permite a criadores, educadores, profissionais de marketing e equipes de produto gerar cenas de áudio abrangentes a partir de várias entradas. Ele integra diálogo, expressão emocional, música, ambiente e efeitos sonoros em um processo criativo unificado, suportando até seis minutos de áudio por cena. SeedAudio 2.0 funciona como um espaço de trabalho de áudio de IA baseado em navegador que transforma direções escritas, áudio de referência ou vídeo em rascunhos de áudio completos. Seed Audio 1.0 foi lançado em 20 de julho de 2026, gerando cenas de áudio completas, incluindo diálogo multi-personagem, efeitos sonoros, ambiente e música em uma única passagem, tipicamente cerca de 2 minutos por geração em mais de 20 idiomas. Seed TTS 2.0, um motor de texto para fala com contexto de tom com mais de 200 vozes, foi lançado em outubro de 2025, juntamente com Seed-ICL 2.0 para clonagem de voz a partir de aproximadamente 5 segundos de áudio. O blog oficial do SeedAudio 2.0, atualizado em 28 de julho de 2026, fornece atualizações de produtos e guias de prompt.
