overview
Qu'est-ce que SeedAudio 2.0 ?
SeedAudio 2.0 est un outil de génération audio IA multimodal développé par l'équipe Seed de ByteDance qui permet aux créateurs, éducateurs, spécialistes du marketing et équipes produit de générer des scènes audio complètes à partir de diverses entrées. Il intègre le dialogue, l'expression émotionnelle, la musique, l'ambiance et les effets sonores dans un processus créatif unifié, prenant en charge jusqu'à six minutes d'audio par scène. SeedAudio 2.0 fonctionne comme un espace de travail audio IA basé sur un navigateur qui transforme les instructions écrites, l'audio de référence ou la vidéo en ébauches audio complètes. Seed Audio 1.0 a été lancé le 20 juillet 2026, générant des scènes audio complètes, y compris des dialogues multi-personnages, des effets sonores, une ambiance et de la musique en une seule passe, généralement environ 2 minutes par génération dans plus de 20 langues. Seed TTS 2.0, un moteur de synthèse vocale text-to-speech sensible au contexte tonal avec plus de 200 voix, a été lancé en octobre 2025, aux côtés de Seed-ICL 2.0 pour le clonage vocal à partir d'environ 5 secondes d'audio. Le blog officiel de SeedAudio 2.0, mis à jour le 28 juillet 2026, fournit des mises à jour de produits et des guides d'incitation.
