overview
Was ist SeedAudio 2.0?
SeedAudio 2.0 ist ein multimodales KI-Audiogenerierungstool, das vom Seed-Team von ByteDance entwickelt wurde und es Kreativen, Pädagogen, Marketern und Produktteams ermöglicht, umfassende Audioszenen aus verschiedenen Eingaben zu generieren. Es integriert Dialoge, emotionalen Ausdruck, Musik, Ambiente und Soundeffekte in einen einheitlichen kreativen Prozess und unterstützt bis zu sechs Minuten Audio pro Szene. SeedAudio 2.0 fungiert als browserbasierter KI-Audio-Arbeitsbereich, der schriftliche Anweisungen, Referenz-Audio oder -Video in vollständige Audioentwürfe umwandelt. Seed Audio 1.0 wurde am 20. Juli 2026 eingeführt und generierte komplette Audioszenen, einschließlich Dialoge mit mehreren Charakteren, Soundeffekte, Ambiente und Musik in einem einzigen Durchgang, typischerweise etwa 2 Minuten pro Generierung in mehr als 20 Sprachen. Seed TTS 2.0, eine Text-to-Speech-Engine mit Tonkontext und über 200 Stimmen, wurde im Oktober 2025 veröffentlicht, zusammen mit Seed-ICL 2.0 für die Stimmklonung aus etwa 5 Sekunden Audio. Der offizielle SeedAudio 2.0 Blog, aktualisiert am 28. Juli 2026, bietet Produktaktualisierungen und Prompting-Anleitungen.
