overview
Что такое SeedAudio 2.0?
SeedAudio 2.0 — это мультимодальный инструмент для генерации аудио с помощью ИИ, разработанный командой Seed компании ByteDance, который позволяет создателям, преподавателям, маркетологам и продуктовым командам генерировать комплексные аудиосцены из различных входных данных. Он объединяет диалоги, эмоциональное выражение, музыку, атмосферу и звуковые эффекты в единый творческий процесс, поддерживая до шести минут аудио на сцену. SeedAudio 2.0 функционирует как браузерная рабочая область ИИ для аудио, которая преобразует письменные указания, эталонное аудио или видео в полные аудиочерновики. Seed Audio 1.0 был запущен 20 июля 2026 года, генерируя полные аудиосцены, включая диалоги с несколькими персонажами, звуковые эффекты, атмосферу и музыку за один проход, обычно около 2 минут на генерацию на более чем 20 языках. Seed TTS 2.0, движок преобразования текста в речь с учетом тона и более чем 200 голосами, был выпущен в октябре 2025 года, наряду с Seed-ICL 2.0 для клонирования голоса из примерно 5 секунд аудио. Официальный блог SeedAudio 2.0, обновленный 28 июля 2026 года, содержит обновления продукта и руководства по запросам.
