overview
SeedAudio 2.0이란 무엇인가요?
SeedAudio 2.0은 ByteDance의 Seed 팀이 개발한 멀티모달 AI 오디오 생성 도구로, 크리에이터, 교육자, 마케터 및 제품 팀이 다양한 입력으로부터 포괄적인 오디오 장면을 생성할 수 있도록 합니다. 대화, 감정 표현, 음악, 분위기 및 음향 효과를 통합된 창작 프로세스에 통합하며, 장면당 최대 6분 길이의 오디오를 지원합니다. SeedAudio 2.0은 브라우저 기반 AI 오디오 작업 공간으로, 작성된 지시, 참조 오디오 또는 비디오를 완전한 오디오 초안으로 변환합니다. Seed Audio 1.0은 2026년 7월 20일에 출시되었으며, 다중 캐릭터 대화, 음향 효과, 분위기 및 음악을 포함한 완전한 오디오 장면을 한 번에 생성했으며, 일반적으로 20개 이상의 언어에서 생성당 약 2분 길이였습니다. 200개 이상의 음성을 가진 톤-컨텍스트 텍스트-음성 엔진인 Seed TTS 2.0은 2025년 10월에 약 5초 길이의 오디오에서 음성 복제를 위한 Seed-ICL 2.0과 함께 출시되었습니다. 2026년 7월 28일 업데이트된 공식 SeedAudio 2.0 블로그는 제품 업데이트 및 프롬프트 가이드를 제공합니다.
