Seed Audio 1.0 — 한 번의 생성으로 풀씬 AI 오디오풀씬 오디오

SeedDance의 ByteDance Seed 풀씬 오디오 모델. 단일 프롬프트로 다중 캐릭터 대화, 감정 표현, 앰비언스, 효과음을 편성——생성당 최대 약 2분의 오디오.

SeedDance 플랫폼에서 이용 가능

Seed Audio 1.0 개요

Seed Audio 1.0이란

Seed Audio 1.0은 ByteDance Seed 팀의 멀티모달 오디오 제작 모델입니다. 단일 보이스 트랙을 출력하는 기존 텍스트 음성 변환과 달리, 대화와 그 주변의 음향 세계를 포함한 완전한 사운드 장면을 생성합니다. SeedDance에서는 텍스트 프롬프트(최대 1,500자)로 만들고, 선택적으로 최대 3개의 레퍼런스 오디오 또는 1장의 레퍼런스 이미지를 조건화해 최대 약 2분 출력이 가능합니다.

텍스트 음성 변환을 넘어

기존 TTS는 텍스트를 하나의 목소리로 바꿉니다. Seed Audio 1.0은 대화, 앰비언스, 효과음, 장면 질감이 겹친 전체 사운드스케이프를 목표로 합니다. 자연어로 장면을 설명하고 여러 도구를 이어 붙이는 대신 들을 수 있는 믹스를 얻습니다.

레퍼런스 오디오 또는 이미지

최대 3개의 레퍼런스 클립을 업로드하고 프롬프트에서 @Audio1, @Audio2, @Audio3로 태그해 보이스 스타일을 안내하세요. 오디오 레퍼런스를 쓰지 않을 때는 무드용 레퍼런스 이미지 1장을 사용할 수 있습니다——같은 생성에서 이미지와 오디오 레퍼런스는 함께 쓸 수 없습니다.

다중 역할 대화와 감정

각각 음색과 감정 아크가 다른 화자의 대화를 생성합니다. 여러 성우를 녹음하지 않고 스크립트 팟캐스트, 교육 시나리오, 캐릭터 중심 스토리텔링에 유용합니다.

앰비언스와 SFX를 한 번에

환경 앰비언스와 동작에 맞는 효과음을 공유 장면 맥락에서 말과 함께 생성——프로토타입과 숏폼을 위한 별도 SFX 찾기와 러프 믹스를 줄입니다.

SeedDance에서 Seed Audio 1.0으로 할 수 있는 일

SeedDance AI 오디오 생성기에서 사용할 수 있는 기능——프롬프트, 레퍼런스, 출력 길이에 대한 명확한 한도.

하나의 장면 설명 아래 대화, 앰비언스, 사운드 큐를 조율합니다. 심야 편의점 라디오 드라마에 속삭이는 대사, 형광등 허밍, 문 차임, 긴장 언더스코어를 단일 지시로 포함——풀 스튜디오 스택 없이 빠른 초안.

하나의 프롬프트 하나의 믹스

Seed Audio 1.0용 SeedDance 기능 세트

SeedDance AI 오디오 생성기에서 Seed Audio 1.0용으로 제공되는 기능.

텍스트 투 오디오 장면 생성

자연어로 캐릭터, 설정, 무드, 페이싱을 설명(최대 1,500자). 모델은 평평한 나레이션이 아니라 완전한 오디오 장면을 렌더링합니다.

레퍼런스 오디오 조건화

최대 3개의 레퍼런스 클립(보통 각 최대 30초·10MB)을 업로드하고 @Audio1, @Audio2, @Audio3로 보이스 스타일과 캐릭터 캐스팅에 참조합니다.

선택적 이미지 레퍼런스

오디오 레퍼런스를 쓰지 않을 때 무드에 영향을 줄 단일 레퍼런스 이미지(JPEG, PNG 또는 WebP)를 제공합니다. 이미지와 오디오 레퍼런스는 상호 배타적입니다.

다중 캐릭터 대화

스크립트 대화, 인터뷰, 서사 교환을 위해 한 번의 생성에서 여러 화자에게 서로 다른 보이스를 할당합니다.

앰비언스와 환경 FX

대화와 함께 앰비언트 사운드 디자인을 생성——비, 발소리, 도시 소음, 기계 허밍 등 프롬프트에 기술한 장면 레이어.

프롬프트 수준 대화 타이밍

프롬프트에서 대사가 들어올 시점을 지정합니다. 캐릭터 대화의 공식 타이밍 제어는 약 100ms 간격——더빙과 시간 지정 스크립트에 유용합니다.

다국어 장면 오디오

중국어, 영어, 일본어, 한국어, 스페인어 등 공식 20개 이상 언어로 표현력 있는 장면 오디오를 생성——로컬라이즈 초안에 유용합니다.

최대 약 2분 출력

SeedDance 한 번의 생성에서 최대 약 2분의 오디오——팟캐스트 인트로, 광고 스팟, 짧은 드라마 장면에 충분합니다.

자주 묻는 질문

SeedDance의 Seed Audio 1.0에 대해 알아야 할 모든 것.









SeedDance에서 Seed Audio 1.0으로 만들기 시작

풀씬 AI 오디오를 시도하세요——텍스트와 선택적 레퍼런스로 다중 캐릭터 대화, 앰비언스, 효과음을, 생성당 최대 약 2분.