Seedance 2.0
ByteDance의 전체 Seedance 2.0 비디오 모델로, 프롬프트만 사용하는 생성, 프레임 기반 애니메이션, 멀티모달 참조 생성을 명시적으로 지원합니다. Rivya는 프레임 입력과 멀티모달 참조가 하나의 모호한 업로드 묶음으로 합쳐지지 않고 서로 배타적으로 유지되도록 문서화된 역할 분리를 명확히 유지합니다.
고려할 이유
다음 작업에 프롬프트, 프레임 또는 이미지/비디오/오디오 참조이 필요할 때 고려하세요.
완성된 음성 트랙을 바탕으로 사람, 반려동물 또는 일러스트 캐릭터가 연기하고 소스 인물을 시각적 기준으로 유지해야 할 때 OmniHuman 1.5를 사용하세요. 이 페이지에서는 인물 식별, 피사체 감지 및 마스크 기반 선택을 사용할 수 없습니다.
예시 출력
OmniHuman 1.5
이미지와 오디오로 비디오 생성
예시 출력
OmniHuman 1.5
적합한 작업
지원 항목
온라인 체험
결과
완성된 음성 트랙을 바탕으로 사람, 반려동물 또는 일러스트 캐릭터가 연기하고 소스 인물을 시각적 기준으로 유지해야 할 때 OmniHuman 1.5를 사용하세요. 이 페이지에서는 인물 식별, 피사체 감지 및 마스크 기반 선택을 사용할 수 없습니다.
아직 결과가 없습니다. 프롬프트를 제출해 실행을 시작하세요.
결정 적합도
결정 적합도
OmniHuman 1.5 FAQ
OmniHuman 1.5는 한 장의 인물 이미지가 피사체를 제공하고 하나의 음성 트랙이 결과 연기를 이끄는 집중된 이미지·오디오 워크플로용으로 설계되었습니다. 일반적인 프롬프트-비디오 작업보다 발표자 클립, 캐릭터 내레이션, 짧은 말하는 피사체 비디오에 더 적합합니다.
최대 10MB인 JPEG, PNG 또는 WebP 이미지 정확히 한 장과 최대 10MB인 MP3, M4A, WAV, AAC 또는 OGG 오디오 파일 한 개를 업로드하세요. 검증된 오디오 길이는 0초보다 길고 60초보다 짧아야 합니다.
Rivya는 검증된 오디오 1초당 27크레딧의 요율을 사용합니다. 소수 길이는 전체 계산에 그대로 반영되고 예약 총액만 정수 크레딧으로 올림됩니다. 보고된 실제 사용량이 유효하고 예약량 이하인 경우에만 해당 실제 사용량으로 정산합니다. 실제 사용량이 누락되었거나 유효하지 않거나 예약량보다 많으면 숨겨진 추가 차감 없이 대조 조정 상태로 전환됩니다.
대안 비교
ByteDance의 전체 Seedance 2.0 비디오 모델로, 프롬프트만 사용하는 생성, 프레임 기반 애니메이션, 멀티모달 참조 생성을 명시적으로 지원합니다. Rivya는 프레임 입력과 멀티모달 참조가 하나의 모호한 업로드 묶음으로 합쳐지지 않고 서로 배타적으로 유지되도록 문서화된 역할 분리를 명확히 유지합니다.
고려할 이유
다음 작업에 프롬프트, 프레임 또는 이미지/비디오/오디오 참조이 필요할 때 고려하세요.
ByteDance의 더 빠른 Seedance 2.0 비디오 모델로, 프롬프트 생성, 프레임 기반 이미지 애니메이션과 멀티모달 참조 비디오를 지원합니다. Rivya에서는 첫·마지막 프레임 입력과 참조 이미지, 비디오, 오디오의 역할을 명확히 구분합니다.
고려할 이유
가장 잘 맞는 작업
작업이 이런 모습일 때 사용하세요
핵심 사실
제공업체
ByteDance
카테고리
비디오
기능
이미지와 오디오로 비디오 생성
크레딧 모델
per_input_second · default=27 · ⌈total⌉
입력 경로
이미지 1개 + 오디오 1개
프롬프트 설정
최대 300자
고속 모드는 품질이 낮아질 수 있는 대신 처리 시간을 단축하는 데 우선순위를 둡니다. 품질을 우선하는 작업에서는 끄고, 초기 테스트에서 빠른 결과가 더 중요할 때 켜세요.
예. 단, 프롬프트는 선택 사항이며 Rivya에서 최대 300자로 제한됩니다. 현재 프롬프트 입력은 중국어, 영어, 일본어, 한국어, 스페인어 또는 인도네시아어로 작성된 텍스트만 지원하며, 인물 이미지와 오디오는 필수 입력으로 유지됩니다.
인물 이미지 정확히 한 장과 오디오 클립 한 개로 오디오 기반 캐릭터 비디오를 만드세요. 피사체는 사람, 반려동물 또는 일러스트 캐릭터일 수 있으며 720p 또는 1080p로 출력할 수 있습니다.
유지하려는 피사체를 이미 잘 보여 주는 선명한 인물 이미지를 선택한 다음 최종 음성 녹음을 준비하세요. 오디오는 60초보다 짧아야 하며 두 파일 모두 생성 전에 업로드 검사를 통과해야 합니다.
720p 또는 1080p를 선택하고 고속 처리 옵션을 사용할지 결정하세요. 더 반복 가능한 비교가 필요하지 않다면 시드는 무작위 결과를 위한 -1로 두세요.
상세 정보는 공개되어 있지만 업로드와 생성에는 로그인이 필요합니다. OmniHuman 1.5는 검증된 오디오 1초당 27크레딧이며 마지막 계산 총액만 올림합니다.
인물 이미지 한 장과 음성 트랙 한 개를 시험할 때는 이 페이지를 이용하세요. 저장된 테이크, 여러 캐릭터, 반복되는 음성 버전 또는 더 긴 제작 워크플로가 필요하면 Studio를 여세요.
다음 작업에 프롬프트, 프레임 또는 이미지/비디오/오디오 참조이 필요할 때 고려하세요.
텍스트-비디오와 이미지-비디오를 위한 Seedance 모델로 네이티브 오디오-비주얼 동기화를 제공합니다. 480p-1080p, 4-12초 클립, 6가지 화면비, 동적 또는 고정 렌즈 제어, 선택적 오디오 생성과 립싱크를 지원합니다.
고려할 이유
다음 작업에 프롬프트 + 선택적 이미지이 필요할 때 고려하세요.