OmniHuman API
$10.00
종량제 옵션
Pay-as-you-go access through PiAPI.
$10.00
종량제 옵션
Capabilities from the production model page.
Diffusion Transformer 기반 프레임워크로 다양한 입력을 결합해 사실적이고 몰입감 있는 인물 애니메이션을 생성합니다.
이미지, 오디오, 비디오 입력을 지원해 다양한 스타일과 포맷의 생성 작업에 유연하게 대응합니다.
립싱크 정확도와 자연스러운 제스처를 개선해 더 현실적인 동기화 영상을 생성합니다.
악기 연주나 물체 조작 등 사람-사물 상호작용을 자연스럽게 표현합니다.
입력 오디오와 일치하는 자연스러운 표정과 머리 움직임으로 사실감을 높입니다.
다양한 화면 비율과 인물 스타일을 지원해 근접샷부터 전신샷까지 폭넓게 대응합니다.
임의의 포즈에서도 디테일이 뛰어난 인물 중심 애니메이션을 생성할 수 있습니다.
동작 동기화와 표현력을 높여 자연스러운 노래/대화 영상을 제작합니다.
프리미엄 플랜 구독자는 생성된 영상을 합법적인 상업 용도로 사용할 수 있습니다.
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Use the API docs and the request example above to iterate on prompts and settings before wiring them into your product.
OmniHuman 은 ByteDance 가 개발한 인물 애니메이션 모델입니다. Diffusion Transformer를 기반으로 오디오, 포즈, 이미지, 비디오 입력에서 사실적인 결과를 생성합니다.
PiAPI의 OmniHuman API를 통해 개발자는 확장 가능한 추론 인프라에서 OmniHuman 기능을 쉽게 통합할 수 있습니다.
오디오 기반, 포즈 기반, 상호작용형, 스타일 인물, 스토리텔링 영상 등 다양한 유형을 생성할 수 있습니다.
이미지, 오디오, 비디오 및 오디오+비디오 결합 입력을 지원합니다.
콘텐츠 제작, 마케팅, 영상 제작, 개발 분야에서 가상 캐릭터, 광고, 설명 영상, 엔터테인먼트 제작에 활용됩니다.
More questions? See the API docs.