txt2audio base1.35 min
$0.02
몇 초 만에 완전한 프로 품질의 노래를 만드세요! DiffRhythm은 간단한 텍스트 프롬프트에서 전체 보컬 및 악기 트랙을 생성하는 세계 최초의 오픈 소스 잠재 확산 모델입니다. 당신의 비전을 설명하면 DiffRhythm이 리듬, 멜로디, 가사를 처리합니다.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
한 번에 4분 45초까지 완전한 노래 생성 - 짧은 클립 연결이나 다단계 워크플로우 불필요.
분위기, 장르, 이미지를 설명하여(예: "재지한 나이트클럽 분위기" 또는 "어쿠스틱 하모니카가 있는 인디 포크 발라드") 독특한 작품을 만드세요.
비동기 API 호출 구조를 통해 개발자는 작업을 제출하고 "콜백" 함수가 실행될 때까지 프로그램을 계속 실행할 수 있습니다.
"북극 테레민 폭풍"과 같은 창의적인 프롬프트에서 사운드스케이프 제작 - 영화 음악, 게임 사운드트랙 또는 실험 음악에 완벽합니다.
독립 보컬 트랙으로 가사 스토리텔링에 집중 - 가사 다듬기나 아카펠라 프로젝트에 이상적입니다.
영어 또는 중국어로 노래를 원활하게 생성하며, 두 언어 모두에서 자연스러운 보컬 프레이징을 구현합니다.
가장 까다로운 부하에서도 안정적인 성능을 경험하세요 - 서비스는 변화하는 피크 부하에 따라 자동으로 확장되며, 지연 시간을 최소화하면서 많은 수의 작업을 동시에 처리합니다!
비자기회귀 아키텍처를 활용하여 언어 모델 기반 대안보다 100배 빠르게 노래를 생성합니다.
Apache 2.0 라이선스로 상업적 사용, 커스터마이징, 창작 도구 또는 앱 통합이 가능합니다.
30초 징글부터 10분 확장 작품까지 노래 길이를 즉석에서 조절(곧 출시!).
AI 생성 노래에 새 섹션을 추가하여 기존 트랙을 확장하거나 스타일을 블렌딩(곧 출시!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm은 ASLP Lab에서 개발한 최초의 오픈소스 잠재 확산 모델로, 엔드투엔드 풀 렝스 노래 생성을 위해 특별히 설계되었습니다. 가사와 스타일 설명 같은 텍스트 프롬프트만 사용하여 보컬과 악기 반주가 포함된 완전한 트랙(최대 285초)을 몇 초 만에 생성합니다. 기존의 다단계 시스템과 달리 단순성, 속도, 확장성을 결합하여 AI 기반 음악 제작을 모든 사람이 이용할 수 있게 합니다.
DiffRhythm API는 에서 만들었으며 개발자가 노래 생성 기술을 앱, 도구 또는 워크플로우에 직접 통합할 수 있게 합니다. 모델 기능에 대한 프로그래밍 방식의 액세스를 제공하여 대량 생성, 실시간 커스터마이징, 상업적 사용을 위한 원활한 확장 등의 기능을 구현합니다. 음악 제작 앱, 게임 사운드트랙 엔진, 창작 AI 플랫폼을 구축하든 API가 컴퓨팅 집약적인 작업을 처리하고 사용자 경험에 집중할 수 있습니다.
DiffRhythm API는 프롬프트에 설명된 거의 모든 장르나 스타일을 지원합니다! 팝, 재즈, 일렉트로닉, 포크, 영화 음악, 실험적 사운드스케이프 등 창작 비전에 맞게 적응합니다.
"종량제" 옵션의 경우 txt2audio 베이직(1.35분)과 txt2audio 풀(4.45분) 모두 각 생성 호출당 $0.02입니다.
예, 다른 구독 플랜(무료, Creator 또는 Pro 플랜)은 "종량제" 사용자에게 다른 수의 동시 작업을 부여합니다. 자세한 내용은 가격 페이지를 참조하세요.
예! Apache 2.0 라이선스는 상업적 사용을 허용하지만, 독창성을 확인하고 AI 참여를 공개해야 합니다!
가사(선택 사항)와 스타일 프롬프트만 있으면 됩니다. 악기 참조나 멜로디 템플릿은 필요 없습니다!
워크스페이스에 결제 시스템으로 Stripe를 통합하여 대부분의 주요 신용카드 제공업체에서 결제가 가능합니다.
아니요, 환불은 제공하지 않습니다. 하지만 PiAPI 워크스페이스에 처음 가입하면 결제 전에 DiffRhythm(특히 "종량제" 서비스)을 체험할 수 있는 무료 크레딧이 제공됩니다!
이메일로 연락해 주세요: - 피드백을 듣고 잠재적인 협업을 탐색하고 싶습니다!
More questions? See the API docs.
DiffRhythm API