txt2audio base1.35 min
$0.02
Buat lagu lengkap berkualitas profesional dalam hitungan detik! DiffRhythm adalah model difusi laten open source pertama di dunia yang menghasilkan trek vokal dan instrumental penuh dari prompt teks sederhana. Jelaskan visi Anda dan biarkan DiffRhythm menangani ritme, melodi, dan lirik.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Hasilkan lagu lengkap hingga 4 menit 45 detik dalam satu langkah - tanpa menggabungkan klip pendek atau alur kerja multi-tahap.
Jelaskan suasana hati, genre, atau citra (mis. "Suasana Klub Jazz Malam" atau "Balada Folk Indie dengan Harmonika Akustik") untuk membentuk komposisi unik.
Struktur panggilan API asinkron kami memungkinkan developer mengirim tugas dan program mereka terus berjalan hingga fungsi "callback" dieksekusi.
Buat lanskap suara dari prompt liar seperti "Badai Theremin Arktik" - sempurna untuk skor film, soundtrack game, atau musik eksperimental.
Fokus pada penceritaan liris dengan trek vokal mandiri, ideal untuk menyempurnakan lirik atau proyek acapella.
Hasilkan lagu dalam bahasa Inggris atau Mandarin dengan mulus, dengan frasa vokal yang terdengar alami di kedua bahasa.
Nikmati performa stabil bahkan di bawah beban paling berat - layanan kami dapat secara otomatis menyesuaikan skala sesuai beban puncak yang bervariasi, memproses banyak pekerjaan secara bersamaan sambil menjaga latensi seminimal mungkin!
Manfaatkan arsitektur non-autoregresif untuk membuat lagu 100x lebih cepat dari alternatif berbasis model bahasa.
Lisensi Apache 2.0 memungkinkan penggunaan komersial, kustomisasi, dan integrasi ke alat kreatif atau aplikasi Anda.
Sesuaikan durasi lagu secara langsung, dari jingle 30 detik hingga komposisi 10 menit (segera hadir!).
Perluas trek yang ada atau campurkan gaya dengan memperpanjang lagu yang dihasilkan AI dengan bagian baru (segera hadir!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm adalah model difusi laten open-source pertama yang dikembangkan oleh ASLP Lab, dirancang khusus untuk generasi lagu penuh end-to-end. Model ini membuat trek lengkap (hingga 285 detik) dengan vokal dan iringan instrumental dalam hitungan detik, hanya menggunakan prompt teks seperti lirik dan deskripsi gaya. Berbeda dengan sistem multi-tahap tradisional, ini menggabungkan kesederhanaan, kecepatan, dan skalabilitas - membuat pembuatan musik bertenaga AI dapat diakses oleh semua orang.
DiffRhythm API dibuat oleh dan memungkinkan developer mengintegrasikan teknologi generasi lagu kami langsung ke aplikasi, alat, atau alur kerja. API ini menyediakan akses programatis ke kemampuan model, memungkinkan fitur seperti generasi massal, kustomisasi real-time, dan skalabilitas mulus untuk penggunaan komersial. Baik Anda membangun aplikasi produksi musik, mesin soundtrack game, atau platform AI kreatif, API menangani tugas komputasi berat sementara Anda fokus pada pengalaman pengguna.
DiffRhythm API mendukung hampir semua genre atau gaya yang dijelaskan dalam prompt Anda! Apakah Anda membutuhkan pop, jazz, elektronik, folk, skor sinematik, atau lanskap suara eksperimental, API ini beradaptasi dengan visi kreatif Anda.
Untuk opsi "Pay-as-you-go" kami, biayanya $0.02 untuk setiap panggilan generasi baik untuk txt2audio dasar (1.35 menit) maupun txt2audio penuh (4.45 menit).
Ya, paket langganan berbeda (Gratis, Creator, atau Pro Plan) akan memberikan pengguna "Pay-as-you-go" jumlah pekerjaan bersamaan yang berbeda, silakan lihat halaman harga kami untuk detailnya.
Ya! Lisensi Apache 2.0 mengizinkan penggunaan komersial, tetapi Anda harus memverifikasi orisinalitas dan mengungkapkan keterlibatan AI!
Hanya lirik (opsional) dan prompt gaya. Tidak perlu referensi instrumental atau template melodi!
Workspace kami telah mengintegrasikan Stripe dalam sistem pembayaran kami, yang akan memungkinkan pembayaran dari sebagian besar penyedia kartu kredit utama.
Tidak, kami tidak menawarkan pengembalian dana. Tetapi saat Anda pertama kali mendaftar akun di Workspace PiAPI, Anda diberikan kredit gratis untuk mencoba DiffRhythm kami (khususnya layanan "Pay-as-you-go") sebelum melakukan pembayaran!
Silakan email kami di - kami senang mendengar umpan balik Anda dan mengeksplorasi kolaborasi potensial!
More questions? See the API docs.
DiffRhythm API