txt2audio base1.35 min
$0.02
सेकंडों में पूर्ण, पेशेवर-गुणवत्ता वाले गाने बनाएं! DiffRhythm दुनिया का पहला ओपन सोर्स लेटेंट डिफ्यूजन मॉडल है जो सरल टेक्स्ट प्रॉम्प्ट से पूर्ण वोकल और इंस्ट्रुमेंटल ट्रैक बनाता है। अपनी कल्पना का वर्णन करें और DiffRhythm को ताल, धुन और गीत संभालने दें।
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
एक ही चरण में 4 मिनट 45 सेकंड तक के पूर्ण गाने बनाएं - छोटी क्लिप जोड़ने या बहु-चरण वर्कफ़्लो की आवश्यकता नहीं।
अद्वितीय रचनाओं को आकार देने के लिए मूड, शैलियों या इमेजरी का वर्णन करें (जैसे "जैज़ी नाइटक्लब वाइब" या "एकॉस्टिक हारमोनिका के साथ इंडी फोक बैलाड")।
हमारी एसिंक्रोनस API कॉल संरचना डेवलपर्स को कार्य सबमिट करने और उनके प्रोग्राम को जारी रखने की अनुमति देती है जब तक कि "callback" फ़ंक्शन निष्पादित न हो जाए।
"आर्कटिक थेरेमिन स्टॉर्म्स" जैसे अनोखे प्रॉम्प्ट से साउंडस्केप बनाएं - फिल्म स्कोर, गेम साउंडट्रैक या प्रयोगात्मक संगीत के लिए बिल्कुल सही।
स्टैंडअलोन वोकल ट्रैक के साथ गीतात्मक कहानी कहने पर ध्यान केंद्रित करें, गीतों को परिष्कृत करने या एकापेला प्रोजेक्ट्स के लिए आदर्श।
दोनों भाषाओं में प्राकृतिक-ध्वनि वाली वोकल फ्रेजिंग के साथ अंग्रेजी या चीनी में निर्बाध रूप से गाने बनाएं।
सबसे मांग वाले लोड के तहत भी स्थिर प्रदर्शन का अनुभव करें - हमारी सेवा विभिन्न पीक लोड के अनुसार स्वचालित रूप से स्केल कर सकती है, लेटेंसी को न्यूनतम रखते हुए उच्च संख्या में जॉब्स को समवर्ती रूप से प्रोसेस कर सकती है!
भाषा मॉडल-आधारित विकल्पों की तुलना में 100 गुना तेज गाने बनाने के लिए नॉन-ऑटोरेग्रेसिव आर्किटेक्चर का लाभ उठाएं।
Apache 2.0 लाइसेंस वाणिज्यिक उपयोग, अनुकूलन और आपके रचनात्मक टूल्स या ऐप्स में एकीकरण की अनुमति देता है।
30-सेकंड जिंगल्स से लेकर विस्तारित 10-मिनट रचनाओं तक, गाने की अवधि को तुरंत समायोजित करें (जल्द आ रहा है!)।
AI-जनित गानों को नए अनुभागों के साथ विस्तारित करके मौजूदा ट्रैक का विस्तार करें या शैलियों को मिलाएं (जल्द आ रहा है!)।
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm पहला ओपन-सोर्स लेटेंट डिफ्यूजन मॉडल है जिसे ASLP Lab द्वारा विकसित किया गया है, विशेष रूप से एंड-टू-एंड पूर्ण-लंबाई गाना जनरेशन के लिए डिज़ाइन किया गया है। यह केवल गीत और शैली विवरण जैसे टेक्स्ट प्रॉम्प्ट का उपयोग करके सेकंडों में वोकल और इंस्ट्रुमेंटल संगत के साथ पूर्ण ट्रैक (285s तक) बनाता है। पारंपरिक बहु-चरण प्रणालियों के विपरीत, यह सरलता, गति और स्केलेबिलिटी को जोड़ता है - AI संचालित संगीत निर्माण को सभी के लिए सुलभ बनाता है।
DiffRhythm API बनाई गई है द्वारा और यह डेवलपर्स को हमारी गाना जनरेशन तकनीक को सीधे ऐप्स, टूल्स या वर्कफ़्लो में एकीकृत करने देती है। यह मॉडल की क्षमताओं तक प्रोग्रामेटिक एक्सेस प्रदान करती है, बल्क जनरेशन, रीयल-टाइम कस्टमाइज़ेशन और वाणिज्यिक उपयोग के लिए सीमलेस स्केलिंग जैसी सुविधाओं को सक्षम करती है। चाहे आप म्यूज़िक प्रोडक्शन ऐप, गेम साउंडट्रैक इंजन, या क्रिएटिव AI प्लेटफ़ॉर्म बना रहे हों, API कम्प्यूट-हेवी कार्यों को संभालती है जबकि आप उपयोगकर्ता अनुभव पर ध्यान केंद्रित करते हैं।
DiffRhythm API आपके प्रॉम्प्ट में वर्णित लगभग किसी भी शैली या स्टाइल का समर्थन करती है! चाहे आपको पॉप, जैज़, इलेक्ट्रॉनिक, फोक, सिनेमैटिक स्कोर या प्रयोगात्मक साउंडस्केप की आवश्यकता हो, यह आपकी रचनात्मक दृष्टि के अनुकूल होती है।
हमारे "पे-एज़-यू-गो" विकल्प के लिए, txt2audio बेस (1.35 मिनट) और txt2audio फुल (4.45 मिनट) दोनों के लिए प्रत्येक जनरेशन कॉल के लिए $0.02 का खर्च आता है।
हां, विभिन्न सब्सक्रिप्शन प्लान (फ्री, क्रिएटर, या प्रो प्लान) "पे-एज़-यू-गो" उपयोगकर्ताओं को समवर्ती जॉब्स की अलग-अलग संख्या प्रदान करेंगे, कृपया विवरण के लिए हमारा मूल्य निर्धारण देखें।
हां! Apache 2.0 लाइसेंस वाणिज्यिक उपयोग की अनुमति देता है, लेकिन आपको मौलिकता सत्यापित करनी होगी और AI भागीदारी का खुलासा करना होगा!
बस गीत (वैकल्पिक) और एक स्टाइल प्रॉम्प्ट। कोई इंस्ट्रुमेंटल रेफरेंस या मेलोडी टेम्पलेट की आवश्यकता नहीं!
हमारे वर्कस्पेस ने हमारे भुगतान प्रणाली में Stripe को एकीकृत किया है, जो अधिकांश प्रमुख क्रेडिट कार्ड प्रदाताओं से भुगतान की अनुमति देगा।
नहीं, हम रिफंड प्रदान नहीं करते हैं। लेकिन जब आप पहली बार PiAPI के वर्कस्पेस पर अकाउंट के लिए साइन अप करते हैं, तो आपको भुगतान करने से पहले हमारे DiffRhythm (विशेष रूप से "पे-एज़-यू-गो" सेवा) को आज़माने के लिए मुफ्त क्रेडिट मिलते हैं!
कृपया हमें ईमेल करें पर - हम आपकी प्रतिक्रिया सुनना और संभावित सहयोग का पता लगाना पसंद करेंगे!
More questions? See the API docs.
DiffRhythm API