txt2audio base1.35 min
$0.02
Maak complete, professionele nummers in seconden! DiffRhythm is het eerste open source latent diffusion model ter wereld dat volledige vocale en instrumentale tracks genereert uit eenvoudige tekstprompts. Beschrijf je visie en laat DiffRhythm het ritme, de melodie en de tekst verzorgen.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Genereer complete nummers tot 4 minuten 45 seconden in een enkele stap - zonder korte clips aan elkaar te plakken of meerstaps workflows.
Beschrijf sferen, genres of beelden (bijv. "Jazzy nachtclub sfeer" of "Indie folk ballade met akoestische mondharmonica") om unieke composities te vormen.
Onze asynchrone API-aanroepstructuur stelt ontwikkelaars in staat taken in te dienen en hun programma te laten doorgaan totdat een "callback" functie wordt uitgevoerd.
Creeer soundscapes uit wilde prompts zoals "Arctische Theremin stormen" - perfect voor filmmuziek, game soundtracks of experimentele muziek.
Focus op lyrische storytelling met zelfstandige vocale tracks, ideaal voor het verfijnen van teksten of a capella projecten.
Genereer naadloos nummers in het Engels of Chinees, met natuurlijk klinkende vocale frasering in beide talen.
Ervaar stabiele prestaties zelfs onder de zwaarste belasting - onze service kan automatisch schalen naar varierende piekbelastingen, waarbij veel taken gelijktijdig worden verwerkt terwijl de latentie minimaal blijft!
Benut de niet-autoregressieve architectuur om nummers 100x sneller te maken dan taalmodel-gebaseerde alternatieven.
De Apache 2.0 licentie staat commercieel gebruik, aanpassing en integratie in je creatieve tools of apps toe.
Pas de nummerlengte direct aan, van 30 seconden jingles tot uitgebreide 10 minuten composities (binnenkort beschikbaar!).
Breid bestaande tracks uit of meng stijlen door AI-gegenereerde nummers uit te breiden met nieuwe secties (binnenkort beschikbaar!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm is het eerste open-source latent diffusion model ontwikkeld door ASLP Lab, speciaal ontworpen voor end-to-end generatie van volledige nummers. Het creert complete tracks (tot 285s) met vocalen en instrumentale begeleiding in seconden, alleen met tekstprompts zoals songteksten en stijlbeschrijvingen. In tegenstelling tot traditionele meerstaps systemen combineert het eenvoud, snelheid en schaalbaarheid - waardoor AI-aangedreven muziekcreatie voor iedereen toegankelijk wordt.
De DiffRhythm API is gemaakt door en stelt ontwikkelaars in staat onze nummergenereratietechnologie direct te integreren in apps, tools of workflows. Het biedt programmatische toegang tot de mogelijkheden van het model, waardoor functies zoals bulkgeneratie, realtime aanpassing en naadloze schaling voor commercieel gebruik mogelijk zijn. Of je nu een muziekproductie-app, een game soundtrack engine of een creatief AI-platform bouwt, de API verwerkt rekenintensieve taken terwijl jij je focust op de gebruikerservaring.
De DiffRhythm API ondersteunt vrijwel elk genre of stijl beschreven in je prompts! Of je nu pop, jazz, electronic, folk, filmmuziek of experimentele soundscapes nodig hebt, het past zich aan aan je creatieve visie.
Voor onze "Pay-as-you-go" optie kost elke generatie-aanroep $0,02 voor zowel txt2audio basis (1,35 min) als txt2audio volledig (4,45 min).
Ja, verschillende abonnementsplannen (Gratis, Creator of Pro Plan) geven "Pay-as-you-go" gebruikers verschillende aantallen gelijktijdige taken. Bekijk onze prijspagina voor details.
Ja! De Apache 2.0 licentie staat commercieel gebruik toe, maar je moet de originaliteit verifieren en AI-betrokkenheid vermelden!
Alleen songteksten (optioneel) en een stijlprompt. Geen instrumentale referenties of melodie-templates nodig!
Onze workspace heeft Stripe geintegreerd in ons betalingssysteem, waardoor betalingen van de meeste grote creditcardaanbieders mogelijk zijn.
Nee, we bieden geen terugbetalingen aan. Maar als je je voor het eerst aanmeldt voor een account op PiAPI's Workspace, krijg je gratis tegoed om onze DiffRhythm (specifiek de "Pay-as-you-go" service) te proberen voordat je betaalt!
Stuur ons een e-mail op - we horen graag je feedback en verkennen graag mogelijke samenwerkingen!
More questions? See the API docs.
DiffRhythm API