txt2audio base1.35 min
$0.02
Crea canzoni complete di qualita professionale in pochi secondi! DiffRhythm e il primo modello di diffusione latente open source al mondo che genera tracce vocali e strumentali complete da semplici descrizioni testuali. Descrivi la tua visione e lascia che DiffRhythm si occupi del ritmo, della melodia e dei testi.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Genera canzoni complete fino a 4 minuti e 45 secondi in un unico passaggio - senza unire brevi clip o flussi di lavoro multi-fase.
Descrivi atmosfere, generi o immagini (es. "Atmosfera da jazz club notturno" o "Ballata folk indie con armonica acustica") per creare composizioni uniche.
La nostra struttura di chiamate API asincrone consente agli sviluppatori di inviare attivita e far proseguire il programma fino all'esecuzione di una funzione "callback".
Crea paesaggi sonori da descrizioni creative come "Tempeste di theremin artico" - perfetto per colonne sonore di film, soundtrack di videogiochi o musica sperimentale.
Concentrati sulla narrazione lirica con tracce vocali autonome, ideali per perfezionare i testi o progetti a cappella.
Genera canzoni in inglese o cinese senza problemi, con fraseggio vocale naturale in entrambe le lingue.
Sperimenta prestazioni stabili anche sotto i carichi piu impegnativi - il nostro servizio puo scalare automaticamente in base ai picchi di carico variabili, elaborando un alto numero di lavori contemporaneamente mantenendo le latenze al minimo!
Sfrutta l'architettura non autoregressiva per creare canzoni 100 volte piu velocemente rispetto alle alternative basate su modelli linguistici.
La licenza Apache 2.0 consente l'uso commerciale, la personalizzazione e l'integrazione nei tuoi strumenti creativi o app.
Regola la durata della canzone al volo, da jingle di 30 secondi a composizioni estese di 10 minuti (in arrivo!).
Espandi tracce esistenti o mescola stili estendendo canzoni generate dall'IA con nuove sezioni (in arrivo!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm e il primo modello di diffusione latente open-source sviluppato da ASLP Lab, progettato specificamente per la generazione end-to-end di canzoni complete. Crea tracce complete (fino a 285s) con voce e accompagnamento strumentale in pochi secondi, usando solo descrizioni testuali come testi e descrizioni di stile. A differenza dei sistemi tradizionali multi-fase, combina semplicita, velocita e scalabilita - rendendo la creazione musicale basata sull'IA accessibile a tutti.
L'API DiffRhythm e stata creata da e consente agli sviluppatori di integrare la nostra tecnologia di generazione di canzoni direttamente in app, strumenti o flussi di lavoro. Fornisce accesso programmatico alle capacita del modello, abilitando funzionalita come la generazione in blocco, la personalizzazione in tempo reale e la scalabilita senza interruzioni per uso commerciale. Che tu stia costruendo un'app di produzione musicale, un motore di soundtrack per videogiochi o una piattaforma di IA creativa, l'API gestisce le attivita computazionalmente intensive mentre tu ti concentri sull'esperienza utente.
L'API DiffRhythm supporta praticamente qualsiasi genere o stile descritto nelle tue descrizioni! Che tu abbia bisogno di pop, jazz, elettronica, folk, colonne sonore cinematografiche o paesaggi sonori sperimentali, si adatta alla tua visione creativa.
Per la nostra opzione "Pay-as-you-go", costa $0,02 per ogni chiamata di generazione sia per txt2audio base (1,35 min) che per txt2audio completo (4,45 min).
Si, diversi piani di abbonamento (Gratuito, Creator o Pro Plan) concederanno agli utenti "Pay-as-you-go" diversi numeri di lavori simultanei. Consulta la nostra pagina dei prezzi per i dettagli.
Si! La licenza Apache 2.0 consente l'uso commerciale, ma devi verificare l'originalita e dichiarare il coinvolgimento dell'IA!
Solo testi (opzionale) e una descrizione di stile. Non sono necessari riferimenti strumentali o modelli di melodia!
Il nostro workspace ha integrato Stripe nel nostro sistema di pagamento, che consentira pagamenti dalla maggior parte dei principali fornitori di carte di credito.
No, non offriamo rimborsi. Ma quando ti registri per la prima volta su Workspace di PiAPI, ricevi crediti gratuiti per provare il nostro DiffRhythm (specificamente il servizio "Pay-as-you-go") prima di effettuare pagamenti!
Scrivici a - saremo felici di ascoltare il tuo feedback ed esplorare potenziali collaborazioni!
More questions? See the API docs.
DiffRhythm API