txt2audio base1.35 min
$0.02
Creez des chansons completes de qualite professionnelle en quelques secondes ! DiffRhythm est le premier modele de diffusion latente open source au monde qui genere des pistes vocales et instrumentales completes a partir de simples descriptions textuelles. Decrivez votre vision et laissez DiffRhythm gerer le rythme, la melodie et les paroles.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Generez des chansons completes jusqu'a 4 minutes 45 secondes en une seule etape - pas de collage de clips courts ni de workflows multi-etapes.
Decrivez des ambiances, des genres ou des images (par exemple "Ambiance club de jazz nocturne" ou "Ballade folk indie avec harmonica acoustique") pour faconner des compositions uniques.
Notre structure d'appels API asynchrones permet aux developpeurs de soumettre des taches et de continuer leur programme jusqu'a l'execution d'une fonction "callback".
Creez des paysages sonores a partir de descriptions creatives comme "Tempetes de theremin arctique" - parfait pour les musiques de films, les bandes sonores de jeux ou la musique experimentale.
Concentrez-vous sur la narration lyrique avec des pistes vocales autonomes, ideal pour affiner les paroles ou les projets a cappella.
Generez des chansons en anglais ou en chinois de maniere fluide, avec un phrasé vocal naturel dans les deux langues.
Beneficiez de performances stables meme sous les charges les plus exigeantes - notre service peut s'adapter automatiquement aux pics de charge variables, traitant un grand nombre de taches simultanement tout en maintenant des latences minimales !
Exploitez l'architecture non autoregressive pour creer des chansons 100 fois plus rapidement que les alternatives basees sur les modeles de langage.
La licence Apache 2.0 permet l'utilisation commerciale, la personnalisation et l'integration dans vos outils creatifs ou applications.
Ajustez la duree de la chanson a la volee, des jingles de 30 secondes aux compositions etendues de 10 minutes (bientot disponible !).
Etendez les pistes existantes ou melangez les styles en ajoutant de nouvelles sections aux chansons generees par IA (bientot disponible !).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm est le premier modele de diffusion latente open source developpe par ASLP Lab, concu specifiquement pour la generation de chansons completes de bout en bout. Il cree des pistes completes (jusqu'a 285s) avec voix et accompagnement instrumental en quelques secondes, en utilisant uniquement des descriptions textuelles comme les paroles et les descriptions de style. Contrairement aux systemes traditionnels multi-etapes, il combine simplicite, rapidite et evolutivite - rendant la creation musicale assistee par IA accessible a tous.
L'API DiffRhythm a ete creee par et elle permet aux developpeurs d'integrer notre technologie de generation de chansons directement dans les applications, outils ou workflows. Elle fournit un acces programmatique aux capacites du modele, permettant des fonctionnalites comme la generation en masse, la personnalisation en temps reel et une mise a l'echelle fluide pour l'utilisation commerciale. Que vous construisiez une application de production musicale, un moteur de bande sonore de jeu ou une plateforme d'IA creative, l'API gere les taches gourmandes en calcul pendant que vous vous concentrez sur l'experience utilisateur.
L'API DiffRhythm prend en charge pratiquement tous les genres ou styles decrits dans vos descriptions ! Que vous ayez besoin de pop, jazz, electronique, folk, musiques de film ou paysages sonores experimentaux, elle s'adapte a votre vision creative.
Pour notre option "Paiement a l'utilisation", chaque appel de generation coute 0,02 $ pour txt2audio base (1,35 min) et txt2audio complet (4,45 min).
Oui, differents plans d'abonnement (Gratuit, Creator ou Pro) accorderont aux utilisateurs "Paiement a l'utilisation" differents nombres de taches concurrentes. Veuillez consulter notre page de tarification pour les details.
Oui ! La licence Apache 2.0 permet l'utilisation commerciale, mais vous devez verifier l'originalite et divulguer l'implication de l'IA !
Juste des paroles (optionnel) et une description de style. Pas besoin de references instrumentales ou de modeles de melodie !
Notre espace de travail a integre Stripe dans notre systeme de paiement, ce qui permettra les paiements depuis la plupart des principaux fournisseurs de cartes de credit.
Non, nous ne proposons pas de remboursements. Mais lorsque vous vous inscrivez pour la premiere fois sur l'espace de travail de PiAPI, vous recevez des credits gratuits pour essayer notre DiffRhythm (specifiquement le service "Paiement a l'utilisation") avant de payer !
Veuillez nous envoyer un email a - nous serions ravis d'ecouter vos retours et d'explorer de potentielles collaborations !
More questions? See the API docs.
DiffRhythm API