txt2audio base1.35 min
$0.02
Erstellen Sie komplette, professionelle Songs in Sekunden! DiffRhythm ist das weltweit erste Open-Source-Latent-Diffusion-Modell, das vollstaendige Gesangs- und Instrumentalspuren aus einfachen Textbeschreibungen generiert. Beschreiben Sie Ihre Vision und lassen Sie DiffRhythm Rhythmus, Melodie und Text uebernehmen.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Generieren Sie komplette Songs bis zu 4 Minuten 45 Sekunden in einem Schritt - kein Zusammenfuegen kurzer Clips oder mehrstufige Workflows.
Beschreiben Sie Stimmungen, Genres oder Bilder (z.B. "Jazzige Nachtclub-Atmosphaere" oder "Indie-Folk-Ballade mit akustischer Mundharmonika"), um einzigartige Kompositionen zu gestalten.
Unsere asynchrone API-Aufrufstruktur ermoeglicht es Entwicklern, Aufgaben zu uebermitteln und ihr Programm fortzusetzen, bis eine "Callback"-Funktion ausgefuehrt wird.
Erstellen Sie Klanglandschaften aus wilden Beschreibungen wie "Arktische Theremin-Stuerme" - perfekt fuer Filmmusik, Spielsoundtracks oder experimentelle Musik.
Konzentrieren Sie sich auf lyrisches Storytelling mit eigenstaendigen Gesangsspuren, ideal fuer die Verfeinerung von Texten oder A-cappella-Projekte.
Generieren Sie nahtlos Songs auf Englisch oder Chinesisch mit natuerlich klingender Gesangsphrasierung in beiden Sprachen.
Erleben Sie stabile Leistung selbst unter hoechster Last - unser Service kann automatisch je nach variierender Spitzenlast skalieren und eine hohe Anzahl von Jobs gleichzeitig verarbeiten, waehrend die Latenzzeiten minimal bleiben!
Nutzen Sie die nicht-autoregressive Architektur, um Songs 100x schneller zu erstellen als sprachmodellbasierte Alternativen.
Die Apache 2.0-Lizenz erlaubt kommerzielle Nutzung, Anpassung und Integration in Ihre kreativen Tools oder Apps.
Passen Sie die Songdauer spontan an, von 30-Sekunden-Jingles bis zu erweiterten 10-Minuten-Kompositionen (demnachst!).
Erweitern Sie bestehende Tracks oder mischen Sie Stile, indem Sie KI-generierte Songs um neue Abschnitte erweitern (demnachst!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm ist das erste Open-Source-Latent-Diffusion-Modell, entwickelt von ASLP Lab, speziell konzipiert fuer die Ende-zu-Ende-Generierung vollstaendiger Songs. Es erstellt komplette Tracks (bis zu 285s) mit Gesang und Instrumentalbegleitung in Sekunden, nur mit Textbeschreibungen wie Liedtexten und Stilbeschreibungen. Im Gegensatz zu traditionellen mehrstufigen Systemen kombiniert es Einfachheit, Geschwindigkeit und Skalierbarkeit - und macht KI-gestuetzte Musikerstellung fuer jeden zugaenglich.
Die DiffRhythm API wurde erstellt von und ermoeglicht Entwicklern, unsere Song-Generierungstechnologie direkt in Apps, Tools oder Workflows zu integrieren. Sie bietet programmatischen Zugriff auf die Modell-Faehigkeiten und ermoeglicht Funktionen wie Massengenerierung, Echtzeit-Anpassung und nahtlose Skalierung fuer kommerzielle Nutzung. Ob Sie eine Musikproduktions-App, eine Spielsoundtrack-Engine oder eine kreative KI-Plattform bauen, die API uebernimmt rechenintensive Aufgaben, waehrend Sie sich auf die Benutzererfahrung konzentrieren.
Die DiffRhythm API unterstuetzt praktisch jedes Genre oder jeden Stil, der in Ihren Beschreibungen beschrieben wird! Ob Sie Pop, Jazz, Elektronik, Folk, Filmmusik oder experimentelle Klanglandschaften benoetigen, sie passt sich Ihrer kreativen Vision an.
Bei unserer "Pay-as-you-go"-Option kostet jeder Generierungsaufruf 0,02 $ fuer sowohl txt2audio basis (1,35 Min.) als auch txt2audio voll (4,45 Min.).
Ja, verschiedene Abonnementplaene (Kostenlos, Creator oder Pro-Plan) gewaehren "Pay-as-you-go"-Nutzern unterschiedliche Anzahlen gleichzeitiger Jobs. Bitte besuchen Sie unsere Preisseite fuer Details.
Ja! Die Apache 2.0-Lizenz erlaubt kommerzielle Nutzung, aber Sie muessen die Originalitaet ueberpruefen und die KI-Beteiligung offenlegen!
Nur Liedtexte (optional) und eine Stilbeschreibung. Keine Instrumentalreferenzen oder Melodievorlagen erforderlich!
Unser Workspace hat Stripe in unser Zahlungssystem integriert, wodurch Zahlungen von den meisten grossen Kreditkartenanbietern moeglich sind.
Nein, wir bieten keine Rueckerstattungen an. Aber wenn Sie sich zum ersten Mal fuer ein Konto im PiAPI Workspace registrieren, erhalten Sie kostenloses Guthaben, um unser DiffRhythm (speziell den "Pay-as-you-go"-Service) vor der Zahlung auszuprobieren!
Bitte senden Sie uns eine E-Mail an - wir wuerden gerne Ihr Feedback hoeren und moegliche Zusammenarbeiten erkunden!
More questions? See the API docs.
DiffRhythm API