txt2audio base1.35 min
$0.02
Twórz kompletne, profesjonalne utwory w kilka sekund! DiffRhythm to pierwszy na świecie otwartoźródłowy model dyfuzji latentnej, który generuje pełne utwory wokalne i instrumentalne z prostych podpowiedzi tekstowych. Opisz swoją wizję i pozwól DiffRhythm zająć się rytmem, melodią i tekstami.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Generuj kompletne utwory do 4 minut 45 sekund w jednym kroku - bez łączenia krótkich klipów czy wieloetapowych procesów.
Opisz nastroje, gatunki lub obrazy (np. 'Jazzowy klimat nocnego klubu' lub 'Indie folk ballada z harmonijką') aby kształtować unikalne kompozycje.
Nasza asynchroniczna struktura wywołań API pozwala deweloperom przesyłać zadania i kontynuować działanie programu, aż do wykonania funkcji "callback".
Twórz pejzaże dźwiękowe z szalonych podpowiedzi jak "Arktyczne burze theremina" - idealne do ścieżek filmowych, soundtracków do gier lub muzyki eksperymentalnej.
Skup się na lirycznym opowiadaniu z samodzielnymi ścieżkami wokalnymi, idealnymi do dopracowywania tekstów lub projektów a cappella.
Bezproblemowo generuj utwory po angielsku lub chińsku, z naturalnie brzmiącymi frazami wokalnymi w obu językach.
Doświadcz stabilnej wydajności nawet przy najbardziej wymagającym obciążeniu - nasza usługa może automatycznie skalować się w zależności od zmiennego obciążenia szczytowego, przetwarzając dużą liczbę zadań jednocześnie przy minimalnych opóźnieniach!
Wykorzystaj architekturę nieautoregresyjną do tworzenia utworów 100x szybciej niż alternatywy oparte na modelach językowych.
Licencja Apache 2.0 pozwala na użycie komercyjne, dostosowanie i integrację z twoimi kreatywnymi narzędziami lub aplikacjami.
Dostosuj długość utworu w locie, od 30-sekundowych dżingli do rozszerzonych 10-minutowych kompozycji (wkrótce!).
Rozszerzaj istniejące utwory lub mieszaj style, dodając nowe sekcje do utworów wygenerowanych przez AI (wkrótce!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm to pierwszy otwartoźródłowy model dyfuzji latentnej opracowany przez ASLP Lab, zaprojektowany specjalnie do kompleksowego generowania pełnych utworów. Tworzy kompletne ścieżki (do 285s) z wokalami i akompaniamentem instrumentalnym w kilka sekund, używając tylko podpowiedzi tekstowych jak teksty i opisy stylu. W przeciwieństwie do tradycyjnych systemów wieloetapowych, łączy prostotę, szybkość i skalowalność - czyniąc tworzenie muzyki napędzane AI dostępnym dla wszystkich.
API DiffRhythm zostało stworzone przez i pozwala deweloperom integrować naszą technologię generowania utworów bezpośrednio w aplikacjach, narzędziach lub procesach roboczych. Zapewnia programowy dostęp do możliwości modelu, umożliwiając funkcje takie jak generowanie masowe, dostosowywanie w czasie rzeczywistym i bezproblemowe skalowanie do użytku komercyjnego. Niezależnie od tego, czy budujesz aplikację do produkcji muzyki, silnik soundtracków do gier, czy kreatywną platformę AI, API obsługuje zadania wymagające dużej mocy obliczeniowej, podczas gdy ty skupiasz się na doświadczeniu użytkownika.
API DiffRhythm obsługuje praktycznie każdy gatunek lub styl opisany w twoich podpowiedziach! Niezależnie od tego, czy potrzebujesz popu, jazzu, elektroniki, folku, ścieżek filmowych czy eksperymentalnych pejzaży dźwiękowych, dostosowuje się do twojej kreatywnej wizji.
Dla naszej opcji "Pay-as-you-go" koszt wynosi $0.02 za każde wywołanie generowania zarówno dla txt2audio basic (1.35 min) jak i txt2audio full (4.45 min).
Tak, różne plany subskrypcji (Free, Creator lub Pro Plan) przyznają użytkownikom "Pay-as-you-go" różną liczbę równoczesnych zadań, szczegóły znajdziesz w naszym cenniku.
Tak! Licencja Apache 2.0 zezwala na użycie komercyjne, ale musisz zweryfikować oryginalność i ujawnić udział AI!
Tylko teksty (opcjonalnie) i podpowiedź stylowa. Nie są potrzebne odniesienia instrumentalne ani szablony melodii!
Nasz workspace ma zintegrowany Stripe w systemie płatności, co pozwala na płatności z większości głównych dostawców kart kredytowych.
Nie, nie oferujemy zwrotów. Ale gdy po raz pierwszy zarejestrujesz konto w Workspace PiAPI, otrzymasz darmowe kredyty na wypróbowanie naszego DiffRhythm (szczególnie usługi "Pay-as-you-go") przed dokonaniem płatności!
Napisz do nas na - chętnie wysłuchamy twoich opinii i zbadamy potencjalne współprace!
More questions? See the API docs.
DiffRhythm API