txt2audio base1.35 min
$0.02
Crie músicas completas de qualidade profissional em segundos! DiffRhythm é o primeiro modelo de difusão latente de código aberto do mundo que gera faixas vocais e instrumentais completas a partir de simples prompts de texto. Descreva sua visão e deixe o DiffRhythm cuidar do ritmo, melodia e letras.
Pay-as-you-go access through PiAPI.
$0.02
$0.02
Capabilities from the production model page.
Gere músicas completas de até 4 minutos e 45 segundos em uma única etapa - sem costurar clipes curtos ou fluxos de trabalho multi-estágios.
Descreva humores, gêneros ou imagens (ex: 'Vibe de clube noturno jazzístico' ou 'Balada folk indie com harmônica acústica') para moldar composições únicas.
Nossa estrutura de chamadas de API assíncrona permite que desenvolvedores enviem tarefas e continuem seu programa, até que uma função "callback" seja executada.
Crie paisagens sonoras a partir de prompts selvagens como "Tempestades de Theremin Ártico" - perfeito para trilhas de filmes, soundtracks de jogos ou música experimental.
Foque na narrativa lírica com faixas vocais independentes, ideal para refinar letras ou projetos a cappella.
Gere músicas em inglês ou chinês sem problemas, com fraseado vocal de som natural em ambos os idiomas.
Experimente desempenho estável mesmo sob a carga mais exigente - nosso serviço pode escalar automaticamente conforme a carga de pico variável, processando alto número de trabalhos simultaneamente mantendo latências no mínimo!
Aproveite a arquitetura não-autoregressiva para criar músicas 100x mais rápido que alternativas baseadas em modelos de linguagem.
A licença Apache 2.0 permite uso comercial, personalização e integração em suas ferramentas criativas ou apps.
Ajuste a duração da música instantaneamente, de jingles de 30 segundos a composições estendidas de 10 minutos (em breve!).
Expanda faixas existentes ou misture estilos estendendo músicas geradas por AI com novas seções (em breve!).
Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.
Add credits on the billing page when you are ready to scale beyond the free tier.
POST your first task following the API docs, then poll the task until the result is ready.
Prototype prompts and settings in the the playground above before wiring them into your product.
curl -X POST 'https://api.piapi.ai/api/v1/task' \
-H 'X-API-Key: YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "Qubico/diffrhythm",
"task_type": "txt2audio-base",
"input": {
"lyrics": "[00:00.00]A bright new melody begins",
"style_prompt": "upbeat indie pop"
}
}'
# → { "task_id": "9d5a…", "status": "pending" }curl 'https://api.piapi.ai/api/v1/task/{task_id}' \
-H 'X-API-Key: YOUR_API_KEY'
# poll until status = completed
{
"data": {
"status": "completed",
"output": {
"audio_url": "https://img.theapi.app/ephemeral/…"
}
}
}$ npm install -g piapi-cli $ piapi run diffrhythm \ lyrics="[00:00.00]A bright new melody begins" \ style_prompt="upbeat indie pop" ✓ Task completed! https://img.theapi.app/ephemeral/…
DiffRhythm é o primeiro modelo de difusão latente de código aberto desenvolvido pelo ASLP Lab, projetado especificamente para geração de músicas completas de ponta a ponta. Cria faixas completas (até 285s) com vocais e acompanhamento instrumental em segundos, usando apenas prompts de texto como letras e descrições de estilo. Diferente dos sistemas multi-estágios tradicionais, combina simplicidade, velocidade e escalabilidade - tornando a criação musical com IA acessível a todos.
A API DiffRhythm foi criada por e permite que desenvolvedores integrem nossa tecnologia de geração de músicas diretamente em apps, ferramentas ou fluxos de trabalho. Fornece acesso programático às capacidades do modelo, habilitando recursos como geração em massa, personalização em tempo real e escalabilidade perfeita para uso comercial. Seja construindo um app de produção musical, um motor de trilhas sonoras de jogos ou uma plataforma criativa de IA, a API cuida das tarefas computacionalmente intensivas enquanto você foca na experiência do usuário.
A API DiffRhythm suporta virtualmente qualquer gênero ou estilo descrito em seus prompts! Seja pop, jazz, eletrônico, folk, trilhas cinematográficas ou paisagens sonoras experimentais, ela se adapta à sua visão criativa.
Para nossa opção "Pay-as-you-go", custa $0.02 por cada chamada de geração tanto para txt2audio básico (1.35 min) quanto txt2audio completo (4.45 min).
Sim, diferentes planos de assinatura (Free, Creator ou Pro Plan) concedem aos usuários "Pay-as-you-go" diferentes números de trabalhos simultâneos, consulte nossos preços para detalhes.
Sim! A licença Apache 2.0 permite uso comercial, mas você deve verificar originalidade e divulgar envolvimento de IA!
Apenas letras (opcional) e um prompt de estilo. Não são necessárias referências instrumentais ou templates de melodia!
Nosso workspace integrou Stripe em nosso sistema de pagamentos, permitindo pagamentos da maioria dos principais provedores de cartão de crédito.
Não, não oferecemos reembolsos. Mas quando você se cadastra pela primeira vez no Workspace da PiAPI, você recebe créditos grátis para experimentar nosso DiffRhythm (especificamente o serviço "Pay-as-you-go") antes de fazer pagamentos!
Por favor envie-nos um email em - adoraríamos ouvir seu feedback e explorar colaborações potenciais!
More questions? See the API docs.
DiffRhythm API