Skip to main content

audio models

DiffRhythm AI & API:即时全长歌曲生成!

在几秒钟内创作完整的专业级歌曲!DiffRhythm 是世界上第一个开源潜在扩散模型,可以从简单的文本提示生成全长人声和器乐曲目。描述您的愿景,让 DiffRhythm 处理节奏、旋律和歌词。

立即开始!

DiffRhythm API Pricing

Pay-as-you-go access through PiAPI.

txt2audio base1.35 min

$0.02

    txt2audio full4.45 min

    $0.02

      功能特性

      Capabilities from the production model page.

      端到端全长音乐

      在单步中生成长达 4 分 45 秒的完整歌曲 - 无需拼接短片段或多阶段工作流程。

      风格+场景驱动创作!

      描述情绪、流派或意象(例如 '爵士夜店氛围' 或 '带口琴的独立民谣')来塑造独特的作品。

      异步 API 调用

      我们的异步 API 调用结构允许开发者提交任务并让程序继续运行,直到执行 "回调" 函数。

      器乐模式

      从疯狂的提示中创作音景,如 "北极特雷门风暴" - 非常适合电影配乐、游戏原声或实验音乐。

      纯人声生成

      专注于独立人声曲目的歌词叙事,非常适合完善歌词或无伴奏项目。

      多语言音乐

      无缝生成英语或中文歌曲,两种语言都有自然发音的人声措辞。

      高并发

      即使在最苛刻的负载下也能体验稳定的性能 - 我们的服务可以根据不同的峰值负载自动扩展,在保持最低延迟的同时高并发处理大量任务!

      10 秒推理速度

      利用非自回归架构创作歌曲,比基于语言模型的替代品快 100 倍。

      开源自由

      Apache 2.0 许可证允许商业使用、定制和集成到您的创意工具或应用中。

      动态时长控制

      随时调整歌曲时长,从 30 秒的短曲到 10 分钟的长篇作品(即将推出!)。

      歌曲扩展和混音

      通过添加新部分来扩展现有曲目或混合风格(即将推出!)。

      Get started

      Create your API key

      Sign up and grab an API key from the PiAPI workspace — free credits are included on sign-up.

      Top up credits

      Add credits on the billing page when you are ready to scale beyond the free tier.

      Call the API

      POST your first task following the API docs, then poll the task until the result is ready.

      Iterate in the playground

      Prototype prompts and settings in the the playground above before wiring them into your product.

      curl -X POST 'https://api.piapi.ai/api/v1/task' \
        -H 'X-API-Key: YOUR_API_KEY' \
        -H 'Content-Type: application/json' \
        -d '{
          "model": "Qubico/diffrhythm",
          "task_type": "txt2audio-base",
          "input": {
            "lyrics": "[00:00.00]A bright new melody begins",
            "style_prompt": "upbeat indie pop"
          }
        }'
      
      # → { "task_id": "9d5a…", "status": "pending" }

      Frequently asked questions

      什么是 DiffRhythm?

      DiffRhythm 是由 ASLP 实验室开发的第一个开源潜在扩散模型,专门设计用于端到端全长歌曲生成。它在几秒钟内创建完整的曲目(最长 285 秒),包含人声和器乐伴奏,仅使用歌词和风格描述等文本提示。与传统的多阶段系统不同,它结合了简单性、速度和可扩展性 - 让 AI 驱动的音乐创作变得人人可及。

      什么是 DiffRhythm API?

      DiffRhythm API 由 创建,它允许开发者将我们的歌曲生成技术直接集成到应用程序、工具或工作流程中。它提供对模型功能的编程访问,支持批量生成、实时定制和商业用途的无缝扩展等功能。无论您是构建音乐制作应用、游戏原声引擎还是创意 AI 平台,API 都会处理计算密集型任务,让您专注于用户体验。

      DiffRhythm 可以生成什么类型的音乐?

      DiffRhythm API 支持您在提示中描述的几乎任何流派或风格!无论您需要流行、爵士、电子、民谣、电影配乐还是实验音景,它都能适应您的创意愿景。

      音乐生成的定价是多少?

      对于我们的「按需付费」选项,txt2audio 基础版(1.35 分钟)和 txt2audio 完整版(4.45 分钟)每次生成调用的费用均为 $0.02。

      「按需付费」选项是否有最大并发任务数限制?

      是的,不同的订阅计划(免费、创作者或专业计划)将为「按需付费」用户授予不同数量的并发任务,请参阅我们的定价了解详情。

      我可以商业化使用 DiffRhythm 歌曲吗?

      是的!Apache 2.0 许可证允许商业使用,但您必须验证原创性并披露 AI 参与!

      需要什么输入?

      只需歌词(可选)和风格提示。不需要器乐参考或旋律模板!

      如何支付此 API 的费用?

      我们的工作区已集成 Stripe 支付系统,允许使用大多数主要信用卡提供商进行付款。

      你们提供退款吗?

      不,我们不提供退款。但当您首次在 PiAPI 工作区注册账户时,您将获得免费积分来试用我们的 DiffRhythm(特别是「按需付费」服务),然后再付款!

      如何联系你们的团队?

      请发送电子邮件至 - 我们很乐意听取您的反馈并探索潜在的合作机会!

      More questions? See the API docs.

      Our blog

      DiffRhythm API