Stable Audio 3.0 Medium / 全站资源搜索
搜索 更新 2026-10-02
工作流 音频 只用内置节点

Stable Audio 3.0 Medium

Stable Audio 3.0 Medium

标签来自官方模板索引原值(括号里是英文原文),点标签看同类工作流。

下载这条工作流的成品包(夸克网盘)
包内:工作流 JSON(112 KB,官方原文未改动)+ 说明书 + 注意事项 + 模型说明。
这条工作流做什么 用 Stable Audio 3.0 Medium 从文字生成音频。
看官方英文原文
Input a short text idea, optional duration, seed, and category. Generate stereo audio (music, SFX, or instruments) using Stable Audio 3 with optional AI-driven text expansion.
中文为本站译自官方描述,英文为官方模板索引原文。
这条工作流要 3 个模型文件,合计约 14.96 GB ,本地权重库已全部备好。

下载这条工作流的模型

  • 按 ComfyUI 的 models/ 目录分好类的 163 个权重文件
  • 每个文件一份说明(放哪个目录、用什么节点加载、被哪些工作流引用)
  • 目录结构可直接复制进 ComfyUI 的 models
待挂载 网盘链接整理中,挂载后此处会出现保存按钮。
按 diffusion_models、text_encoders、vae、loras 等 15 类分目录,与 ComfyUI 官方目录一致。另有 7 个上游已不提供下载地址,标为「拿不到」,不计入上面的体积。
项目值
官方发布日期2026-05-20
最低 ComfyUI 版本0.19.2
节点数24(主画布 4 + 子图内部 20,共 1 个子图)
模型依赖3 个文件 · 约 14.96 GB(3 个有官方地址)
额外节点包不需要,全部为主程序内置节点

要准备的模型文件

放进 ComfyUI 的 models/ 下对应目录,文件名一字不差(含大小写与扩展名)。 「下载」指向本站权重库(正在上传,挂载前先走官方源); 权重库共 163 个文件 / 约 1187.28 GB,当前已备好 163 个。 看权重库总表(每个文件放哪个目录、被哪些工作流引用)。

models/checkpoints/ 主模型(UNet、文本编码器、VAE 打包在一起) · 1 个文件

文件名(必须完全一致)体积权重库加载节点下载
stable_audio_3_medium.safetensors 9.22 GB 已备好 CheckpointLoaderSimple 网盘下载
stable-audio-3 · checkpoints/ 目录:模型档案中的下载入口

models/text_encoders/ 文本编码器(把提示词编码成模型能读的条件) · 2 个文件

文件名(必须完全一致)体积权重库加载节点下载
t5gemma_b_b_ul2.safetensors 1.19 GB 已备好 CLIPLoader 网盘下载
stable-audio-3 · text_encoders/ 目录:模型档案中的下载入口
qwen3.5_2b_bf16.safetensors 4.55 GB 已备好 CLIPLoader 网盘下载
Qwen3.5 · text_encoders/ 目录:模型档案中的下载入口
使用前提 权重文件不在工作流下载包里,要从上面的权重库获取(或按官方地址自行下载)。 这条工作流的依赖与参数来自对文件的静态解析,未在本机运行验证,所以不提供显存与耗时结论。

返回工作流列表