> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-sync-comfy-api-v2-spec-462120c.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Stable Audio 1.0 ComfyUI ワークフロー例

> Stability AI のオープンソースモデル Stable Audio 1.0 を ComfyUI で使用してテキストから音声を生成する方法を解説します。

<Tip>
  <Tabs>
    <Tab title="ローカルユーザー">
      ComfyUI が最新版に更新されていることを確認してください。

      * [ComfyUI のダウンロード](https://www.comfy.org/download)
      * [更新手順](/ja/installation/update_comfyui)

      このガイドで紹介するワークフローは、[ワークフローテンプレート](/ja/interface/features/template)から入手できます。
      テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。

      ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因：

      1. 最新の ComfyUI（Nightly 版）を使用していない
      2. 起動時に一部のノードのインポートに失敗している
    </Tab>

    <Tab title="クラウドユーザー">
      * [Cloud](https://cloud.comfy.org) は、ComfyUI の安定版リリース後に更新されます。

      したがって、このドキュメントでコアノードが見つからない場合、それは新しいコアノードがまだ最新の安定版にリリースされていない可能性があります。次回の安定版リリースをお待ちください。
    </Tab>
  </Tabs>
</Tip>

**Stable Audio 1.0** は、Stability AI初のオープンソースのオーディオ生成モデルです。テキストプロンプトを受け取り、オーディオクリップを生成します。ComfyUIでは、標準的なテキストから音声生成のパイプラインとして動作します。CLIPがプロンプトをエンコードし、Kサンプラーが潜在空間をノイズ除去し、VAEがそれをオーディオにデコードします。

**関連リンク**：

* [GitHub: Stability-AI/stable-audio-open-1.0](https://github.com/Stability-AI/stable-audio-open-1.0)

## ワークフロー

<h3 id="audio_stable_audio_example">
  Stable Audio 1.0: テキストからオーディオへ
</h3>

テキストプロンプトからStable Audioを使用してオーディオを生成します。

<img src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/templates/audio_stable_audio_example-1.webp" alt="Stable Audio 1.0 テキストからオーディオへのワークフロープレビュー" />

<CardGroup cols={2}>
  <Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=audio_stable_audio_example&utm_source=docs&utm_medium=referral&utm_campaign=stable-audio-1">
    Comfy Cloud で開く
  </Card>

  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/audio_stable_audio_example.json">
    JSONをダウンロードするか、テンプレートライブラリで "Stable Audio 1.0: Text to Audio" を検索
  </Card>
</CardGroup>

このワークフローは**スタンダードなComfyUIノード**を使用しており、カスタムノードは不要です。Stable Audio 1.0チェックポイントをロードし、CLIPテキストエンコーダー（t5-base）でプロンプトをエンコード、Kサンプラーで潜在オーディオをデノイズし、モデルのVAEでオーディオにデコードします。

**使用方法**:

1. **チェックポイントをロード**: `CheckpointLoaderSimple`ノードで`stable-audio-open-1.0.safetensors`を使用
2. **プロンプトを入力**: `CLIPTextEncode`ノードに説明を入力（例："heaven church electronic dance music"）
3. **再生時間を設定**: `EmptyLatentAudio`ノードの長さの値を調整（デフォルト47.6秒）
4. **実行**（`Ctrl/Cmd + Enter`）をクリックして生成。オーディオは`ComfyUI/output/audio/`に保存されます。

## モデルのダウンロード

ワークフローの読み込み時に、不足しているモデルがある場合、ComfyUI はダウンロードリンクを表示します。手動で設定するには、以下のファイルをダウンロードし、適切なフォルダに配置してください。

### チェックポイント

<Card title="stable-audio-open-1.0.safetensors" icon="download" href="https://huggingface.co/StabilityAI/stable-audio-open-1.0/blob/main/stable-audio-open-1.0.safetensors">
  2.3GB。models/checkpoints/ に配置してください。
</Card>

チェックポイントは以下の場所に配置します：

```
📂 ComfyUI/
├── 📂 models/
│   └── 📂 checkpoints/
│       └── stable-audio-open-1.0.safetensors
```

### テキストエンコーダー

<Card title="t5-base.safetensors" icon="download" href="https://huggingface.co/Comfy-Org/t5-base/blob/main/t5-base.safetensors">
  プロンプトの条件付け用テキストエンコーダー。models/text\_encoders/ に配置してください。
</Card>

テキストエンコーダーは以下の場所に配置します：

```
📂 ComfyUI/
├── 📂 models/
│   └── 📂 text_encoders/
│       └── t5-base.safetensors
```

ファイルを配置した後、ComfyUI で **R** キーを押してノードを更新し、最新のモデルを読み込んでください。
