> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-sync-comfy-api-v2-spec-462120c.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Qwen3.5 ComfyUI ワークフロー例

> Qwen3.5 は Alibaba Cloud のオープンソースマルチモーダル大規模言語モデルで、画像理解とテキスト生成機能を持ち、画像キャプション作成やリバースプロンプトエンジニアリングに対応します。

<Tip>
  <Tabs>
    <Tab title="ローカルユーザー">
      ComfyUI が最新版に更新されていることを確認してください。

      * [ComfyUI のダウンロード](https://www.comfy.org/download)
      * [更新手順](/ja/installation/update_comfyui)

      このガイドで紹介するワークフローは、[ワークフローテンプレート](/ja/interface/features/template)から入手できます。
      テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。

      ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因：

      1. 最新の ComfyUI（Nightly 版）を使用していない
      2. 起動時に一部のノードのインポートに失敗している
    </Tab>

    <Tab title="クラウドユーザー">
      * [Cloud](https://cloud.comfy.org) は、ComfyUI の安定版リリース後に更新されます。

      したがって、このドキュメントでコアノードが見つからない場合、それは新しいコアノードがまだ最新の安定版にリリースされていない可能性があります。次回の安定版リリースをお待ちください。
    </Tab>
  </Tabs>
</Tip>

**Qwen3.5** は Alibaba Cloud のオープンソースマルチモーダル大規模言語モデルで、Qwen 3.0 シリーズに画像理解機能を追加したものです。テキスト生成と、画像キャプション作成やリバースプロンプトエンジニアリングなどの画像ベースのタスクの両方をサポートします。

**モデルのハイライト**：

* **マルチモーダル** — テキストと画像の入力を受け付け、視覚的理解タスクに対応
* **画像キャプション作成** — 画像を説明し、詳細なキャプションを生成
* **リバースプロンプトエンジニアリング** — 参照画像からプロンプトと生成パラメータを抽出
* **ComfyUI ネイティブ** — 組み込みの `TextGenerate` ノードを使用、カスタムノード不要
* **軽量** — 4B パラメータモデル、コンシューマー GPU に適切

## 使用例

Qwen3.5 は、視覚的理解とテキスト生成の組み合わせが ComfyUI ワークフローに付加価値をもたらすシナリオで力を発揮します：

* **画像からのプロンプト逆生成** — 参照画像を Qwen3.5 に渡し、その画像を再現できる詳細なテキストプロンプトを生成させます。良い画像を見つけてもプロンプトがわからない場合に特に便利です。
* **プロンプト最適化** — 既存のプロンプトと画像コンセプトを読み込み、Qwen3.5 に生成、洗練、または拡張を依頼してよりリッチな記述を得ます。
* **画像キャプション作成** — 生成された画像のキャプション、説明、メタデータタグを自動生成。作品のカタログ化やトレーニングデータの準備に役立ちます。
* **ビジュアル質問応答** — 画像コンテンツに関する質問（「このシーンには何がある？」「背景は何色？」）に対して構造化されたテキスト回答を得ます。
* **テキスト読み取り** — 適切なプロンプトを使用すると、モデルが画像内のテキストやラベルを読み取ろうとすることがありますが、信頼性は文字の品質と鮮明さに依存します。

## 利用可能なワークフロー

<h3 id="llm_qwen3_5_text_gen">
  Qwen3.5: テキスト生成
</h3>

Qwen3.5 モデルを使用して入力画像を分析し、説明的なテキストプロンプトを生成します。このワークフローは、画像キャプション作成とリバースプロンプトエンジニアリングを実行します。

<img src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/templates/llm_qwen3_5_text_gen-1.webp" alt="Qwen3.5 テキスト生成ワークフローのプレビュー" />

<CardGroup cols={2}>
  <Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=llm_qwen3_5_text_gen&utm_source=docs&utm_medium=referral&utm_campaign=qwen3_5">
    Comfy Cloud で開く
  </Card>

  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/llm_qwen3_5_text_gen.json">
    JSON をダウンロードするか、テンプレートライブラリで「Qwen3.5: テキスト生成」を検索してください。
  </Card>
</CardGroup>

**入力ファイル**

このファイルを対応する `LoadImage` ノードにアップロードしてください:

<CardGroup cols={2}>
  <Card title="man_with_red_hat.png" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/man_with_red_hat.png">
    `LoadImage` ノード 2 · `man_with_red_hat.png`
  </Card>
</CardGroup>

<div style={{display: 'grid', gridTemplateColumns: 'repeat(2, minmax(0, 1fr))', gap: '1rem', alignItems: 'start'}}>
  <img src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/man_with_red_hat.png" alt="入力画像" style={{width: '100%', height: 'auto', objectFit: 'contain'}} />
</div>

このワークフローは、Qwen3.5 の**テキスト生成と画像理解**機能を示します。テキストプロンプトとオプションの画像を受け取り、入力に基づいて説明的なテキストまたは構造化分析を生成します。

**入力**:

* **テキストプロンプト**: 質問、指示、またはタスクの説明
* **画像**（オプション）: 視覚的理解タスク用（画像キャプション作成、リバースプロンプトエンジニアリング、プロンプト最適化など）

**主要なコントロール**:

* **最大長**: 生成する最大トークン数（デフォルト: 256）
* **サンプリングモード**: サンプリングのオン/オフを切り替え、温度、top-k、top-p、繰り返しペナルティ、シードを調整します
* **デフォルトテンプレートを使用**: モデルに組み込まれたシステムプロンプトを適用します

**出力**:

* **生成されたテキスト**: モデルの応答をプレーンテキスト文字列として返します

<Card title="サブグラフについて" icon="book-open" href="/ja/interface/features/subgraph">
  このワークフローはサブグラフノードを使用してモジュール処理を行います。サブグラフのドキュメントを確認して、ワークフローをカスタマイズおよび拡張する方法を学んでください。
</Card>

## モデルのダウンロード

Qwen3.5 モデルは ComfyUI でテキストエンコーダーとして読み込まれます。ハードウェアに合わせて適切なバージョンを選択してください：

<Card title="Qwen3.5 2B (bf16)" icon="download" href="https://huggingface.co/Comfy-Org/Qwen3.5/resolve/main/text_encoders/qwen3.5_2b_bf16.safetensors">
  軽量版、約 4.5 GB。低 VRAM 環境や高速ダウンロードに最適。
</Card>

<Card title="Qwen3.5 4B (bf16)" icon="download" href="https://huggingface.co/Comfy-Org/Qwen3.5/resolve/main/text_encoders/qwen3.5_4b_bf16.safetensors">
  サイズと品質のバランス型。ほとんどのコンシューマー GPU に推奨。
</Card>

<Card title="Qwen3.5 9B (bf16)" icon="download" href="https://huggingface.co/Comfy-Org/Qwen3.5/resolve/main/text_encoders/qwen3.5_9b_bf16.safetensors">
  最大版、約 19 GB。より高品質な出力、より多くの VRAM が必要。
</Card>

ダウンロードした `.safetensors` ファイルを以下の場所に配置：

```
📂 ComfyUI/
├── 📂 models/
│   └── 📂 text_encoders/
│       └── qwen3.5_4b_bf16.safetensors   # または 2b / 9b バージョン
```
