> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# FishAudioTextToSpeech - ComfyUI Built-in Node Documentation

> このノードは、Fish Audio のテキスト読み上げモデルを使用して、記述されたテキストを音声に変換します。

このノードは、Fish Audio のテキスト読み上げモデルを使用して、記述されたテキストを音声に変換します。テキストに埋め込まれた感情表現（s2.1-pro では `[happy]`、`[whispering]`、s1 では `(happy)`）や、複数のボイスを接続した場合の `@Voice1`/`@Voice2` タグによる多話者ダイアログに対応しています。利用可能なモデルは2つあります。最大5つのボイスと多話者ダイアログをサポートする s2.1-pro と、単一のオプショナルボイスを使用する s1 です。

## 入力

### 共通入力

| パラメータ   | 説明                                                                                           | データ型           | 必須 | 範囲                       |
| ------- | -------------------------------------------------------------------------------------------- | -------------- | -- | ------------------------ |
| `text`  | 音声に変換するテキストです。2つ以上のボイスを接続している場合は、`@Voice1`、`@Voice2` などで話者の切り替えを指定します。空にすることはできません。（デフォルト：空） | STRING         | はい | 空でない任意のテキスト              |
| `model` | テキスト読み上げに使用するモデルです。                                                                          | DYNAMIC\_COMBO | はい | `"s2.1-pro"`<br />`"s1"` |
| `seed`  | シードはノードを再実行するかどうかを制御します。結果はシードに関係なく非決定的です。（デフォルト：42）                                         | INT            | はい | 0〜2147483647             |

### s2.1-pro 入力

これらの入力は、s2.1-pro モデルが選択されたときに表示されます。

| パラメータ         | 説明                                                                                                                                                            | データ型             | 必須  | 範囲           |
| ------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------- | ---------------- | --- | ------------ |
| `voices`      | 追加可能スロット：1〜5個のボイスアイテム（`voice_1`、`voice_2`、...）を接続できます。合成に使用するボイスです。デフォルトのボイスを使用する場合は空のままにします。2つ以上のボイスを接続する場合は、テキスト内で `@Voice1`、`@Voice2` などを使って話者の切り替えを指定します。 | FISHAUDIO\_VOICE | いいえ | 0〜5 ボイス      |
| `temperature` | 表現力です。値が高いほど多様になり、低いほど一貫性が高くなります。（デフォルト：0.7）                                                                                                                  | FLOAT            | はい  | 0.0〜1.0      |
| `top_p`       | 核サンプリングによる多様性です。（デフォルト：0.7）                                                                                                                                   | FLOAT            | はい  | 0.01〜1.0     |
| `speed`       | 話速です。1.0が通常で、\<1.0は遅く、>1.0は速くなります。（デフォルト：1.0）                                                                                                                 | FLOAT            | はい  | 0.5〜2.0      |
| `volume`      | 音量調整（デシベル単位）です。0は変更なしです。（デフォルト：0.0）                                                                                                                           | FLOAT            | はい  | -10.0〜10.0   |
| `normalize`   | 英語と中国語の数字とテキストを正規化し、数字と日付の安定性を向上させます。（デフォルト：true）                                                                                                             | BOOLEAN          | はい  | true / false |

### s1 入力

これらの入力は、s1 モデルが選択されたときに表示されます。

| パラメータ         | 説明                                                | データ型             | 必須  | 範囲           |
| ------------- | ------------------------------------------------- | ---------------- | --- | ------------ |
| `voice`       | 合成に使用するボイスです。デフォルトのボイスを使用する場合は接続しないでください。         | FISHAUDIO\_VOICE | いいえ | オプションの単一ボイス  |
| `temperature` | 表現力です。値が高いほど多様になり、低いほど一貫性が高くなります。（デフォルト：0.7）      | FLOAT            | はい  | 0.0〜1.0      |
| `top_p`       | 核サンプリングによる多様性です。（デフォルト：0.7）                       | FLOAT            | はい  | 0.01〜1.0     |
| `speed`       | 話速です。1.0が通常で、\<1.0は遅く、>1.0は速くなります。（デフォルト：1.0）     | FLOAT            | はい  | 0.5〜2.0      |
| `volume`      | 音量調整（デシベル単位）です。0は変更なしです。（デフォルト：0.0）               | FLOAT            | はい  | -10.0〜10.0   |
| `normalize`   | 英語と中国語の数字とテキストを正規化し、数字と日付の安定性を向上させます。（デフォルト：true） | BOOLEAN          | はい  | true / false |

**注記：** `text` 入力は空にすることはできません。話者タグ（`@Voice1`、`@Voice2` など）は大文字と小文字を区別せず、接続されているボイスを参照する必要があります。接続されていないボイスをタグ付けするとエラーが発生します。2つ以上のボイスを接続する場合、テキストは接続されたすべてのボイスを少なくとも1回は参照する必要があります。参照がない場合は、ノードが不足しているタグを報告します。s2.1-pro では、0個のボイスを接続するとデフォルトのボイスが使用され、1個のボイスではそのボイスのみが使用され、2個以上のボイスで多話者ダイアログが有効になります。s1 では、オプションの単一ボイスが使用され、接続しない場合はデフォルトのボイスが使用されます。感情表現はテキスト内に配置できます。s2.1-pro では `[happy]` と `[whispering]`、s1 では `(happy)` です。

## 出力

| 出力名     | 説明             | データ型  |
| ------- | -------------- | ----- |
| `audio` | 生成された音声ファイルです。 | AUDIO |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/FishAudioTextToSpeech/ja.md)

***

**Source fingerprint (SHA-256):** `6cc005ae76fc7b60d9399b1b0a3c5de40a6eff47cd6f0f0b73b4212c0270ae29`
