> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# FishAudioTextToSpeech - ComfyUI Built-in Node Documentation

> 이 노드는 Fish Audio 텍스트 음성 변환 모델을 사용하여 작성된 텍스트를 음성 오디오로 변환합니다. 텍스트에 삽입된 감정 큐(s2.1-pro의 경우 [happy], [whispering], s1의 경우 (happy))를 지원하며, 여러 음성이 연결된 경우 @Voice1/@Voice2 태그를 사용한 다중 화자 대화를

이 노드는 Fish Audio 텍스트 음성 변환 모델을 사용하여 작성된 텍스트를 음성 오디오로 변환합니다. 텍스트에 삽입된 감정 큐(s2.1-pro의 경우 \[happy], \[whispering], s1의 경우 (happy))를 지원하며, 여러 음성이 연결된 경우 @Voice1/@Voice2 태그를 사용한 다중 화자 대화를 지원합니다. 사용 가능한 모델은 두 가지입니다: 최대 5개의 음성과 다중 화자 대화를 지원하는 s2.1-pro와 단일 선택적 음성을 사용하는 s1입니다.

## 입력

### 공통 입력

| 매개변수    | 설명                                                                                                | 데이터 타입         | 필수 여부 | 범위                   |
| ------- | ------------------------------------------------------------------------------------------------- | -------------- | ----- | -------------------- |
| `text`  | 음성으로 변환할 텍스트입니다. 두 개 이상의 음성이 연결된 경우 @Voice1, @Voice2 등으로 화자 변경을 표시하세요. 비어 있으면 안 됩니다. (기본값: 비어 있음) | STRING         | 예     | 비어 있지 않은 모든 텍스트      |
| `model` | 텍스트 음성 변환에 사용할 모델입니다.                                                                             | DYNAMIC\_COMBO | 예     | "s2.1-pro"<br />"s1" |
| `seed`  | 시드는 노드의 재실행 여부를 제어합니다. 결과는 시드와 관계없이 비결정적입니다. (기본값: 42)                                            | INT            | 예     | 0 \~ 2147483647      |

### s2.1-pro 입력

이 입력은 s2.1-pro 모델이 선택된 경우 표시됩니다.

| 매개변수          | 설명                                                                                                                                                              | 데이터 타입           | 필수 여부 | 범위            |
| ------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------------- | ---------------- | ----- | ------------- |
| `voices`      | 확장 가능한 슬롯: 1\~5개의 음성 항목(`voice_1`, `voice_2`, ...)을 연결할 수 있습니다. 합성에 사용할 음성입니다. 기본 음성을 사용하려면 비워 두세요. 두 개 이상의 음성이 연결된 경우 텍스트에서 @Voice1, @Voice2 등으로 화자 변경을 표시하세요. | FISHAUDIO\_VOICE | 아니요   | 0 \~ 5개 음성    |
| `temperature` | 표현력입니다. 값이 높을수록 더 다양해지고, 값이 낮을수록 더 일관적입니다. (기본값: 0.7)                                                                                                           | FLOAT            | 예     | 0.0 \~ 1.0    |
| `top_p`       | 핵심 샘플링(nucleus sampling)을 통한 다양성입니다. (기본값: 0.7)                                                                                                                 | FLOAT            | 예     | 0.01 \~ 1.0   |
| `speed`       | 말하기 속도입니다. 1.0이 보통이며, \<1.0이면 더 느리게, >1.0이면 더 빠르게 말합니다. (기본값: 1.0)                                                                                              | FLOAT            | 예     | 0.5 \~ 2.0    |
| `volume`      | 데시벨 단위의 음량 조절입니다. 0은 변경 없음입니다. (기본값: 0.0)                                                                                                                       | FLOAT            | 예     | -10.0 \~ 10.0 |
| `normalize`   | 영어와 중국어의 숫자 및 텍스트를 정규화하여 숫자와 날짜의 안정성을 향상시킵니다. (기본값: true)                                                                                                       | BOOLEAN          | 예     | true / false  |

### s1 입력

이 입력은 s1 모델이 선택된 경우 표시됩니다.

| 매개변수          | 설명                                                                 | 데이터 타입           | 필수 여부 | 범위            |
| ------------- | ------------------------------------------------------------------ | ---------------- | ----- | ------------- |
| `voice`       | 합성에 사용할 음성입니다. 기본 음성을 사용하려면 연결하지 않은 상태로 두세요.                       | FISHAUDIO\_VOICE | 아니요   | 선택적 단일 음성     |
| `temperature` | 표현력입니다. 값이 높을수록 더 다양해지고, 값이 낮을수록 더 일관적입니다. (기본값: 0.7)              | FLOAT            | 예     | 0.0 \~ 1.0    |
| `top_p`       | 핵심 샘플링(nucleus sampling)을 통한 다양성입니다. (기본값: 0.7)                    | FLOAT            | 예     | 0.01 \~ 1.0   |
| `speed`       | 말하기 속도입니다. 1.0이 보통이며, \<1.0이면 더 느리게, >1.0이면 더 빠르게 말합니다. (기본값: 1.0) | FLOAT            | 예     | 0.5 \~ 2.0    |
| `volume`      | 데시벨 단위의 음량 조절입니다. 0은 변경 없음입니다. (기본값: 0.0)                          | FLOAT            | 예     | -10.0 \~ 10.0 |
| `normalize`   | 영어와 중국어의 숫자 및 텍스트를 정규화하여 숫자와 날짜의 안정성을 향상시킵니다. (기본값: true)          | BOOLEAN          | 예     | true / false  |

**참고:** `text` 입력은 비어 있으면 안 됩니다. 화자 태그(@Voice1, @Voice2 등)는 대소문자를 구분하지 않으며 연결된 음성을 참조해야 합니다. 연결되지 않은 음성을 태그하면 오류가 발생합니다. 두 개 이상의 음성이 연결된 경우 텍스트는 연결된 모든 음성을 최소한 한 번 이상 참조해야 하며, 그렇지 않으면 노드가 누락된 태그를 보고합니다. s2.1-pro에서는 음성을 0개 연결하면 기본 음성을 사용하고, 1개를 연결하면 해당 음성만 사용하며, 2개 이상을 연결하면 다중 화자 대화를 사용할 수 있습니다. s1에서는 단일 선택적 음성을 사용하며, 연결하지 않으면 기본 음성을 사용합니다. 감정 큐는 텍스트에 배치할 수 있습니다: s2.1-pro에서는 \[happy] 및 \[whispering], s1에서는 (happy)입니다.

## 출력

| 출력 이름   | 설명                    | 데이터 타입 |
| ------- | --------------------- | ------ |
| `audio` | 생성된 음성을 담은 오디오 파일입니다. | AUDIO  |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/FishAudioTextToSpeech/ko.md)

***

**Source fingerprint (SHA-256):** `6cc005ae76fc7b60d9399b1b0a3c5de40a6eff47cd6f0f0b73b4212c0270ae29`
