Skip to main content
elevenlabs/eleven_v3 的 API 参考文档,由 Comfy Router 从 Elevenlabs 提供。

快速开始

你的 Comfy 工作区中创建一个密钥,并将其导出为 COMFY_API_KEY。Python 和 TypeScript 代码片段使用 Comfy SDK(pip install comfy-sdknpm install @comfyorg/sdk);cURL 代码片段则是通过原生 HTTP 发起的同一调用。 模型 ID: elevenlabs/eleven_v3 端点: POST https://api.comfy.org/v2/models/elevenlabs/eleven_v3

Schema

输入

string
默认值:"\"auto\""
通过三种模式控制文本归一化: ‘auto’ - 系统自动决定是否应用文本归一化 ‘on’ - 始终应用文本归一化 ‘off’ - 跳过文本归一化可选值:autoonoff
object[]
必填
对话输入列表,每一项包含将被转换为语音的文本和语音 ID。 唯一语音 ID 的最大数量为 10。
string
必填
要转换为语音的文本。
string
必填
用于生成的语音 ID。
string
语言代码(ISO 639-1),用于为模型和文本归一化强制指定一种语言。 如果模型不支持所提供的语言代码,将返回错误。
string
将要使用的模型标识符。此路由仅接受 ‘eleven_v3’,不接受其他任何值;任何其他值都会在请求到达 ElevenLabs 之前以 400 拒绝。 上游 ElevenLabs 关于通过 GET /v1/models 查询 可用模型集合的建议并不适用于此路由,因为此路由只提供一个模型。 它不在本 schema 的 required 列表中,因为 Comfy Router 会从 /v2/models/elevenlabs/{model} 的 {model} 路径段中 填充该值,因此 Router 调用方会省略它。
object[]
要应用于文本的发音词典定位符列表(id、version_id)。 它们将按顺序应用。每次请求最多可使用 3 个定位符。
string
必填
发音词典的 ID
string
必填
发音词典的版本 ID
integer
如果指定,我们的系统将尽最大努力进行确定性采样。 使用相同种子和参数的重复请求应返回相同的结果。 必须是 0 到 4294967295 之间的整数。范围:04294967295
object
控制对话生成的设置
number
默认值:"0.5"
决定语音的稳定程度以及每次生成之间的随机性。 较低的值会为语音带来更广泛的情感范围。 较高的值可能导致语音单调、情感表达有限。格式:double
根据 Router 在 GET /v2/models/elevenlabs/eleven_v3/openapi.json 提供的 schema 生成,该文档与 Router 在请求到达提供商之前用于校验调用的文档相同。

输出

string (binary)
原始音频字节。Content-Type 和编码遵循所请求的 output_format,并从 ElevenLabs 原样转发。示例是二进制主体的占位符,不是 JSON 或 base64。

输出

Router 不发布此模型的输出 schema。

示例

输入

发布前须知

SDK 会生成 Idempotency-Key 并在自动重试中复用它。手动重试时,请复用原始 key。Router 最长可保持连接 10 分钟。 请求失败时,Router 会发送 X-Comfy-Error-Type 响应头说明原因。422 表示 Router 在调用提供商之前就拒绝了输入。生成的资源请及时下载,因为结果链接会过期

请求头

身份验证、幂等性、请求 ID、错误分类、重试节奏、消费限额。

使用 Router API

模型发现、校验错误、重试与计费。

限制

Router 目前不支持的功能,以及替代方案。