Skip to main content
synclabs/sync-3에 대한 API 레퍼런스로, Synclabs의 Comfy Router에서 제공합니다.

빠른 시작

Comfy 워크스페이스에서 키를 생성하고 COMFY_API_KEY로 내보내세요. Python 및 TypeScript 스니펫은 Comfy SDK(pip install comfy-sdk 및 npm install @comfyorg/sdk)를 사용하며, cURL 스니펫은 동일한 호출을 원시 HTTP로 수행한 것입니다. 모델 ID: synclabs/sync-3 엔드포인트: POST https://api.comfy.org/v2/models/synclabs/sync-3
동일한 본문을 POST https://api.comfy.org/v2/models/synclabs/sync-3/requests로 전송합니다. Router는 실행이 승인되는 즉시 request_id와 함께 201로 응답하며, 결과는 준비되면 이 프로세스에서든 다른 프로세스에서든 수집할 수 있습니다. 대기 중 전달에서 상태, 취소, 수집 과정을 안내합니다.

스키마

입력

object
Sync Labs 생성 요청에 첨부되는 더빙 파라미터
integer
소스 비디오의 화자 수이며, 0으로 설정하면 자동 감지가 활성화됩니다
string
필수
더빙에 사용할 공급자 (예: elevenlabs)
string
소스 언어 코드이며, 기본값은 auto입니다
string
필수
더빙 대상 언어 코드
object[]
필수
입력 항목이며, 시각 입력(비디오 또는 이미지) 하나와 오디오 또는 텍스트 입력 하나가 정확히 필요합니다
string
Sync Labs 미디어 라이브러리에 있는 에셋의 ID
object
Sync Labs 텍스트 입력을 위한 텍스트 기반 음성 생성 공급자 구성
string
필수
TTS 공급자 이름 (예: elevenlabs)
string
필수
생성에 사용할 스크립트
number
AI가 원본 음성에 얼마나 밀접하게 따라야 하는지형식: double
number
음성 안정성이며, 값이 낮을수록 감정 표현의 폭이 넓어집니다형식: double
string
필수
Sync 음성 ID(Studio에서 복제한 음성) 또는 ElevenLabs 음성 ID
string
이 입력을 세그먼트 정의에 연결하는 데 사용되는 참조 식별자
integer[][]
지원 중단됨 - 대신 최상위 segments 배열을 사용하세요
number[][]
지원 중단됨 - 대신 최상위 segments 배열을 사용하세요
string
필수
입력 유형 (video, image, audio, text 중 하나)
string
생성에 사용할 미디어의 URL
string
생성에 사용할 모델 이름이며, sync-3만 지원됩니다. Comfy Router 경로 POST /v2/models/synclabs/{model}에서는 이 필드가 경로에서 제공되므로 생략할 수 있습니다.
object
Sync Labs 생성에 사용할 수 있는 추가 옵션
object
활성 화자 감지 구성
boolean
활성 화자를 자동으로 감지하여 생성 결과를 적용할지 여부
integer[][]
감지된 얼굴에 대한 프레임별 바운딩 박스 [x1, y1, x2, y2] 배열
string
바운딩 박스를 담고 있는 JSON 파일의 URL
integer[]
frame_number로 식별되는 소스 비디오 프레임의 픽셀 좌표 [x, y]
integer
수동 화자 선택을 위해 제공된 좌표에 대응하는 프레임 인덱스
boolean
ASD v3를 사용할지 여부
string
모델이 편집할 영역 (lips, face, head)이며, react-1에서만 작동합니다
boolean
생성 중 가림(occlusion)을 감지할지 여부
string
감정 프롬프트이며, react-1에서만 작동합니다
string
비디오와 오디오 간 재생 시간 불일치를 처리하는 방식 (bounce, loop, cut_off, silence, remap)
number
립싱크가 얼마나 표현력 있게 생성될 수 있는지, 0에서 1 사이형식: double
string
확장자를 제외한 생성된 출력의 기본 파일 이름
string
선택적으로 이 생성을 Sync Labs 프로젝트에 연결합니다
object[]
서로 다른 비디오 세그먼트에 서로 다른 오디오 입력을 적용하는 세그먼트 정의
object
필수
특정 세그먼트의 오디오 입력 구성
number
참조된 오디오를 잘라낼 선택적 종료 시간(초)형식: double
string
필수
이 세그먼트에 사용할 오디오/텍스트 기반 음성 생성 입력의 참조 ID
number
참조된 오디오를 잘라낼 선택적 시작 시간(초)형식: double
number
필수
세그먼트 종료 시간(초)형식: double
object
특정 세그먼트의 생성 옵션 재정의
object
활성 화자 감지 구성
boolean
활성 화자에 대해 자동으로 감지하고 생성을 적용할지 여부
integer[][]
감지된 얼굴에 대한 프레임별 바운딩 박스 [x1, y1, x2, y2] 배열
string
바운딩 박스를 포함하는 JSON 파일의 URL
integer[]
frame_number로 식별되는 소스 비디오 프레임의 픽셀 좌표 [x, y]
integer
수동 화자 선택을 위해 제공된 좌표에 대응하는 프레임 인덱스
boolean
ASD v3를 사용할지 여부
boolean
이 세그먼트에 대한 가림 감지 재정의
string
이 세그먼트의 sync 모드 재정의
number
이 세그먼트의 temperature(0-1) 재정의형식: double
number
필수
세그먼트 시작 시간(초)형식: double
string
생성 상태 업데이트를 위한 Webhook URL
Router가 GET /v2/models/synclabs/sync-3/openapi.json에서 제공하는 스키마에서 생성되었으며, 이는 요청이 공급자에 도달하기 이전에 호출을 검증하는 대상이 되는 동일한 문서입니다.

출력

string
생성이 만들어진 날짜와 시간
string
생성에 실패한 경우의 오류 메시지
string
생성에 실패한 경우의 안정적이고 기계 판독 가능한 오류 코드
string
생성의 고유 식별자
object[]
생성에 사용된 입력 항목
string
Sync Labs 미디어 라이브러리에 있는 에셋의 ID
object
Sync Labs 텍스트 입력에 대한 텍스트 기반 음성 생성 공급자 구성
string
필수
TTS 공급자 이름(예: elevenlabs)
string
필수
생성에 사용할 스크립트
number
AI가 원본 음성에 얼마나 밀접하게 따를지형식: double
number
음성 안정성. 값이 낮을수록 감정 표현 범위가 넓어집니다형식: double
string
필수
Sync 음성 id(Studio에서 복제한 음성) 또는 ElevenLabs 음성 ID
string
이 입력을 세그먼트 정의에 연결하는 데 사용되는 참조 식별자
integer[][]
지원 중단됨 - 대신 최상위 segments 배열을 사용하세요
number[][]
지원 중단됨 - 대신 최상위 segments 배열을 사용하세요
string
필수
입력 유형(video, image, audio, text)
string
생성에 사용할 미디어의 URL
string
생성에 사용된 모델 이름
object
Sync Labs 생성에 사용할 수 있는 추가 옵션
object
활성 화자 감지 구성
boolean
활성 화자를 자동으로 감지하여 생성 결과를 적용할지 여부
integer[][]
감지된 얼굴에 대한 프레임별 바운딩 박스 [x1, y1, x2, y2] 배열
string
바운딩 박스를 포함하는 JSON 파일의 URL
integer[]
frame_number로 식별되는 소스 비디오 프레임의 픽셀 좌표 [x, y]
integer
수동 화자 선택을 위해 제공된 좌표에 해당하는 프레임 인덱스
boolean
ASD v3를 사용할지 여부
string
모델의 편집 영역(lips, face, head). react-1에서만 작동합니다
boolean
생성 중 가림 현상을 감지할지 여부
string
감정 프롬프트. react-1에서만 작동합니다
string
비디오와 오디오 간 재생 시간 불일치를 처리하는 방법(bounce, loop, cut_off, silence, remap)
number
립싱크의 표현 정도, 0에서 1형식: double
number
출력 미디어의 재생 시간(초)형식: double
string
출력 미디어에 적용된 정제된 파일 이름
string
출력 미디어의 URL
string
이 생성이 속한 프로젝트의 id
string
세그먼트 출력 미디어의 URL
object[]
생성의 세그먼트
object
필수
특정 세그먼트에 대한 오디오 입력 구성
number
참조된 오디오를 자를 선택적 종료 시간(초)형식: double
string
필수
이 세그먼트에 사용할 오디오/텍스트 기반 음성 생성 입력의 참조 ID
number
참조된 오디오를 자를 선택적 시작 시간(초)형식: double
number
필수
세그먼트 종료 시간(초)형식: double
object
특정 세그먼트의 생성 옵션 재정의
object
활성 화자 감지 구성
boolean
활성 화자를 자동으로 감지하고 생성 결과를 적용할지 여부
integer[][]
감지된 얼굴에 대한 프레임별 바운딩 박스 [x1, y1, x2, y2] 배열
string
바운딩 박스를 포함하는 JSON 파일의 URL
integer[]
frame_number로 식별된 소스 비디오 프레임의 픽셀 좌표 [x, y]
integer
수동 화자 선택을 위해 제공된 좌표에 해당하는 프레임 인덱스
boolean
ASD v3를 사용할지 여부
boolean
이 세그먼트에 대한 가림 감지 재정의
string
이 세그먼트의 sync 모드 재정의
number
이 세그먼트의 temperature (0-1) 재정의형식: double
number
필수
세그먼트 시작 시간(초)형식: double
string
생성 상태 (PENDING, PROCESSING, COMPLETED, FAILED, REJECTED)
string
텍스트(TTS) 입력에서 합성된 오디오의 URL
string
webhook 엔드포인트의 URL

예시

입력

출력

배포 전 확인

SDK는 Idempotency-Key를 생성하고 자동 재시도에 재사용합니다. 수동으로 재시도할 때는 원본 키를 재사용하세요. Router는 연결을 최대 10분간 유지할 수 있습니다. 요청이 실패하면 Router는 그 이유를 설명하는 X-Comfy-Error-Type 응답 헤더를 보냅니다. 422는 Router가 공급자를 호출하기 전에 입력을 거부했음을 의미하고, 413은 요청 본문이 Router가 허용하는 크기보다 컸음을 의미합니다. 결과 URL이 만료될 수 있으므로 생성된 에셋은 즉시 다운로드하세요. 위의 필드 설명에 명시된 크기 제한은 해당 필드에 대한 공급자 자체의 한도이며, 공급자 사양에서 인용한 것입니다. Router는 전체 요청 본문에 별도의 상한을 적용하며, base64로 인코딩된 미디어도 여기에 포함됩니다. 요청 본문 크기를 참고하세요. 이 페이지는 Comfy Router를 통해 호출하는 하나의 파트너 모델을 설명합니다. 동일한 comfy-sdk / @comfyorg/sdk 패키지에는 Comfy Cloud에서 전체 ComfyUI 워크플로 그래프를 실행하기 위한 두 번째 클라이언트도 포함되어 있습니다: Comfy(api_key=...) / new Comfy({ apiKey }), 그리고 client.workflows, client.assets, client.jobs가 있습니다. Comfy SDKs를 참조하세요.

헤더

인증, 멱등성, 요청 ID, 오류 분류, 재시도 간격, 지출 한도.

Router API 사용

모델 검색, 검증 오류, 재시도, 과금.

제한 사항

Router가 현재 지원하지 않는 기능과 대신 사용할 방법.