입력
참고: VAE가 제공되면 노드는 제공된 모든 입력 이미지로부터 참조 레이턴트를 생성합니다. 한 번에 최대 3개의 이미지를 처리할 수 있습니다. 이미지는 비전-언어 처리를 위해 목표 영역 384x384픽셀(가로세로 비율 유지)로 조정되고, VAE 인코딩을 위해 목표 영역 1024x1024픽셀의 8로 나누어지는 크기로 조정됩니다.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
5eea53a84045924b44d445244e6149b341188d22573aaaced87bac8a139dac96