입력
참고: 노드가 작동하려면 최소 하나의 뷰 입력이 제공되어야 합니다. 노드는 유효한 CLIP vision 출력 데이터를 포함하는 뷰만 처리하고, 연결되지 않은 뷰는 건너뜁니다. 각 뷰는 해당 슬롯(front, left, back, right)에 따라 고정된 위치 인코딩을 받으며, 제공된 모든 뷰에서 처리된 임베딩은 시퀀스 차원을 따라 함께 결합됩니다.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
1492b51661d0bb8f2c142c1b1e8ef104beed1b9dae532a970e2928e27ad71d69