H3 얼굴 잠금은 R2V입니다…정본을 매번 넣습니다
같은 인물을 여러 컷에 쓸 때, MiniMax H3에서는 학습 슬롯 대신 Reference-to-Video로 정본을 매번 넣습니다. 이 글은 공개 노드·가중치 이름과 검수 순서만 적습니다.
사실: R2V와 I2V는 한 요청에 같이 못 씁니다

같은 얼굴·옷·제품을 새 장면으로 옮길 때는 R2V(Omni Reference)입니다. ComfyUI 노드는 MiniMaxH3ReferenceToVideo, 가중치는 minimax_h3_ref2va입니다. 시작(또는 끝) 구도를 그대로 살릴 때는 I2V/FL2VA, 노드 MiniMaxH3ImageToVideo, 가중치 minimax_h3_fl2va입니다.
얼굴이 우선이면 R2V를 고르고 시작 구도는 프롬프트로 적습니다. 첫 장 고정이 우선이면 I2V를 쓰고, 뒤 프레임 얼굴이 달라질 수 있습니다.
사실: 참조는 역할마다 나눕니다

공개 가이드 기준 참조 이미지는 최대 9장, 참조 영상 최대 3개, 참조 오디오 최대 3개입니다. 정본은 배경이 깨끗한 정면·시트·여러 각도가 잘 붙습니다. 복잡한 라이프스타일 컷만 넣으면 약합니다.
연결 순서대로 프롬프트에서 부릅니다. @image1, @image2 또는 Image 1, Image 2입니다. 예: @image1은 얼굴, @image2는 옷, @image3는 장소. ref_image_size는 기본 match이고, 얼굴이 풀린 컷만 max(짧은 변 최대 2048)로 올립니다. 역할 없는 더미는 서로 섞입니다.
속도 칸은 매 요청 같이 켭니다. 스텝 20, UNET 뒤 ModelAttentionBackend = comfy kitchen attention, ref_image_size: match. turbo LoRA 파일명 minimax_h3_fl2v_turbo_*는 R2V(ref2va)에 붙이지 않습니다. turbo는 I2V/FL2V·짧은 프레임 구간용입니다.
출처: R2V 프롬프트 가이드, ComfyUI 튜토리얼
해석: 프롬프트에 표식을 문장으로 적고, 눈으로 검수합니다

“Image 1 써”만 쓰면 흐려집니다. 유지할 머리·눈·옷·브로치 같은 표식을 문장으로 적습니다. 여러 컷을 이을 때는 매 클립 앞에 같은 이름·같은 참조를 반복합니다.
스틸을 뽑을 때는 R2V로 짧은 영상을 만든 뒤, 앞쪽 안정 프레임만 씁니다. 후반 드리프트는 버립니다. 정본과 나란히 놓고 사람 눈으로 같은 사람인지 봅니다. 임베딩 점수가 높아도 다른 사람으로 보일 수 있습니다.
이 해석은 공개 규칙에 현장 검수 순서를 붙인 것입니다. 내부 그래프 JSON·서버 주소는 올리지 않습니다.
출처: 위 공개 가이드
🛒 오늘의 추천 상품
정본·검수할 때 자주 찾습니다.
SD카드
참조 사진·클립을 옮길 때 씁니다.
모니터암
정본과 결과물을 나란히 볼 때 씁니다.
웹캠
시트 정면 촬영용으로 찾습니다.
이 포스팅은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.
한줄 정리
같은 얼굴을 유지하려면 R2V입니다. 정본 역할·스텝 20·사람 눈 검수를 같이 적습니다.
💬 댓글 0