
ContextAnyone — 참조 이미지 1장으로 캐릭터를 끝까지 지키는 영상 생성 (얼굴 너머의 외형까지)
캐릭터 일관성 유지 T2V 생성. 참조 이미지를 재구축하며 생성하는 Context-Aware 디퓨전 프레임워크. 실측: ArcFace 0.6003, VLM-Appearance 0.9457 (VACE/Phantom 대비 SOTA). Emphasize-Attention, 이중 가이던스, Gap-RoPE.
Tag
이 주제로 기록된 글 1개를 모았습니다.

캐릭터 일관성 유지 T2V 생성. 참조 이미지를 재구축하며 생성하는 Context-Aware 디퓨전 프레임워크. 실측: ArcFace 0.6003, VLM-Appearance 0.9457 (VACE/Phantom 대비 SOTA). Emphasize-Attention, 이중 가이던스, Gap-RoPE.