MoGe-3는 칭화대, 중국과학기술대, Microsoft Research 연구진이 개발한 기하 추정 모델입니다. 사진에서 실제 스케일의 깊이, 포인트 맵, 법선과 카메라 기하를 예측해 깊이 기반 편집과 장면 복원에 활용할 수 있습니다.
가는 구조를 3D 공간에서 정교화하는 이유
이미지에서 인접한 픽셀이 3D에서는 멀리 떨어진 표면일 수 있습니다. 특징을 섞으면 난간, 식물과 작은 물체의 기하가 뭉개집니다.
Self-Guided Sparse Refinement는 초기 포인트 맵을 복셀 셸로 올립니다. 희소 3D 합성곱이 공간 이웃을 사용하고 반복으로 더 섬세한 구조를 회복합니다.
사진에서 내보낼 수 있는 것
MoGe 도구는 포인트 맵, 깊이, 노멀과 카메라 시야각을 지원합니다. 추론 CLI는 맵과 GLB·PLY 기하 파일을 저장합니다.
GLB는 이미지 색상을 텍스처로 저장해 3D 뷰어에서 확인하기 좋습니다. PLY는 정점에 색상을 저장해 기하 및 포인트 클라우드 처리에 적합합니다. 사용할 편집기나 처리 과정에 맞춰 선택하세요.
체크포인트를 지정해 MoGe-3 실행
Python 3.10 이상에서 저장소 의존성을 설치하세요. --version v3로 모델 버전을 선택하고 --pretrained PATH_TO_CKPT.pt로 MoGe-3 체크포인트를 지정합니다.
아래 명령은 세 번 정교화해 맵과 기하를 내보냅니다. 반복 횟수와 입력 해상도는 다른 설정입니다. 얇은 구조와 경계를 비교한 뒤 횟수를 늘리세요.
moge infer -i photo.jpg \
--version v3 \
--pretrained PATH_TO_CKPT.pt \
--refine_steps 3 \
--output output \
--maps --glb --ply 장면 기하와 완전한 자산의 선택
사진에 보이는 표면의 배치가 필요하면 MoGe-3를 사용하세요. 깊이 기반 합성, 방 표면의 초기 복원과 기하 검사에 유용합니다.
모든 방향에서 볼 제품, 소품이나 캐릭터가 필요하면 이미지-to-3D 생성을 사용하세요. 둘 다 3D 파일을 만들지만 해결하는 목적이 다릅니다.
MoGe-3와 3D 자산 생성
| 목적 | MoGe-3 | 자산 생성 |
|---|---|---|
| 주요 목표 | 보이는 장면 기하 복원 | 완전하고 재사용 가능한 객체 |
| 입력 | 장면 또는 물체 사진 | 선명한 대상 참고 이미지 |
| 숨은 표면 | 보이지 않는 기하를 측정하지 않음 | 생성 모델이 보완 |
| 출력 | 깊이·포인트 맵, GLB, PLY | 객체 메시와 재질 |
자주 묻는 질문
MoGe-3가 TRELLIS 3인가요?
별개 프로젝트입니다. TRELLIS는 자산을 생성하고 MoGe는 이미지의 가시 정보로 기하를 추정합니다.
어떤 MoGe-3 체크포인트를 선택할 수 있나요?
공식 모델은 3억 7천만 파라미터의 ViT-L과 12억 5천만 파라미터의 ViT-G입니다. 둘 다 실제 스케일 기하와 법선 맵을 지원합니다. 선택한 체크포인트를 다운로드하고 --version v3와 함께 --pretrained로 전달하세요.
공식 코드가 macOS에서 작동하나요?
현재 지원하지 않습니다. FlexGEMM이 의존하는 Triton에는 macOS 패키지가 없습니다. 호환 환경이나 공식 데모를 사용하세요.
온라인 데모나 ComfyUI 지원이 있나요?
Ruicheng/MoGe-3 Hugging Face 데모가 있습니다. 2026년 9월 21일 ComfyUI v0.37.0에도 MoGe 3 지원이 추가됐습니다.