[논문리뷰] Depth Anything: Unleashing the Power of Large-Scale Unlabeled Data (CVPR 2024)
62M unlabeled 이미지 self-training과 DINOv2 feature alignment로 만든 zero-shot MDE foundation model, Depth Anything 논문 리뷰
62M unlabeled 이미지 self-training과 DINOv2 feature alignment로 만든 zero-shot MDE foundation model, Depth Anything 논문 리뷰
matching을 3D 문제로 정식화해 DUSt3R에 local feature head와 InfoNCE loss를 더하고 Map-free localization에서 30%p 개선을 이룬 MASt3R 논문 리뷰
카메라 calibration도 pose도 없이 이미지 쌍에서 pointmap을 직접 회귀해, depth·대응·pose·3D 복원까지 기하 3D 비전 과제 전체를 하나의 모델로 푸는 DUSt3R 논문 리뷰
attention의 병목을 FLOPs가 아닌 HBM 접근으로 규정하고 tiling·recomputation으로 O(N) 메모리의 exact attention을 구현한 FlashAttention 논문 리뷰
SAM 기반 ISM과 background token point matching의 PEM으로 zero-shot 6D pose를 구하는 SAM-6D 논문 리뷰
기준점·측정점을 잇는 최적 rigid transform (R, t)을 SVD 한 번으로 구하는 Kabsch 알고리즘
volume rendering의 NeRF와 rasterization의 3DGS, 신경망 기반 연속 표현 비교
부호 거리로 표면을 담는 TSDF와 삼각형 mesh를 뽑아내는 Marching Cubes
outlier 필터와 voxel downsampling으로 point cloud를 다듬는 전처리 기법
SfM(incremental·bundle adjustment)과 MVS로 이어지는 전통 3D reconstruction 파이프라인