[논문리뷰] Depth Anything: Unleashing the Power of Large-Scale Unlabeled Data (CVPR 2024)
62M unlabeled 이미지 self-training과 DINOv2 feature alignment로 만든 zero-shot MDE foundation model, Depth Anything 논문 리뷰
62M unlabeled 이미지 self-training과 DINOv2 feature alignment로 만든 zero-shot MDE foundation model, Depth Anything 논문 리뷰
matching을 3D 문제로 정식화해 DUSt3R에 local feature head와 InfoNCE loss를 더하고 Map-free localization에서 30%p 개선을 이룬 MASt3R 논문 리뷰
카메라 calibration도 pose도 없이 이미지 쌍에서 pointmap을 직접 회귀해, depth·대응·pose·3D 복원까지 기하 3D 비전 과제 전체를 하나의 모델로 푸는 DUSt3R 논문 리뷰
attention의 병목을 FLOPs가 아닌 HBM 접근으로 규정하고 tiling·recomputation으로 O(N) 메모리의 exact attention을 구현한 FlashAttention 논문 리뷰
SAM 기반 ISM과 background token point matching의 PEM으로 zero-shot 6D pose를 구하는 SAM-6D 논문 리뷰
기준점·측정점을 잇는 최적 rigid transform (R, t)을 SVD 한 번으로 구하는 Kabsch 알고리즘
volume rendering의 NeRF와 rasterization의 3DGS, 신경망 기반 연속 표현 비교
부호 거리로 표면을 담는 TSDF와 삼각형 mesh를 뽑아내는 Marching Cubes
outlier 필터와 voxel downsampling으로 point cloud를 다듬는 전처리 기법
SfM(incremental·bundle adjustment)과 MVS로 이어지는 전통 3D reconstruction 파이프라인
카메라 투영 모델·calibration·epipolar geometry·RANSAC·triangulation까지, 두 시점 3D 복원의 기하학
기초 기하학부터 point cloud·voxel·mesh, NeRF·3DGS까지 이어지는 3D Reconstruction 학습 트리
clipped surrogate objective로 TRPO의 안정성을 1차 최적화만으로 달성한 PPO 논문 리뷰
CAD·참조 이미지만으로 novel object의 6DoF를 추정하는 FoundationPose와 SAM-6D
ICP·FPFH+RANSAC·TEASER++로 관측 point cloud를 모델에 정합하는 registration 기반 6DoF 추정
fiducial marker와 PnP 풀이법(P3P·EPnP·IPPE), 평면 pose ambiguity, template 기반 LINEMOD까지 전통 기하 기반 6DoF 추정
로봇 매니퓰레이션을 위한 6DoF pose 추정의 필요성과 마커·점 정합·모델 기반 세 갈래 방법론 개요