[논문리뷰] CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos (ICCV 2025)
기존 tracker들을 teacher로 삼아 real video에 pseudo-label을 달고 1,000배 적은 데이터로 SOTA를 넘는 단순화된 point tracker CoTracker3 논문 리뷰
기존 tracker들을 teacher로 삼아 real video에 pseudo-label을 달고 1,000배 적은 데이터로 SOTA를 넘는 단순화된 point tracker CoTracker3 논문 리뷰
track 간 attention과 support point로 여러 점을 jointly 추적해 occlusion에 강한 transformer 기반 point tracker CoTracker 논문 리뷰
depth와 ray map을 최소 prediction target으로 삼아 plain transformer 하나로 any-view geometry를 통일한 Depth Anything 3 논문 리뷰
실측 label을 전부 synthetic 이미지로 바꾸고 62M pseudo-labeled 실사 이미지로 증류해 정밀도와 robustness를 함께 잡은 Depth Anything V2 논문 리뷰
62M unlabeled 이미지 self-training과 DINOv2 feature alignment로 만든 zero-shot MDE foundation model, Depth Anything 논문 리뷰
matching을 3D 문제로 정식화해 DUSt3R에 local feature head와 InfoNCE loss를 더하고 Map-free localization에서 30%p 개선을 이룬 MASt3R 논문 리뷰
카메라 calibration도 pose도 없이 이미지 쌍에서 pointmap을 직접 회귀해, depth·대응·pose·3D 복원까지 기하 3D 비전 과제 전체를 하나의 모델로 푸는 DUSt3R 논문 리뷰
attention의 병목을 FLOPs가 아닌 HBM 접근으로 규정하고 tiling·recomputation으로 O(N) 메모리의 exact attention을 구현한 FlashAttention 논문 리뷰
SAM 기반 ISM과 background token point matching의 PEM으로 zero-shot 6D pose를 구하는 SAM-6D 논문 리뷰
기준점·측정점을 잇는 최적 rigid transform (R, t)을 SVD 한 번으로 구하는 Kabsch 알고리즘