전체 글 616

마음 지구력

짧은 후기윤홍균 저의 책은 본의 아니게 다 읽게 된 것 같다. 자존감 수업이라는 책을 시작으로 잔잔하게 마음의 위로가 되는 말을 퇴근길에 오디오로 듣고 있노라면 조금이나마 지친 머리가 휴식하는 느낌을 받는다. 내용은 번아웃에 대한 해결, 실패를 바라보는 시선, 완벽주의에 대한 조언 등인데 역시나 이 책도 이전 책들과 마찬가지로 잔잔하게 읽기 좋다. 내가 제일 이번편에서 기억이 남는 부분은 완벽주의 대목에서 "그냥 하는 것"이다. 나도 요즘 부쩍 느끼는 건데 연구가 됐든 공부가 됐든 일이 됐든 계획대로 되는건 아무것도 없는 것 같다. 결국 내가 돌이켜봤을 때 뭔가 그래도 남았다 싶은건 계획했든 안했든 그냥 마음이 이끄는대로 시작해서 뭔가 관찰을 했던 것들이 남았다 싶다. (물론 의미없이 한 일들은 돌이켜..

Book/Mind 2026.06.02

내가 선택할 수 있는 품격 있는 태도에 관하여

끄적끄적오랜만에 다시 기록을 시작한다. 책을 뜸하게 읽은 반 년과 e-book 리더기로 읽고 기록하지 않고 넘어간 반 년을 합치니 벌써 마지막 기록이 1년이 되었더라. 책을 멀리 할수록 사람의 깊이가 낮아지는 것 같아 다시 붙잡아 본다. 출퇴근 거리가 늘어난 김에 조금 더 읽어본다. 짧은 후기책에서 많은 이야기를 한다. 포기하지마라, 끝까지 해라, 언어를 다듬어라, 기분을 관리해라, 태도를 정리해라 등 적힌 이야기들은 어디서 한 번쯤은 들어봤을 법한 이야기들의 재구성이라 볼 수 있다. 내용을 폄하하는 것이 아니라, 반복되는 조언일수록 많은 이들이 공감하는 조언이니만큼 반복되는 것은 어쩔 수 없는 부분이다. 다시 말하면 그만큼 익숙하고도 의미있는 말들을 다시 귀에 새겨주는 책이라 볼 수 있겠다. 책이 하..

Book/Mind 2026.06.02

[FaceLift+] ICCV 2025 FaceLift 업그레이드

작년 ICCV2025 때 포스터를 보기도 했고 그 이전에도 arxiv 논문으로 먼저 읽어봤던 FaceLift 가 있었다. 개인적으로 Adobe에서 쓴 논문이기 때문에 퀄리티에 대한 의심은 없었고 코드가 공개되길 내심 기대했었는데 반갑게도 공개가 됐더라. 얼굴 정면 이미지를 입력하면 Multiview diffusion으로 정해진 시점의 6장 이미지를 만들어 내고, 이 multiview image + camera pose가 뒷단의 GS-LRM 모델에 들어가 pixel 마다 3DGS를 예측하는 구조다. 3DGS를 최적화로 수렴시켜서 찾아내는 것보다 pixel마다 prediction하는 구조이기 때문에 3DGS candidate가 월등히 많아 디테일을 표현하기에 굉장히 유리한 모양이다. 그래서 위 그림처럼 수..

Stable-SCore: A Stable Registration-based Framework for 3D Shape Correspondence

내 맘대로 Introduction많고 많은 mesh간의 correspondence를 추정한 다음, registration하는 논문. 간단히 말하면 형상이 다른 mesh를 A->B로 registration하는 방법. 광범위한 correspondence 데이터셋을 활용해서 최적화에 사용할 flow를 뱉어주는 네트워크를 사전에 학습시킨게 핵심이고 뒤에 최적화의 경우 diff-rendering을 사용한 익숙한 방법. 디테일 적으로 NJF를 이용해서 최적화하거나 하는 부분도 좋은 듯.확실한 prior를 갖고 시작하다보니 기존 방식 대비 왜곡이 적은 것 같다. 메모전체 파이프라인은 2D correspondence에 강하게 의존한다. SD-DINO를 기본으로 feature extractor를 만들었는데, 이 네트워크..

Paper/Others 2026.01.20

Gaussian Opacity Fields: Efficient Adaptive Surface Reconstruction in Unbounded Scenes

내 맘대로 Introduction Gaussian-to-Mesh에 속하는 논문인데, 3DGS에는 3DGS->2DGS로 내려찍는 방식으로 하는데 반대로 조금은 느리겠지만 NeRF에서 원래 하던 방식대로 pixel-to-ray를 만들고 ray tracing하면서 3DGS를 적분해나가는 식으로 바꾼 논문. 왜 이 불편함을 감수하느냐. ray 단위로 다시 시선을 바꾼 다음 적분하기 시작하면 NeRF에서 그랬듯 surface를 찾기 쉬워지기 때문이다. 이 논문에서는 3DGS를 학습할 때 surface를 쉽게 찾아 meshing 난이도를 낮추기 위한 loss로 제안하지만 그보다 더 핵심은 어떻게 주어진 3DGS에 NeRF에서 쓰던 ray 단위의 적분을 적용할 것이냐다. 메모세팅은 일반 3DGS랑 완벽히 동일함...

Paper/3D vision 2026.01.20

AnyUp : Universal Feature Upsampling

내 맘대로 Introduction이전에 FeatUp이라는 논문을 보고 모델마다 새학습, 샘플마다 새학습 문제로 범용성이 매우 떨어진다고 생각하고 말았는데, 범용성을 개선한 버전이 나왔다. 래퍼런스 논문들을 보니 이 foundation feature 해상도를 높이는 연구가 간간히 되어왔던 것 같긴 하다. 컨셉은 아주 간단하고 어찌보면 가장 쉽게 생각할 수 있는 방식인 것 같다. 구조를 어떤식으로 썼는지와 학습을 안정적으로 한 것에 의미가 좀 더 있는 듯. 메모해상도, 모델따라 재학습을 최소화한게 장점. 그림이 설명을 너무 잘해서. 그럼보면 끝.고해상도에서 feature 뽑고 crop한거랑저해상도에서 feature 뽑고 upsample 한거랑 같도록 함. cossim + l2로 학습구조적 핵심은 local ..

Paper/Others 2025.11.12

Animal Avatars: Reconstructing Animatable 3D Animals from Casual Videos

내 맘대로 Introduction동물 논문은 예전에 SMAL 이후로 본 적이 사실 없는데, 그 이후로 그렇게 발전한 것 같진 않다. 데이터가 없을 뿐더러 관심도 낮아서 연구가 그리 많이 안된 느낌. 이해도 가는게 움직이는 개를 어떻게 찍나...그리고 개를 그렇게 많이 모으는 것도 힘들고 털이 많아서 reconstruction도 애초에 안되니 데이터를 모을 수가 없다. (어찌 보면 블루 오션인 것 같기도) 이 논문은 주어진 개 video에서 해당 개랑 가장 닮은 SMAL 파라미터를 뽑아주고, NeRF 컨셉을 이용해서 texture를 발라주는 논문이다. SMAL에 색상을 입히는 방식이기 때문에 정확도가 엄청 높진 않다. 하지만 여태까지 다뤘던 논문 대비는 완성도가 많이 올라간 버전. 핵심은 CSE가 동물 ..

Paper/Others 2025.11.10

DualPM: Dual Posed-Canonical Point Maps for 3D Shape and Pose Reconstruction

내 맘대로 Introduction point map representation이 인기를 얻으면서 누군가는 canonical point map을 다룰 것이라고 바로 생각했었는데, 역시나 있다. 정말 naive하게 camera space point를 예측함과 동시에 canonical space point를 픽셀 별로 예측하는 걸 추가한 것. 새로운 formulation 없이 output에 추가되었다는 것은 좀 아쉬운 점. GT가 존재해야만 풀 수 있는 문제이므로, 일반화할 수 없는게 아쉽다. 뭔가 self-supervised 요소를 넣어서 풀었다면 확장이 가능하니까 더 좋았을 것 같은데... 누군가 곧 하겠지 deformed-canonical 구도에서 주 대상은 역사적으로 사람이었는데, 사람은 변화 자유도가..

Paper/Others 2025.11.10

curope, RoPE cuda version 설치 실패하는 문제

DUST3R 붐의 기저 연구인 CrocoV2 에서 사용하면서 요새 간간히 사용하는게 보이는 RoPE. 속도가 일반 PE보다 느리긴 해서 학습 효율을 위해 CUDA로 구현된 코드가 같이 제공된다. Croco든 dust3r든 human3r인든 같은 코드를 쓰고 설치는 웬만하면 다음과 같이만 안내된다.cd models/curope/python setup.py build_ext --inplacecd ../../ 문제는 한 방에 안 될때가 많다는 것. 오류명을 봐도 뭐가 문젠지 몰라서 감을 못잡다가 최근에 우연히 해결했다. 원인결국 torch 버전 문젠데 torch 버전이 올라가면서 못 따라오는 문제. 내 생각엔 2.6 버전 이후부터 이런 것 같다. tokens.type()라고 쓰는 문법이 deprecated ..