NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis
장면을 좌표 → 색/밀도 함수로 표현하는 MLP를 학습해 새로운 시점의 이미지를 합성한다.
장면을 좌표 → 색/밀도 함수로 표현하는 MLP를 학습해 새로운 시점의 이미지를 합성한다.
이미지를 패치 단위로 잘라 토큰처럼 다루면 순수 Transformer만으로도 CNN을 능가한다.
노이즈를 조금씩 제거하는 과정을 학습해 이미지를 생성하는 확산 모델의 기본 형태.