Announcement
Camera-aware transformer proposed to predict geometry across views jointly
A research post says the model uses a unified global cost volume and is described in a paper set to appear at NeurIPS.
TLDR
The researchers claim feed-forward models distort geometry even when given camera poses. They say their paper, set to appear at NeurIPS, recasts multi-view stereo as a sequence-to-sequence task: a camera-aware transformer uses a unified global cost volume to predict geometry for all views jointly.
Combined views
5.3K
1 Source, first seen ago
