2 papers
cs.CV2026
LocusGS: Spatially Grounded Tokens for Feed-Forward 3D Gaussian Splatting
Wenyu Li, Sidun Liu, Tongrui Hu +2
Recent query-based feed-forward 3DGS methods represent a scene using learnable queries, each aggregating multi-view evidence and decoding a group of Gaussians. Ideally, different q…
cs.CV2025
Muskie: Multi-view Masked Image Modeling for 3D Vision Pre-training
Wenyu Li, Sidun Liu, Peng Qiao +2
We present Muskie, a native multi-view vision backbone designed for 3D vision tasks. Unlike existing models, which are frame-wise and exhibit limited multi-view consistency, Muskie…