Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
Haotang Li, Zhenyu Qi, Shaohan Henry Wang +5
Visual Geometry Transformer (VGGT) is a strong feed-forward model for multiple 3D tasks, but its Alternating-Attention (AA) stack scales quadratically in the total token count, mak…
cs.CV2024
CLII: Visual-Text Inpainting via Cross-Modal Predictive Interaction
Liang Zhao, Qing Guo, Xiaoguang Li +1
Image inpainting aims to fill missing pixels in damaged images and has achieved significant progress with cut-edging learning techniques. Nevertheless, state-of-the-art inpainting…