NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (27)

cs.CV2026

VideoRAE: Taming Video Foundation Models for Generative Modeling via Representation Autoencoders

Zhihao Xie, Junfeng Wu, Xinting Hu +2

VideoRAE is a representation autoencoder that leverages frozen video foundation model features to create compact, generation‑friendly video latents, supporting both continuous diff…

#video generation#representation learning#autoencoders#diffusion models
cs.AI2025

LayerCake: Token-Aware Contrastive Decoding within Large Language Model Layers

Jingze Zhu, Yongliang Wu, Wenbo Zhu +7

cs.CV2025

SoccerNet 2025 Challenges Results

Silvio Giancola, Anthony Cioppa, Marc Gutiérrez-Pérez +115

cs.CV2025

DRC: Enhancing Personalized Image Generation via Disentangled Representation Composition

Yiyan Xu, Wuqiang Zheng, Wenjie Wang +5

cs.CV2025

PersonaHOI: Effortlessly Improving Personalized Face with Human-Object Interaction Generation

Xinting Hu, Haoran Wang, Jan Eric Lenssen +1

cs.AI2021

Distilling Causal Effect of Data in Class-Incremental Learning

Xinting Hu, Kaihua Tang, Chunyan Miao +2

cs.CV2020

Learning to Segment the Tail

Xinting Hu, Yi Jiang, Kaihua Tang +3

cs.CV2026

SemanticNVS: Improving Semantic Scene Understanding in Generative Novel View Synthesis

Xinya Chen, Christopher Wewer, Jiahao Xie +2

cs.GR2025

Edit360: 2D Image Edits to 3D Assets from Any Angle

Junchao Huang, Xinting Hu, Shaoshuai Shi +2

cs.LG2026

On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification

Yongliang Wu, Yizhou Zhou, Zhou Ziheng +7

cs.CV2025

MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory

Bo Wang, Jiehong Lin, Chenzhi Liu +5

cs.CV2026

Do Instance Priors Help Weakly Supervised Semantic Segmentation?

Anurag Das, Anna Kukleva, Xinting Hu +2

cs.CV2026

SPEED: Scalable, Precise, and Efficient Concept Erasure for Diffusion Models

Ouxiang Li, Yuan Wang, Xinting Hu +3

cs.IR2025

Personalized Generation In Large Model Era: A Survey

Yiyan Xu, Jinghao Zhang, Alireza Salemi +6

cs.CV2022

On Non-Random Missing Labels in Semi-Supervised Learning

Xinting Hu, Yulei Niu, Chunyan Miao +2

math.OC2021

Third Party Risk Modelling and Assessment for Safe UAV Path Planning in Metropolitan Environments

Bizhao Pang, Xinting Hu, Wei Dai +1

cs.LG2025

Mimic In-Context Learning for Multimodal Tasks

Yuchu Jiang, Jiale Fu, Chenduo Hao +4

cs.CV2025

Memory Forcing: Spatio-Temporal Memory for Consistent Scene Generation on Minecraft

Junchao Huang, Xinting Hu, Boyao Han +4

cs.CL2024

LIVE: Learnable In-Context Vector for Visual Question Answering

Yingzhe Peng, Chenduo Hao, Xu Yang +3

cs.CV2025

Number it: Temporal Grounding Videos like Flipping Manga

Yongliang Wu, Xinting Hu, Yuyang Sun +5

cs.CV2024

MTA-CLIP: Language-Guided Semantic Segmentation with Mask-Text Alignment

Anurag Das, Xinting Hu, Li Jiang +1

cs.CV2026

LIVE: Long-horizon Interactive Video World Modeling

Junchao Huang, Ziyang Ye, Xinting Hu +5

cs.CV2025

KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models

Yongliang Wu, Zonghui Li, Xinting Hu +7

cs.CV2025

VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory

Yifei Yu, Xiaoshan Wu, Xinting Hu +8

cs.CV2026

Veda: Scalable Video Diffusion via Distilled Sparse Attention

Shihao Han, Hao Yang, Xinting Hu +3

cs.CV2026

Easier Painting Than Thinking: Can Text-to-Image Models Set the Stage, but Not Direct the Play?

Ouxiang Li, Yuan Wang, Xinting Hu +7

cs.LG2025

Unlearning Concepts in Diffusion Model via Concept Domain Correction and Concept Preserving Gradient

Yongliang Wu, Shiji Zhou, Mingzhuo Yang +6