papers

Publications (57)

cs.CV2023

MM-VID: Advancing Video Understanding with GPT-4V(ision)

Kevin Lin, Faisal Ahmed, Linjie Li +9

cs.CV2019

Learning the Depths of Moving People by Watching Frozen People

Zhengqi Li, Tali Dekel, Forrester Cole +4

cs.CV2022

ReCo: Region-Controlled Text-to-Image Generation

Zhengyuan Yang, Jianfeng Wang, Zhe Gan +8

cs.CV2022

LAVENDER: Unifying Video-Language Understanding as Masked Language Modeling

Linjie Li, Zhe Gan, Kevin Lin +4

cs.CV2025

DicFace: Dirichlet-Constrained Variational Codebook Learning for Temporally Coherent Video Face Restoration

Yan Chen, Hanlin Shang, Ce Liu +6

cs.CV2022

GIT: A Generative Image-to-text Transformer for Vision and Language

Jianfeng Wang, Zhengyuan Yang, Xiaowei Hu +6

cs.CV2022

Deep 3D-to-2D Watermarking: Embedding Messages in 3D Meshes and Extracting Them from 2D Renderings

Innfarn Yoo, Huiwen Chang, Xiyang Luo +4

q-bio.BM2024

Dynamic PDB: A New Dataset and a SE(3) Model Extension by Integrating Dynamic Behaviors and Physical Properties in Protein Structures

Ce Liu, Jun Wang, Zhiqiang Cai +10

cs.CV2023

Single Image Depth Prediction Made Better: A Multivariate Gaussian Take

Ce Liu, Suryansh Kumar, Shuhang Gu +2

cs.CV2021

COMISR: Compression-Informed Video Super-Resolution

Yinxiao Li, Pengchong Jin, Feng Yang +3

cs.CV2019

DepthTransfer: Depth Extraction from Video Using Non-parametric Sampling

Kevin Karsch, Ce Liu, Sing Bing Kang

econ.TH2026

On Conservative Stable Standard of Behavior and Perfect Coalitional Equilibrium

S. Nageeb Ali, Ce Liu

cs.LG2011

Adaptively Learning the Crowd Kernel

Omer Tamuz, Ce Liu, Serge Belongie +2

cs.LG2021

Regularizing Generative Adversarial Networks under Limited Data

Hung-Yu Tseng, Lu Jiang, Ce Liu +2

cs.CV2021

AutoFlow: Learning a Better Training Set for Optical Flow

Deqing Sun, Daniel Vlasic, Charles Herrmann +6

econ.TH2023

Self-Enforced Job Matching

Ce Liu, Ziwei Wang, Hanzhe Zhang

cs.CV2022

Coarse-to-Fine Vision-Language Pre-training with Fusion in the Backbone

Zi-Yi Dou, Aishwarya Kamath, Zhe Gan +9

cs.CV2021

NeRD: Neural Reflectance Decomposition from Image Collections

Mark Boss, Raphael Braun, Varun Jampani +3

cs.CV2022

Unified Contrastive Learning in Image-Text-Label Space

Jianwei Yang, Chunyuan Li, Pengchuan Zhang +4

eess.SP2020

Microwave Photonic Imaging Radar with a Millimeter-level Resolution

Cong Ma, Yue Yang, Ce Liu +5

cs.CV2022

Visual Clues: Bridging Vision and Language Foundations for Image Paragraph Captioning

Yujia Xie, Luowei Zhou, Xiyang Dai +4

cs.CV2021

Florence: A New Foundation Model for Computer Vision

Lu Yuan, Dongdong Chen, Yi-Ling Chen +20

cs.CV2024

Stereo Risk: A Continuous Modeling Approach to Stereo Matching

Ce Liu, Suryansh Kumar, Shuhang Gu +3

cs.CL2024

Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Marah Abdin, Jyoti Aneja, Hany Awadalla +126

cs.MM2021

DVMark: A Deep Multiscale Framework for Video Watermarking

Xiyang Luo, Yinxiao Li, Huiwen Chang +3

cs.AI2024

The Llama 3 Herd of Models

Aaron Grattafiori, Abhimanyu Dubey, Abhinav Jauhri +556

econ.TH2022

Credible Persuasion

Xiao Lin, Ce Liu

cs.CV2021

LASR: Learning Articulated Shape Reconstruction from a Monocular Video

Gengshan Yang, Deqing Sun, Varun Jampani +6

eess.SP2026

IPRU: Input-Perturbation-based Radio Frequency Fingerprinting Unlearning for LAWNs

Ce Liu, Rui Meng, Yinqiu Liu +4

cs.CV2023

MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action

Zhengyuan Yang, Linjie Li, Jianfeng Wang +7

cs.CV2026

LoViF 2026 Challenge on Real-World All-in-One Image Restoration: Methods and Results

Xiang Chen, Hao Li, Jiangxin Dong +54

cs.CV2023

X-Paste: Revisiting Scalable Copy-Paste for Instance Segmentation using CLIP and StableDiffusion

Hanqing Zhao, Dianmo Sheng, Jianmin Bao +9

cs.CV2020

Robust image stitching with multiple registrations

Charles Herrmann, Chen Wang, Richard Strong Bowen +4

cs.CV2021

SLIDE: Single Image 3D Photography with Soft Layering and Depth-aware Inpainting

Varun Jampani, Huiwen Chang, Kyle Sargent +8

cs.CV2021

Neural-PIL: Neural Pre-Integrated Lighting for Reflectance Decomposition

Mark Boss, Varun Jampani, Raphael Braun +3

cs.LG2021

Supervised Contrastive Learning

Prannay Khosla, Piotr Teterwak, Chen Wang +6

cs.CV2026

Simulating the Real World: A Unified Survey of Multimodal Generative Models

Yuqi Hu, Longguang Wang, Xian Liu +7

cs.CV2022

Pyramid Adversarial Training Improves ViT Performance

Charles Herrmann, Kyle Sargent, Lu Jiang +5

econ.TH2026

Coalitions in Repeated Games

S. Nageeb Ali, Ce Liu

cs.CV2019

Depth Extraction from Video Using Non-parametric Sampling

Kevin Karsch, Ce Liu, Sing Bing Kang

cs.CV2018

Smart, Sparse Contours to Represent and Edit Images

Tali Dekel, Chuang Gan, Dilip Krishnan +2

cs.LG2024

AlphaFolding: 4D Diffusion for Dynamic Protein Structure Prediction with Reference and Motion Guidance

Kaihui Cheng, Ce Liu, Qingkun Su +6

cs.CV2024

ViTGAN: Training GANs with Vision Transformers

Kwonjoon Lee, Huiwen Chang, Lu Jiang +3

cs.CV2023

NAVI: Category-Agnostic Image Collections with High-Quality 3D Shape and Pose Annotations

Varun Jampani, Kevis-Kokitsi Maninis, Andreas Engelhardt +13

cs.CV2025

Movie Gen: A Cast of Media Foundation Models

Adam Polyak, Amit Zohar, Andrew Brown +85

cs.CV2023

Florence-2: Advancing a Unified Representation for a Variety of Vision Tasks

Bin Xiao, Haiping Wu, Weijian Xu +6

cs.CV2023

Learning Customized Visual Models with Retrieval-Augmented Knowledge

Haotian Liu, Kilho Son, Jianwei Yang +4

cs.CV2026

ViSRA: A Video-based Spatial Reasoning Agent for Multi-modal Large Language Models

Tingshu Mou, Jiabo He, Renying Wang +5

eess.SP2026

TDGCN-Based Mobile Multiuser Physical-Layer Authentication for EI-Enabled IIoT

Rui Meng, Hangyu Zhao, Liang Jin +3

cs.CV2022

K-LITE: Learning Transferable Visual Models with External Knowledge

Sheng Shen, Chunyuan Li, Xiaowei Hu +11

cs.CV2024

Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation

Mingwang Xu, Hui Li, Qingkun Su +6

cs.CV2023

VA-DepthNet: A Variational Approach to Single Image Depth Prediction

Ce Liu, Suryansh Kumar, Shuhang Gu +2

cs.CV2019

Boundless: Generative Adversarial Networks for Image Extension

Piotr Teterwak, Aaron Sarna, Dilip Krishnan +4

cs.CV2022

OmniVL:One Foundation Model for Image-Language and Video-Language Tasks

Junke Wang, Dongdong Chen, Zuxuan Wu +7

cs.CV2025

DroneSR: Rethinking Few-shot Thermal Image Super-Resolution from Drone-based Perspective

Zhipeng Weng, Xiaopeng Liu, Ce Liu +3

cs.CV2022

MaskGIT: Masked Generative Image Transformer

Huiwen Chang, Han Zhang, Lu Jiang +2

econ.TH2021

Stability in Repeated Matching Markets

Ce Liu