Publications (60)
3inGAN: Learning a 3D Generative Model from Images of a Self-similar Scene
Animesh Karnewar, Oliver Wang, Tobias Ritschel +1
Perspective Fields for Single Image Camera Calibration
Linyi Jin, Jianming Zhang, Yannick Hold-Geoffroy +4
Lumiere: A Space-Time Diffusion Model for Video Generation
Omer Bar-Tal, Hila Chefer, Omer Tov +14
Efficient Large-scale Approximate Nearest Neighbor Search on the GPU
Patrick Wieschollek, Oliver Wang, Alexander Sorkine-Hornung +1
Improved Techniques for Training Single-Image GANs
Tobias Hinz, Matthew Fisher, Oliver Wang +1
Learning to Recover 3D Scene Shape from a Single Image
Wei Yin, Jianming Zhang, Oliver Wang +4
Photometric Mesh Optimization for Video-Aligned 3D Object Reconstruction
Chen-Hsuan Lin, Oliver Wang, Bryan C. Russell +4
GSLAM: Initialization-robust Monocular Visual SLAM via Global Structure-from-Motion
Chengzhou Tang, Oliver Wang, Ping Tan
Interactive Sketch & Fill: Multiclass Sketch-to-Image Translation
Arnab Ghosh, Richard Zhang, Puneet K. Dokania +4
Cohomology and the Bowditch Boundary
Jason Fox Manning, Oliver Wang
CharacterGAN: Few-Shot Keypoint Character Animation and Reposing
Tobias Hinz, Matthew Fisher, Oliver Wang +2
Videogenic: Identifying Highlight Moments in Videos with Professional Photographs as a Prior
David Chuan-En Lin, Fabian Caba Heilbron, Joon-Young Lee +2
B-Script: Transcript-based B-roll Video Editing with Recommendations
Bernd Huber, Hijung Valentina Shin, Bryan Russell +2
Spectral Predictability as a Fast Reliability Indicator for Time Series Forecasting Model Selection
Oliver Wang, Pengrui Quan, Kang Yang +1
Self-Supervised Generation of Spatial Audio for 360 Video
Pedro Morgado, Nuno Vasconcelos, Timothy Langlois +1
High-Resolution Image Inpainting using Multi-Scale Neural Patch Synthesis
Chao Yang, Xin Lu, Zhe Lin +3
CNN-generated images are surprisingly easy to spot... for now
Sheng-Yu Wang, Oliver Wang, Richard Zhang +2
Revisiting Adaptive Convolutions for Video Frame Interpolation
Simon Niklaus, Long Mai, Oliver Wang
TS-Skill: A Benchmark for Evaluating Analytical Skills in Time-Series Question Answering
Liying Han, Kang Yang, Oliver Wang +9
Toward Multimodal Image-to-Image Translation
Jun-Yan Zhu, Richard Zhang, Deepak Pathak +4
Localizing Moments in Video with Natural Language
Lisa Anne Hendricks, Oliver Wang, Eli Shechtman +3
Layered Diffusion Model for One-Shot High Resolution Text-to-Image Synthesis
Emaad Khwaja, Abdullah Rashwan, Ting Chen +3
VecFusion: Vector Font Generation with Diffusion
Vikas Thamizharasan, Difan Liu, Shantanu Agarwal +5
Towards Accurate Reconstruction of 3D Scene Shape from A Single Monocular Image
Wei Yin, Jianming Zhang, Oliver Wang +4
Layered Neural Atlases for Consistent Video Editing
Yoni Kasten, Dolev Ofri, Oliver Wang +1
DuctTake: Spatiotemporal Video Compositing
Jan Rueegg, Oliver Wang, Aljoscha Smolic +1
Real-time Semantic Segmentation with Fast Attention
Ping Hu, Federico Perazzi, Fabian Caba Heilbron +4
Swapping Autoencoder for Deep Image Manipulation
Taesung Park, Jun-Yan Zhu, Oliver Wang +4
Detecting Photoshopped Faces by Scripting Photoshop
Sheng-Yu Wang, Oliver Wang, Andrew Owens +2
Joint Stabilization and Direction of 360°Videos
Chengzhou Tang, Oliver Wang, Feng Liu +1
Readout Guidance: Learning Control from Diffusion Features
Grace Luo, Trevor Darrell, Oliver Wang +2
ST-GAN: Spatial Transformer Generative Adversarial Networks for Image Compositing
Chen-Hsuan Lin, Ersin Yumer, Oliver Wang +2
Gemini: A Family of Highly Capable Multimodal Models
Gemini Team, Rohan Anil, Sebastian Borgeaud +1340
GaussiGAN: Controllable Image Synthesis with 3D Gaussians from Unposed Silhouettes
Youssef A. Mejjati, Isa Milefchik, Aaron Gokaslan +3
VideoMap: Supporting Video Editing Exploration, Brainstorming, and Prototyping in the Latent Space
David Chuan-En Lin, Fabian Caba Heilbron, Joon-Young Lee +2
Generating Object Stamps
Youssef Alami Mejjati, Zejiang Shen, Michael Snower +4
An insertable glucose sensor using a compact and cost-effective phosphorescence lifetime imager and machine learning
Artem Goncharov, Zoltan Gorocs, Ridhi Pradhan +12
Neural Scene Flow Fields for Space-Time View Synthesis of Dynamic Scenes
Zhengqi Li, Simon Niklaus, Noah Snavely +1
Image Neural Field Diffusion Models
Yinbo Chen, Oliver Wang, Richard Zhang +3
Image Generators are Generalist Vision Learners
Valentin Gabeur, Shangbang Long, Songyou Peng +22
Imagen 3
Imagen-Team-Google, :, Jason Baldridge +257
Neural Volumetric Object Selection
Zhongzheng Ren, Aseem Agarwala, Bryan Russell +2
Motion Prompting: Controlling Video Generation with Motion Trajectories
Daniel Geng, Charles Herrmann, Junhwa Hur +11
Localizing Moments in Video with Temporal Language
Lisa Anne Hendricks, Oliver Wang, Eli Shechtman +3
MSG-GAN: Multi-Scale Gradients for Generative Adversarial Networks
Animesh Karnewar, Oliver Wang
DeepLens: Shallow Depth Of Field From A Single Image
Lijun Wang, Xiaohui Shen, Jianming Zhang +5
Towards Domain-agnostic Depth Completion
Guangkai Xu, Wei Yin, Jianming Zhang +4
Smooth Models of Fibered Partially Hyperbolic Systems
Jonathan DeWitt, Meg Doucette, Oliver Wang
INVE: Interactive Neural Video Editing
Jiahui Huang, Leonid Sigal, Kwang Moo Yi +2
ReLU Fields: The Little Non-linearity That Could
Animesh Karnewar, Tobias Ritschel, Oliver Wang +1
Sampling Based Scene-Space Video Processing
Felix Klose, Oliver Wang, Jean-Charles Bazin +2
Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431
Web Stereo Video Supervision for Depth Prediction from Dynamic Scenes
Chaoyang Wang, Simon Lucey, Federico Perazzi +1
Differentiable Signal Processing With Black-Box Audio Effects
Marco A. MartÃnez RamÃrez, Oliver Wang, Paris Smaragdis +1
Learning Blind Video Temporal Consistency
Wei-Sheng Lai, Jia-Bin Huang, Oliver Wang +3
Greedy Growing Enables High-Resolution Pixel-Based Diffusion Models
Cristina N. Vasconcelos, Abdullah Rashwan, Austin Waters +22
Online Detection of AI-Generated Images
David C. Epstein, Ishan Jain, Oliver Wang +1
Temporally Distributed Networks for Fast Video Semantic Segmentation
Ping Hu, Fabian Caba Heilbron, Oliver Wang +3
Deep Video Deblurring
Shuochen Su, Mauricio Delbracio, Jue Wang +3
The Unreasonable Effectiveness of Deep Features as a Perceptual Metric
Richard Zhang, Phillip Isola, Alexei A. Efros +2