2 papers
cs.CV2025
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
Zhengcong Fei, Hao Jiang, Di Qiu +8
The generation and editing of audio-conditioned talking portraits guided by multimodal inputs, including text, images, and videos, remains under explored. In this paper, we present…
cs.CV2025
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
Di Qiu, Zhengcong Fei, Rui Wang +5
We present SkyReels-A1, a simple yet effective framework built upon video diffusion Transformer to facilitate portrait image animation. Existing methodologies still encounter issue…