2 papers
cs.SD2026
Zero-VC: Zero-Lookahead Streaming Voice Conversion via Speaker Anonymization
Yudong Li, Zihao Fang, Junwen Qiu +4
Streaming zero-shot voice conversion struggles to disentangle timbre from linguistic content without degrading utility or inflating latency. Current methods rely on information bot…
cs.CV2024
MultiCounter: Multiple Action Agnostic Repetition Counting in Untrimmed Videos
Yin Tang, Wei Luo, Jinrui Zhang +3
Multi-instance Repetitive Action Counting (MRAC) aims to estimate the number of repetitive actions performed by multiple instances in untrimmed videos, commonly found in human-cent…