6 papers
Cyber-Physical Systems for Accessibility and Ability Augmentation: Bridging Diverse Communities
Shuchang Xu, Riku Arakawa, Mina Huh +11
The powerful convergence of wearables, robotics, extended reality, and smart environments is expanding the design space for cyber-physical systems (CPS) that support and augment hu…
Co-Designing Multimodal Systems for Accessible Asynchronous Dance Instruction
Ujjaini Das, Shreya Kappala, Meng Chen +2
Videos make exercise instruction widely available, but they rely on visual demonstrations that blind and low vision (BLV) learners cannot see. While audio descriptions (AD) can mak…
Vid2Coach: Transforming How-To Videos into Task Assistants
Mina Huh, Zihui Xue, Ujjaini Das +3
People use videos to learn new recipes, exercises, and crafts. Such videos remain difficult for blind and low vision (BLV) people to follow as they rely on visual comparison. Our o…
Long-Form Answers to Visual Questions from Blind and Low Vision People
Mina Huh, Fangyuan Xu, Yi-Hao Peng +5
Vision language models can now generate long-form answers to questions about images - long-form visual question answers (LFVQA). We contribute VizWiz-LF, a dataset of long-form ans…
VideoDiff: Human-AI Video Co-Creation with Alternatives
Mina Huh, Dingzeyu Li, Kim Pimmel +3
To make an engaging video, people sequence interesting moments and add visuals such as B-rolls or text. While video editing requires time and effort, AI has recently shown strong p…
Lotus: Creating Short Videos From Long Videos With Abstractive and Extractive Summarization
Aadit Barua, Karim Benharrak, Meng Chen +2
Short-form videos are popular on platforms like TikTok and Instagram as they quickly capture viewers' attention. Many creators repurpose their long-form videos to produce short-for…