11 papers
Dramarrator: Object-Based Audio Editing for Audio Drama Production from Books
Karim Benharrak, Oriol Nieto, Bryan Wang +2
Audio dramas weave dialogue, sound effects, and music into immersive stories. Creators often adapt books into audio dramas, but this process remains labor-intensive, requiring them…
TaskArtisan: Designing Composable Generative Widgets for LLM-Assisted Analysis
Meng Chen, Amy Pavel
People increasingly use chatbots such as ChatGPT for everyday analysis tasks. While chatbots unify many analysis functions (e.g., scripts, visualizations, summaries), long conversa…
DigitalCoach: Communication and Grounding Gaps in Human and Agentic Computer Use Coaching
Meng Chen, Anya Ji, Tsung-Han Wu +4
Agents are increasingly capable of automating software tasks, but can they teach humans how to use software themselves? We introduce DigitalCoach, a multimodal dataset of 72 human…
HistoryPalette: Supporting Exploration and Reuse of Past Alternatives in Image Generation and Editing
Karim Benharrak, Amy Pavel
Creative tasks require creators to iteratively produce, select, and discard potentially useful ideas. Now, creativity tools include generative AI features (e.g., Photoshop Generati…
Co-Designing Multimodal Systems for Accessible Asynchronous Dance Instruction
Ujjaini Das, Shreya Kappala, Meng Chen +2
Videos make exercise instruction widely available, but they rely on visual demonstrations that blind and low vision (BLV) learners cannot see. While audio descriptions (AD) can mak…
CoSight: Exploring Viewer Contributions to Online Video Accessibility Through Descriptive Commenting
Ruolin wang, Xingyu Liu, Biao Wang +5
The rapid growth of online video content has outpaced efforts to make visual information accessible to blind and low vision (BLV) audiences. While professional Audio Description (A…