2 papers
cs.CV2025
Lightweight Structured Multimodal Reasoning for Clinical Scene Understanding in Robotics
Saurav Jha, Stefan K. Ehrlich
Healthcare robotics requires robust multimodal perception and reasoning to ensure safety in dynamic clinical environments. Current Vision-Language Models (VLMs) demonstrate strong…
cs.HC2025
AffectMachine-Pop: A controllable expert system for real-time pop music generation
Kat R. Agres, Adyasha Dash, Phoebe Chua +1
Music is a powerful medium for influencing listeners' emotional states, and this capacity has driven a surge of research interest in AI-based affective music generation in recent y…