Showing cs.AIShow all
2 papers · 1 filter
cs.AI2025
MMMG: a Comprehensive and Reliable Evaluation Suite for Multitask Multimodal Generation
Jihan Yao, Yushi Hu, Yujie Yi +9
Automatically evaluating multimodal generation presents a significant challenge, as automated metrics often struggle to align reliably with human evaluation, especially for complex…
cs.AI2025
Socratic: Enhancing Human Teamwork via AI-enabled Coaching
Sangwon Seo, Bing Han, Rayan E. Harari +4
Coaches are vital for effective collaboration, but cost and resource constraints often limit their availability during real-world tasks. This limitation poses serious challenges in…