Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
IntElicit: Eliciting and Assessing Contextualized Creativity via Dialogue Policy Optimization
Mingjia Li, Jin Wu, Hong Qian +7
Contextualized assessment offers high ecological validity for evaluating creativity but introduces a critical challenge: observed performance may be confounded with cognitive profi…
cs.AI2026
See, Plan, Snap: Evaluating Multimodal GUI Agents in Scratch
Xingyi Zhang, Yulei Ye, Kaifeng Huang +2
Block-based programming environments such as Scratch play a central role in low-code education, yet evaluating the capabilities of AI agents to construct programs through Graphical…