2 papers
cs.AI2026
LiveEvalBench: Toward Open-World Evaluation for Web Generation
Yiyao Wang, Zhen Wen, Yinghao Tang +5
Large language models are increasingly capable of synthesizing executable frontend projects, yet existing benchmarks still treat web generation as a static evaluation problem. We a…
cs.CV2025
VIS-Shepherd: Constructing Critic for LLM-based Data Visualization Generation
Bo Pan, Yixiao Fu, Ke Wang +15
Data visualization generation using Large Language Models (LLMs) has shown promising results but often produces suboptimal visualizations that require human intervention for improv…