2 papers
cs.AI2026
AgentBeats: Agentifying Agent Assessment for Openness, Standardization, and Reproducibility
Xiaoyuan Liu, Jianhong Tu, Yuqi Chen +26
Agent systems are advancing quickly across domains, but their evaluation remains fragmented. Most benchmarks rely on fixed, LLM-centric harnesses that require heavy integration, cr…
cs.CY2026
Divination by Prompt: LLM-Mediated Xuanxue on Chinese Social Media
Chuang Li, Lixuan Wang, Yuqi Chen +1
The rapid proliferation of large language models (LLMs) has produced a striking cultural practice: using conversational AI for divination. This paper offers one of the first system…