2 papers
cs.LG2024
Younger: The First Dataset for Artificial Intelligence-Generated Neural Network Architecture
Zhengxin Yang, Wanling Gao, Luzhou Peng +3
Designing and optimizing neural network architectures typically requires extensive expertise, starting with handcrafted designs and then manual or automated refinement. This depend…
cs.CL2023
AGIBench: A Multi-granularity, Multimodal, Human-referenced, Auto-scoring Benchmark for Large Language Models
Fei Tang, Wanling Gao, Luzhou Peng +1
Large language models (LLMs) like ChatGPT have revealed amazing intelligence. How to evaluate the question-solving abilities of LLMs and their degrees of intelligence is a hot-spot…