2 papers
cs.LG2026
RamanBench: A Large-Scale Benchmark for Machine Learning on Raman Spectroscopy
Mario Koddenbrock, Christoph Lange, Robin Legner +6
Machine Learning (ML) has transformed many scientific fields, yet key applications still lack standardized benchmarks. Raman spectroscopy, a widely used technique for non-invasive…
cs.CL2026
LLMStructBench: Benchmarking Large Language Model Structured Data Extraction
Sönke Tenckhoff, Mario Koddenbrock, Erik Rodner
We present LLMStructBench, a novel benchmark for evaluating Large Language Models (LLMs) on extracting structured data and generating valid JavaScript Object Notation (JSON) output…