3 papers
cs.CL2026
MAGA-Bench: Machine-Augment-Generated Text via Alignment Detection Benchmark
Anyang Song, Ying Cheng, Yiqian Xu +1
Machine-Generated Text (MGT) is becoming increasingly difficult to distinguish from Human-Written Text (HWT). This trend has exacerbated malicious activities such as fake news and…
cs.CV2026
LVSum: A Benchmark for Timestamp-Aware Long Video Summarization
Alkesh Patel, Melis Ozyildirim, Ying-Chang Cheng +1
Long video summarization presents significant challenges for multimodal large language models (MLLMs), particularly in maintaining temporal fidelity over extended durations and pro…
cs.CL2025
FineMedLM-o1: Enhancing Medical Knowledge Reasoning Ability of LLM from Supervised Fine-Tuning to Test-Time Training
Hongzhou Yu, Tianhao Cheng, Yingwen Wang +6
Recent advancements in large language models (LLMs) have shown promise in medical applications such as disease diagnosis and treatment planning. However, most existing medical LLMs…