Showing cs.CLShow all
3 papers · 1 filter
cs.CL2026
SinoGlyphBench: A Diagnostic Benchmark for Chinese Glyph-Level Obfuscation in Language-Model Moderation
Yifan Wang, Zimu Wang, Suliu Qin +10
Glyph-level obfuscation can leave harmful Chinese content readable to humans while degrading automated moderation. We introduce SinoGlyphBench, a diagnostic benchmark that identifi…
cs.CL2025
MedFact: A Large-scale Chinese Dataset for Evidence-based Medical Fact-checking of LLM Responses
Tong Chen, Zimu Wang, Yiyi Miao +6
Medical fact-checking has become increasingly critical as more individuals seek medical information online. However, existing datasets predominantly focus on human-generated conten…
cs.CL2024
Thinker-DDM: Modeling Deliberation for Machine Translation with a Drift-Diffusion Process
Hongbin Na, Zimu Wang, Mieradilijiang Maimaiti +4
Large language models (LLMs) have demonstrated promising potential in various downstream tasks, including machine translation. However, prior work on LLM-based machine translation…