Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
KnowHal: A Knowledge-Driven Benchmark for Comprehensive Multimodal Hallucination Evaluation
Ruihan Li, Jiyang Tan, Kailin Jiang +5
Hallucination remains a critical challenge for developing trustworthy Multimodal Large Language Models (MLLMs). While existing benchmarks mainly focus on entity, attribute, and rel…
cs.AI2026
GraphDx: A Cost-Aware Knowledge-Enhanced Multi-Agent Framework for Sequential Diagnosis
Shaoting Tan, Ning Liu, Yuntao Du +7
Sequential diagnosis requires balancing diagnostic accuracy against resource costs through iterative information gathering. Existing Large Language Model (LLM) approaches exhibit a…