3 papers
cs.CV2026
NudgeVAD: Language-Nudged End-to-End Driving via FiLM Residuals
Chieh-Chi Yang, Yu-Hsiang Chen, Yi-Ting Chen
Natural-language instructions promise controllable end-to-end driving, but their benefit can be hidden when planners already receive reliable high-level commands. We propose NudgeV…
cs.CL2024
Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks
Chien-yu Huang, Wei-Chih Chen, Shu-wen Yang +77
Multimodal foundation models, such as Gemini and ChatGPT, have revolutionized human-machine interactions by seamlessly integrating various forms of data. Developing a universal spo…
cs.CV2023
RiskBench: A Scenario-based Benchmark for Risk Identification
Chi-Hsi Kung, Chieh-Chi Yang, Pang-Yuan Pao +4
Intelligent driving systems aim to achieve a zero-collision mobility experience, requiring interdisciplinary efforts to enhance safety performance. This work focuses on risk identi…