3 papers
cs.SD2025
An Efficient GPU-based Implementation for Noise Robust Sound Source Localization
Zirui Lin, Masayuki Takigahira, Naoya Terakado +6
Robot audition, encompassing Sound Source Localization (SSL), Sound Source Separation (SSS), and Automatic Speech Recognition (ASR), enables robots and smart devices to acquire aud…
cs.CV2023
Incorporating Supervised Domain Generalization into Data Augmentation
Shohei Enomoto, Monikka Roslianna Busto, Takeharu Eda
With the increasing utilization of deep learning in outdoor settings, its robustness needs to be enhanced to preserve accuracy in the face of distribution shifts, such as compressi…
cs.CV2022
Dynamic Test-Time Augmentation via Differentiable Functions
Shohei Enomoto, Monikka Roslianna Busto, Takeharu Eda
Distribution shifts, which often occur in the real world, degrade the accuracy of deep learning systems, and thus improving robustness to distribution shifts is essential for pract…