2 papers
cs.CV2026
Environmental Understanding Vision-Language Model for Embodied Agent
Jinsik Bang, Jaeyeon Bae, Donggyu Lee +2
Vision-language models (VLMs) have shown strong perception and reasoning abilities for instruction-following embodied agents. However, despite these abilities and their generalizat…
cs.CV2025
Multi-aspect Knowledge Distillation with Large Language Model
Taegyeong Lee, Jinsik Bang, Soyeong Kwon +1
Recent advancements in deep learning have significantly improved performance on computer vision tasks. Previous image classification methods primarily modify model architectures or…