4 papers
Addressable Recall Compaction for Long Context-Window Control in AI Agents
Thang Dang, Yuma Ichikawa, Sakina Fatima +1
Long-horizon LLM agents accumulate reasoning traces, actions, and tool observations that can eventually exceed a model's fixed context window. Existing compaction methods address t…
Adaptive Targeted Dynamic Chunking for Tokenization-Free Hierarchical Model
Thang Dang, Akira Nakagawa, Kenichi Kobayashi +1
Tokenization-free hierarchical models are emerging as a promising alternative to traditional Large Language Models (LLMs), addressing inherent preprocessing issues such as vocabula…
Scalpel: Fine-Grained Alignment of Attention Activation Manifolds via Mixture Gaussian Bridges to Mitigate Multimodal Hallucination
Ziqiang Shi, Rujie Liu, Shanshan Yu +2
Rapid progress in large vision-language models (LVLMs) has achieved unprecedented performance in vision-language tasks. However, due to the strong prior of large language models (L…
SchröMind: Mitigating Hallucinations in Multimodal Large Language Models via Solving the Schrödinger Bridge Problem
Ziqiang Shi, Rujie Liu, Shanshan Yu +2
Recent advancements in Multimodal Large Language Models (MLLMs) have achieved significant success across various domains. However, their use in high-stakes fields like healthcare r…