5 papers
Kimi K3: Open Frontier Intelligence
Kimi Team, Tongtong Bai, Yifan Bai +398
We introduce Kimi K3, a 2.8T parameter Mixture-of-Experts model with 104 billion activated parameters, native vision capabilities, and a 1-million-token context window. Kimi K3 is…
FAWAM: Force-Aware World Action Models for Closed-Loop Contact-Rich Manipulation
Haotian He, Zeyu Yan, Qipeng Liu +2
Force signals provide critical interaction cues for contact-rich robotic manipulation. However, existing methods mostly use force as an additional observation modality, without ful…
CLASH: Collision Learning via Augmented Sim-to-real Hybridization to Bridge the Reality Gap
Haotian He, Ning Guo, Siqi Shi +2
The sim-to-real gap, particularly in the inaccurate modeling of contact-rich dynamics like collisions, remains a primary obstacle to deploying robot policies trained in simulation.…
PolyNorm: Few-Shot LLM-Based Text Normalization for Text-to-Speech
Michel Wong, Ali Alshehri, Sophia Kao +1
Text Normalization (TN) is a key preprocessing step in Text-to-Speech (TTS) systems, converting written forms into their canonical spoken equivalents. Traditional TN systems can ex…
Improving Generalization and Convergence by Enhancing Implicit Regularization
Mingze Wang, Jinbo Wang, Haotian He +6
In this work, we propose an Implicit Regularization Enhancement (IRE) framework to accelerate the discovery of flat solutions in deep learning, thereby improving generalization and…