2 papers
cs.LG2025
Latent Prototype Routing: Achieving Near-Perfect Load Balancing in Mixture-of-Experts
Jiajie Yang
Mixture-of-Experts (MoE) architectures have emerged as a key strategy for scaling large language models (LLMs) efficiently. However, current MoE systems suffer from severe load imb…
cs.GR2024
Triplet: Triangle Patchlet for Mesh-Based Inverse Rendering and Scene Parameters Approximation
Jiajie Yang
Recent advancements in Radiance Fields have significantly improved novel-view synthesis. However, in many real-world applications, the more advanced challenge lies in inverse rende…