3 papers
cs.LG2026
Adaptive Inference Batching using Policy Gradients
Ruslan Sharifullin
Inference serving systems must balance throughput and latency under bursty, heterogeneous workloads, yet the industry standard remains static batching policies that require manual…
cs.CV2026
Diffusion Transformer World-Action Model for AV Scene Prediction
Ruslan Sharifullin, Benjamin Jiang, Kai Xi Chew
Action-conditioned world models let an autonomous vehicle predict future camera scenes from its own planned controls, enabling planning and simulation without real-world rollouts,…
cs.IR2026
Offline RL for Adaptive Policy Retrieval in Prior Authorization
Ruslan Sharifullin, Maxim Gorshkov, Hannah Clay
Prior authorization (PA) requires interpretation of complex and fragmented coverage policies, yet existing retrieval-augmented systems rely on static top- strategies with fixed…