All papers
3M resultsCVPO: Enhancing LLM Reinforcement Learning Reasoning via Value-Variance Adaptation and Dynamic Curriculum Learning
Ziqi Jia, Yalu Ouyang, Bo Pang +5
Pressure induced magnetic-field-free superconducting diode effect in NbSe2 flake
Shihao Zhu, Tian Le, Cuiying Pei +17
Construction of flexible wing models by combined manufacturing of additive and subtractive processes for transonic wind tunnel testing
Natsuki Tsushima, Kensuke Soneda, Kenichi Saitoh +1
AI Agent Economics: Can Autonomous Economic Behavior Emerge among AI Agents under Minimal External Conditions?
Lingyun Zhang, Shang Shang
PAMT: Process-Aligned Reinforcement Learning for Multi-Domain Machine Translation
Yongshi Ye, Biao Fu, Chongxuan Huang +2
DiverseDiT++: Quantifying, Analyzing, and Promoting Representation Diversity in Diffusion Transformers
Binglei Li, Mengping Yang, Zhiyu Tan +4
SUV: Future Scene Understanding as Video Generation for End-to-End Driving
Yibo Yuan, Jiacheng Fu, Jiangtong Zhu +8
TumorBoard: Evidence-Grounded Multi-Agent Decision Support for Longitudinal Neuro-Oncology
Yantong Liu, Zheyu Zhang, Runpeng Liu +3
Contrasting anisotropic electron-phonon-spin coupling in Fe$_{3}$GeTe$_{2}$ and Fe$_{5}$GeTe$_{2}$: A helicity-resolved Raman study
Smrutiranjan Mekap, Jyoti Saini, Andrzej Ptok +4
Automatic Patient-Specific Microwave Ablation Planning Accelerated by a Physics-Guided Deep Learning Model
Seonaeng Cho, Minjee Seo, Minju Seol +3
SynEnergy: Anomaly Semantic-Guided Diffusion for Synthetic Energy Data Generation
Lin Jiang, Dahai Yu, Ravikumar Gelli +1
Scalable Frequency- and Length-Aware Subdocument Deduplication for Large Language Model Pretraining
Hai Wang, Chenhao Wang, Qifeng Cai +6
SMOPD: Multi-Reward Reinforcement Learning via Specialize-and-Merge Online Policy Distillation
Wen Wang, Jiahua Bao, Tu Yongsiqi +8
HIP 61637 b: a TESS Brown Dwarf in a Near-circular Orbit around a Massive A-type Star
Nino Ephremidze, David W. Latham, Perry Berlind +8
FakeI2V-Bench: Benchmarking the Applicability of Image-level Deepfake Detectors for Deepfake Video Detection
Pei Li, Sihan Chen, Delong Ran +1
What Language Does and What the Evidence Supports: A Functional Role Taxonomy and Evidence Audit of Language Grounding in Embodied Agents
Yifan Guo, Chenghao Li, Zhu Wang +6
Double Down on Defense: Strengthening Deep Perceptual Hashes against Evasion Attacks without Retraining
Bangjie Sun, Nayoung Kim, Mun Choon Chan +1
On the Implicit Flatness Bias of Sharpness-Aware Minimization: A Linear Stability Analysis with Quantitative Hyperparameter Bounds
Jiaxin Deng, Junbiao Pang
A Hierarchical Approach to Imitation Learning for Manipulation Tasks Requiring Time Varying Forces
Rishabh Shukla, Adithya Santhosh, Shaili Gandhi +2
HomoEnsNER: Does Language Alignment Outperform Architectural Complexity in Gujarati Named Entity Recognition?
Chandrakant K. Bhogayata
Bridging Online and Offline Handwriting via Differentiable Physical Rendering
Seonmi Park, Seunghyun Shin, Vihaan Misra +4
A Unified Resolution-Conditioned Framework for Orthogonal Line-Scanning Image Fusion
Yiming Gong, Kai Wang
Generalized propensity score weighting for functional causal inference framework
Simone Ciardulli, Nicole Fontana, Simone Vantini +1
Convex-Hull-Neighborhood Smooth Dual Generalization: Controlling Local Correction Propagation in Offline RL
Yi Yang, Zhennan Chen, Mingfeng Lv +3