2 papers
cs.LG2026
Neuro-Symbolic Financial Reasoning via Deterministic Fact Ledgers and Adversarial Low-Latency Hallucination Detector
Pedram Agand
Standard Retrieval-Augmented Generation (RAG) architectures fail in high-stakes financial domains due to two fundamental limitations: the inherent arithmetic incompetence of Large…
cs.LG2026
Beyond Static Datasets: Robust Offline Policy Optimization via Vetted Synthetic Transitions
Pedram Agand, Mo Chen
Offline Reinforcement Learning (ORL) holds immense promise for safety-critical domains like industrial robotics, where real-time environmental interaction is often prohibitive. A p…