2 papers
cs.LG2026
OpenJarvis: Personal AI, On Personal Devices
Jon Saad-Falcon, Avanika Narayan, Robby Manihani +10
Personal AI stacks, like OpenClaw and Hermes Agent, are becoming central to daily work, yet they route nearly every query (often over sensitive local data) to cloud-hosted frontier…
cs.LG2025
2048: Reinforcement Learning in a Delayed Reward Environment
Prady Saligram, Tanvir Bhathal, Robby Manihani
Delayed and sparse rewards present a fundamental obstacle for reinforcement-learning (RL) agents, which struggle to assign credit for actions whose benefits emerge many steps later…