2 papers
cs.CL2026
Direct Reasoning Optimization: Token-Level Reasoning Reflectivity Meets Rubric Gates for Unverifiable Tasks
Yifei Xu, Tusher Chakraborty, Srinagesh Sharma +6
Reinforcement learning (RL) training of large language models (LLMs) on unverifiable tasks is challenging even when a reasonable-quality reference answer is available. We propose a…
cs.IR2024
Enabling Adoption of Regenerative Agriculture through Soil Carbon Copilots
Margaret Capetz, Swati Sharma, Rafael Padilha +4
Mitigating climate change requires transforming agriculture to minimize environ mental impact and build climate resilience. Regenerative agricultural practices enhance soil organic…