2 papers
cs.CL2025
Advancing SLM Tool-Use Capability using Reinforcement Learning
Dhruvi Paprunia, Vansh Kharidia, Pankti Doshi
In an era where tool-augmented AI agents are becoming increasingly vital, our findings highlight the ability of Group Relative Policy Optimization (GRPO) to empower SLMs, which are…
cs.AI2024
LightFusionRec: Lightweight Transformers-Based Cross-Domain Recommendation Model
Vansh Kharidia, Dhruvi Paprunia, Prashasti Kanikar
This paper presents LightFusionRec, a novel lightweight cross-domain recommendation system that integrates DistilBERT for textual feature extraction and FastText for genre embeddin…