Publications (22)
Parameter-free Reduction of the Estimation Bias in Deep Reinforcement Learning for Deterministic Policy Gradients
Baturay Saglam, Furkan Burak Mutlu, Dogan Can Cicek +1
Test-Time Safety Alignment
Baturay Saglam, Dionysis Kalogerias
Test-Time Detoxification without Training or Learning Anything
Baturay Saglam, Dionysis Kalogerias
Antares: Foundation Models for Agentic Vulnerability Localization
Supriti Vijay, Aman Priyanshu, Didier Chapoteau +8
Think Before You Retrieve: Learning Test-Time Adaptive Search with Small Language Models
Supriti Vijay, Aman Priyanshu, Anu Vellore +2
Compatible Gradient Approximations for Actor-Critic Algorithms
Baturay Saglam, Dionysis Kalogerias
Actor Prioritized Experience Replay
Baturay Saglam, Furkan B. Mutlu, Dogan C. Cicek +1
Off-Policy Correction for Deep Deterministic Policy Gradient Algorithms via Batch Prioritized Experience Replay
Dogan C. Cicek, Enes Duran, Baturay Saglam +2
Llama-3.1-FoundationAI-SecurityLLM-Base-8B Technical Report
Paul Kassianik, Baturay Saglam, Alexander Chen +15
AWD3: Dynamic Reduction of the Estimation Bias
Dogan C. Cicek, Enes Duran, Baturay Saglam +3
Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report
Sajana Weerawardhena, Paul Kassianik, Blaine Nelson +14
Learning Task Representations from In-Context Learning
Baturay Saglam, Xinyang Hu, Zhuoran Yang +2
Deep Intrinsically Motivated Exploration in Continuous Control
Baturay Saglam, Suleyman S. Kozat
Risk-Averse Constrained Reinforcement Learning with Optimized Certainty Equivalents
Jane H. Lee, Baturay Saglam, Spyridon Pougkakiotis +2
Llama-3.1-FoundationAI-SecurityLLM-Reasoning-8B Technical Report
Zhuoran Yang, Ed Li, Jianliang He +18
FAPO: Fully Automated Prompt Optimization of Multi-Step LLM Pipelines
Paul Kassianik, Baturay Saglam, Huaibo Zhao +4
Large Language Models Encode Semantics and Alignment in Linearly Separable Representations
Baturay Saglam, Paul Kassianik, Blaine Nelson +3
Estimation Error Correction in Deep Reinforcement Learning for Deterministic Actor-Critic Methods
Baturay Saglam, Enes Duran, Dogan C. Cicek +2
Mitigating Off-Policy Bias in Actor-Critic Methods with One-Step Q-learning: A Novel Correction Approach
Baturay Saglam, Dogan C. Cicek, Furkan B. Mutlu +1
Safe and Robust Experience Sharing for Deterministic Policy Gradient Algorithms
Baturay Saglam, Dogan C. Cicek, Furkan B. Mutlu +1
Self-Improving In-Context Learning
Baturay Saglam, Dionysis Kalogerias
Deep Reinforcement Learning Based Joint Downlink Beamforming and RIS Configuration in RIS-aided MU-MISO Systems Under Hardware Impairments and Imperfect CSI
Baturay Saglam, Doga Gurgunoglu, Suleyman S. Kozat