NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (22)

cs.LG2022

Parameter-free Reduction of the Estimation Bias in Deep Reinforcement Learning for Deterministic Policy Gradients

Baturay Saglam, Furkan Burak Mutlu, Dogan Can Cicek +1

cs.CL2026

Test-Time Safety Alignment

Baturay Saglam, Dionysis Kalogerias

cs.CL2026

Test-Time Detoxification without Training or Learning Anything

Baturay Saglam, Dionysis Kalogerias

cs.CR2026

Antares: Foundation Models for Agentic Vulnerability Localization

Supriti Vijay, Aman Priyanshu, Didier Chapoteau +8

cs.AI2025

Think Before You Retrieve: Learning Test-Time Adaptive Search with Small Language Models

Supriti Vijay, Aman Priyanshu, Anu Vellore +2

cs.LG2025

Compatible Gradient Approximations for Actor-Critic Algorithms

Baturay Saglam, Dionysis Kalogerias

cs.LG2022

Actor Prioritized Experience Replay

Baturay Saglam, Furkan B. Mutlu, Dogan C. Cicek +1

cs.LG2021

Off-Policy Correction for Deep Deterministic Policy Gradient Algorithms via Batch Prioritized Experience Replay

Dogan C. Cicek, Enes Duran, Baturay Saglam +2

cs.CR2025

Llama-3.1-FoundationAI-SecurityLLM-Base-8B Technical Report

Paul Kassianik, Baturay Saglam, Alexander Chen +15

cs.LG2021

AWD3: Dynamic Reduction of the Estimation Bias

Dogan C. Cicek, Enes Duran, Baturay Saglam +3

cs.CR2025

Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report

Sajana Weerawardhena, Paul Kassianik, Blaine Nelson +14

cs.CL2025

Learning Task Representations from In-Context Learning

Baturay Saglam, Xinyang Hu, Zhuoran Yang +2

cs.LG2022

Deep Intrinsically Motivated Exploration in Continuous Control

Baturay Saglam, Suleyman S. Kozat

cs.LG2025

Risk-Averse Constrained Reinforcement Learning with Optimized Certainty Equivalents

Jane H. Lee, Baturay Saglam, Spyridon Pougkakiotis +2

cs.AI2026

Llama-3.1-FoundationAI-SecurityLLM-Reasoning-8B Technical Report

Zhuoran Yang, Ed Li, Jianliang He +18

cs.SE2026

FAPO: Fully Automated Prompt Optimization of Multi-Step LLM Pipelines

Paul Kassianik, Baturay Saglam, Huaibo Zhao +4

cs.CL2026

Large Language Models Encode Semantics and Alignment in Linearly Separable Representations

Baturay Saglam, Paul Kassianik, Blaine Nelson +3

cs.LG2021

Estimation Error Correction in Deep Reinforcement Learning for Deterministic Actor-Critic Methods

Baturay Saglam, Enes Duran, Dogan C. Cicek +2

cs.LG2023

Mitigating Off-Policy Bias in Actor-Critic Methods with One-Step Q-learning: A Novel Correction Approach

Baturay Saglam, Dogan C. Cicek, Furkan B. Mutlu +1

cs.LG2022

Safe and Robust Experience Sharing for Deterministic Policy Gradient Algorithms

Baturay Saglam, Dogan C. Cicek, Furkan B. Mutlu +1

cs.CL2026

Self-Improving In-Context Learning

Baturay Saglam, Dionysis Kalogerias

cs.NI2023

Deep Reinforcement Learning Based Joint Downlink Beamforming and RIS Configuration in RIS-aided MU-MISO Systems Under Hardware Impairments and Imperfect CSI

Baturay Saglam, Doga Gurgunoglu, Suleyman S. Kozat