Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Code Monitor Red Teaming for Public-Test-Passing Code
Junchi Liao, Jiawen Deng, Fuji Ren
Visible tests are a common gate for LLM-generated code, but passing them does not certify specification correctness. We study a deployment-like monitoring problem: after code has p…
cs.AI2025
Compositional Concept Generalization with Variational Quantum Circuits
Hala Hawashin, Mina Abbaszadeh, Nicholas Joseph +3
Compositional generalization is a key facet of human cognition, but lacking in current AI tools such as vision-language models. Previous work examined whether a compositional tenso…