5 papers
Playing ZendoWorld: Challenging AI Agents on Active Visual Concept Induction
Sophia Koehler, Antonia Wüst, Inga Ibs +5
A central challenge in building intelligent systems is enabling agents to jointly perceive complex inputs, form hypotheses about hidden patterns, and design informative experiments…
ActivationReasoning: Logical Reasoning in Latent Activation Spaces
Lukas Helff, Ruben Härle, Wolfgang Stammer +6
Large language models (LLMs) excel at generating fluent text, but their internal reasoning remains opaque and difficult to control. Sparse autoencoders (SAEs) make hidden activatio…
Fodor and Pylyshyn's Legacy: Still No Human-like Systematic Compositionality in Neural Networks
Tim Woydt, Moritz Willig, Antonia Wüst +4
Strong meta-learning capabilities for systematic compositionality are emerging as an important skill for navigating the complex and changing tasks of today's world. However, in pre…
Synthesizing Visual Concepts as Vision-Language Programs
Antonia Wüst, Wolfgang Stammer, Hikaru Shindo +3
Vision-Language models (VLMs) achieve strong performance on multimodal tasks but often fail at systematic visual reasoning tasks, leading to inconsistent or illogical outputs. Neur…
Bongard in Wonderland: Visual Puzzles that Still Make AI Go Mad?
Antonia Wüst, Tim Woydt, Lukas Helff +5
Recently, newly developed Vision-Language Models (VLMs), such as OpenAI's o1, have emerged, seemingly demonstrating advanced reasoning capabilities across text and image modalities…