2 papers
cs.MA2025
Adaptive Coopetition: Leveraging Coarse Verifier Signals for Resilient Multi-Agent LLM Reasoning
Rui Jerry Huang, Wendy Liu, Anastasia Miin +1
Inference-time computation is a critical yet challenging paradigm for enhancing the reasoning performance of large language models (LLMs). While existing strategies improve reasoni…
cs.AI2024
Optimizing Large Language Models for Dynamic Constraints through Human-in-the-Loop Discriminators
Timothy Wei, Annabelle Miin, Anastasia Miin
Large Language Models (LLMs) have recently demonstrated impressive capabilities across various real-world applications. However, due to the current text-in-text-out paradigm, it re…