4 papers · 1 filter
Domain-Adaptation through Synthetic Data: Fine-Tuning Large Language Models for German Law
Ali Hamza Bashir, Muhammad Rehan Khalid, Kostadin Cvejoski +7
Large language models (LLMs) often struggle in specialized domains such as legal reasoning due to limited expert knowledge, resulting in factually incorrect outputs or hallucinatio…
Multi-Modal Vision vs. Text-Based Parsing: Benchmarking LLM Strategies for Invoice Processing
David Berghaus, Armin Berger, Lars Hillebrand +2
This paper benchmarks eight multi-modal large language models from three families (GPT-5, Gemini 2.5, and open-source Gemma 3) on three diverse openly available invoice document da…
A Survey on Current Trends and Recent Advances in Text Anonymization
Tobias DeuÃer, Lorenz Sparrenberg, Armin Berger +3
The proliferation of textual data containing sensitive personal information across various domains requires robust anonymization techniques to protect privacy and comply with regul…
Advancing Risk and Quality Assurance: A RAG Chatbot for Improved Regulatory Compliance
Lars Hillebrand, Armin Berger, Daniel Uedelhoven +7
Risk and Quality (R&Q) assurance in highly regulated industries requires constant navigation of complex regulatory frameworks, with employees handling numerous daily queries demand…