3 papers
cs.CV2025
Glyph: Scaling Context Windows via Visual-Text Compression
Jiale Cheng, Yusen Liu, Xinyu Zhang +11
Large language models (LLMs) increasingly rely on long-context modeling for tasks such as document understanding, code analysis, and multi-step reasoning. However, scaling context…
cs.CR2025
No Free Lunch Theorem for Privacy-Preserving LLM Inference
Xiaojin Zhang, Yahao Pang, Yan Kang +4
Individuals and businesses have been significantly benefited by Large Language Models (LLMs) including PaLM, Gemini and ChatGPT in various ways. For example, LLMs enhance productiv…
cs.CV2024
Do Current Video LLMs Have Strong OCR Abilities? A Preliminary Study
Yulin Fei, Yuhui Gao, Xingyuan Xian +3
With the rise of multimodal large language models, accurately extracting and understanding textual information from video content, referred to as video based optical character reco…