44 citations · 118 across the 15 of their papers we have counts for
Showing 2026Show all
2 papers · 1 filter
cs.CV2026
Appearance Pointers -- Multimodal Region Control of Diffusion Transformers
Rahul Sajnani, Yulia Gryaditskaya, Radomír Měch +2
Controllable image generation remains challenging for creative professionals, who often require precise regional control over materials, object identities, and spatial arrangements…
cs.CV2026
3D Space as a Scratchpad for Editable Text-to-Image Generation
Oindrila Saha, Vojtech Krs, Radomir Mech +3
Recent progress in large language models (LLMs) has shown that reasoning improves when intermediate thoughts are externalized into explicit workspaces, such as chain-of-thought tra…