3 papers
cs.LG2025
Hyperbolic Multimodal Representation Learning for Biological Taxonomies
ZeMing Gong, Chuanqi Tang, Xiaoliang Huo +6
Taxonomic classification in biodiversity research involves organizing biological specimens into structured hierarchies based on evidence, which can come from multiple modalities su…
cs.GR2025
HSM: Hierarchical Scene Motifs for Multi-Scale Indoor Scene Generation
Hou In Derek Pun, Hou In Ivan Tam, Austin T. Wang +3
Despite advances in indoor 3D scene layout generation, synthesizing scenes with dense object arrangements remains challenging. Existing methods focus on large furniture while negle…
cs.CV2025
ViGiL3D: A Linguistically Diverse Dataset for 3D Visual Grounding
Austin T. Wang, ZeMing Gong, Angel X. Chang
3D visual grounding (3DVG) involves localizing entities in a 3D scene referred to by natural language text. Such models are useful for embodied AI and scene retrieval applications,…