Publications (26)
MajutsuCity: Language-driven Aesthetic-adaptive City Generation with Controllable 3D Assets and Layouts
Zilong Huang, Jun He, Xiaobin Huang +6
SGS-3D: High-Fidelity 3D Instance Segmentation via Reliable Semantic Mask Splitting and Growing
Chaolei Wang, Yang Luo, Jing Du +3
Spatially-Weighted CLIP for Street-View Geo-localization
Ting Han, Fengjiao Li, Chunsong Chen +3
Unveiling Deep Semantic Uncertainty Perception for Language-Anchored Multi-modal Vision-Brain Alignment
Zehui Feng, Chenqi Zhang, Mingru Wang +4
Depth Matters: Exploring Deep Interactions of RGB-D for Semantic Segmentation in Traffic Scenes
Siyu Chen, Ting Han, Changshe Zhang +4
Comparative Analysis of Advanced Feature Matching Algorithms in Challenging High Spatial Resolution Optical Satellite Stereo Scenarios
Qiyan Luo, Jidan Zhang, Yuzhen Xie +2
Fengshenbang 1.0: Being the Foundation of Chinese Cognitive Intelligence
Jiaxing Zhang, Ruyi Gan, Junjie Wang +22
A Large-Scale Remote Sensing Dataset and VLM-based Algorithm for Fine-Grained Road Hierarchy Classification
Ting Han, Xiangyi Xie, Yiping Chen +5
Usability Investigation on the Localization of Text CAPTCHAs: Take Chinese Characters as a Case Study
Junnan Yu, Xuna Ma, Ting Han
TCBERT: A Technical Report for Chinese Topic Classification BERT
Ting Han, Kunhao Pan, Xinyu Chen +5
Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice
Shanbo Cheng, Yu Bao, Zhichao Huang +25
Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition
Ye Bai, Jingping Chen, Jitong Chen +52
Coreference Augmentation for Multi-Domain Task-Oriented Dialogue State Tracking
Ting Han, Chongxuan Huang, Wei Peng
MultiWOZ 2.3: A multi-domain task-oriented dialogue dataset enhanced with annotation corrections and co-reference annotation
Ting Han, Ximing Liu, Ryuichi Takanobu +5
Stronger, Steadier & Superior: Geometric Consistency in Depth VFM Forges Domain Generalized Semantic Segmentation
Siyu Chen, Ting Han, Changshe Zhang +4
Adaptive loose optimization for robust question answering
Jie Ma, Pinghui Wang, Zewei Wang +4
Time2General: Learning Spatiotemporal Invariant Representations for Domain-Generalization Video Semantic Segmentation
Siyu Chen, Ting Han, Haoling Huang +5
PreResQ-R1: Towards Fine-Grained Rank-and-Score Reinforcement Learning for Visual Quality Assessment via Preference-Response Disentangled Policy Optimization
Zehui Feng, Tian Qiu, Tong Wu +3
Flatness is Necessary, Neural Collapse is Not: Rethinking Generalization via Grokking
Ting Han, Linara Adilova, Henning Petzka +2
Semantic4Safety: Causal Insights from Zero-shot Street View Imagery Segmentation for Urban Road Safety
Huan Chen, Ting Han, Siyu Chen +3
Leveraging Depth and Language for Open-Vocabulary Domain-Generalized Semantic Segmentation
Siyu Chen, Ting Han, Chengzheng Fu +5
Enabling Robots to Draw and Tell: Towards Visually Grounded Multimodal Description Generation
Ting Han, Sina ZarrieÃ
Four-Dimensional Usability Investigation of Image CAPTCHA
Junnan Yu, Xuna Ma, Ting Han
GBA-UBF : A Large-Scale and Fine-Grained Building Function Classification Dataset in the Greater Bay Area
Chunsong Chen, Yichen Hou, Huan Chen +5
A spin-torque nano-oscillator based on interlayer-coupled meron-skyrmion pairs with a fixed orbit
Qiyun Yi, Ting Han, Jinyi Jiang +1
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
Zilong Huang, Jun He, Junyan Ye +4