Publications (211)
MLLMGuard: A Multi-dimensional Safety Evaluation Suite for Multimodal Large Language Models
Tianle Gu, Zeyang Zhou, Kexin Huang +10
Guiding Topic Flows in the Generative Chatbot by Enhancing the ConceptNet with the Conversation Corpora
Pengda Si, Yao Qiu, Jinchao Zhang +1
Stochastic Voronoi Ensembles for Anomaly Detection
Yang Cao, Sikun Yang, Xuyun Zhang +1
Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
Qingyan Guo, Rui Wang, Junliang Guo +3
CriticBench: Benchmarking LLMs for Critique-Correct Reasoning
Zicheng Lin, Zhibin Gou, Tian Liang +3
Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
Dadi Guo, Yuejin Xie, Qingyu Liu +11
A Survey on the Honesty of Large Language Models
Siheng Li, Cheng Yang, Taiqiang Wu +12
Universal Segmentation at Arbitrary Granularity with Language Instruction
Yong Liu, Cairong Zhang, Yitong Wang +3
Text Anomaly Detection with Simplified Isolation Kernel
Yang Cao, Sikun Yang, Yujiu Yang +2
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
Zhibin Gou, Zhihong Shao, Yeyun Gong +4
ToolBeHonest: A Multi-level Hallucination Diagnostic Benchmark for Tool-Augmented Large Language Models
Yuxiang Zhang, Jing Chen, Junjie Wang +10
A.S.E: A Repository-Level Benchmark for Evaluating Security in AI-Generated Code
Keke Lian, Bin Wang, Lei Zhang +19
EALM: Introducing Multidimensional Ethical Alignment in Conversational Information Retrieval
Yiyao Yu, Junjie Wang, Yuxiang Zhang +3
Smaller Models are Natural Explorers for Policy-Level Diversity in GRPO
Yiming Ren, Yiran Xu, Zicheng Lin +8
ToM: Leveraging Tree-oriented MapReduce for Long-Context Reasoning in Large Language Models
Jiani Guo, Zuchao Li, Jie Wu +5
Deep Evolutional Instant Interest Network for CTR Prediction in Trigger-Induced Recommendation
Zhibo Xiao, Luwei Yang, Tao Zhang +3
LayoutDiT: Exploring Content-Graphic Balance in Layout Generation with Diffusion Transformer
Yu Li, Yifan Chen, Gongye Liu +6
Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation
Zhuoyan Luo, Fengyuan Shi, Yixiao Ge +3
Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition
Xinzhe Ni, Yong Liu, Hao Wen +3
Think-with-Rubrics: From External Evaluator to Internal Reasoning Guidance
Jiachen Yu, Zhihao Xu, Junjie Wang +1
Modelling Latent Dynamics of StyleGAN using Neural ODEs
Weihao Xia, Yujiu Yang, Jing-Hao Xue
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
Yuqing Chen, Lin Liu, Haisu Wu +4
MORE: A Metric Learning Based Framework for Open-domain Relation Extraction
Yutong Wang, Renze Lou, Kai Zhang +2
MANIQA: Multi-dimension Attention Network for No-Reference Image Quality Assessment
Sidi Yang, Tianhe Wu, Shuwei Shi +5
AnchorWorld: Embodied Egocentric World Simulation with View-based Evolution Customization
Yu Li, Menghan Xia, Gongye Liu +8
Global Knowledge Calibration for Fast Open-Vocabulary Segmentation
Kunyang Han, Yong Liu, Jun Hao Liew +8
CoWork-X: Experience-Optimized Co-Evolution for Multi-Agent Collaboration System
Zexin Lin, Jiachen Yu, Haoyang Zhang +5
Prior Bilinear Based Models for Knowledge Graph Completion
Jiayi Li, Ruilin Luo, Jiaqi Sun +2
AutoConv: Automatically Generating Information-seeking Conversations with Large Language Models
Siheng Li, Cheng Yang, Yichun Yin +6
ContextVis: Envision Contextual Learning and Interaction with Generative Models
Bo Shui, Chufan Shi, Yujiu Yang +1
Chain of History: Learning and Forecasting with LLMs for Temporal Knowledge Graph Completion
Ruilin Luo, Tianle Gu, Haoling Li +4
IG-Diff: Complex Night Scene Restoration with Illumination-Guided Diffusion Model
Yifan Chen, Fei Yin, Chunle Guo +2
StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter
Gongye Liu, Menghan Xia, Yong Zhang +6
Rethinking Alignment in Video Super-Resolution Transformers
Shuwei Shi, Jinjin Gu, Liangbin Xie +3
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
Xuewei Yang, Jiachen Yu, Jie Wu +3
MMCL-Bench: Multimodal Context Learning from Visual Rules, Procedures, and Evidence
Yifan Chen, Fei Yin, Qingyan Bai +2
Wan-Weaver: Interleaved Multi-modal Generation via Decoupled Training
Jinbo Xing, Zeyinzi Jiang, Yuxiang Tuo +15
Exploring the Mystery of Influential Data for Mathematical Reasoning
Xinzhe Ni, Yeyun Gong, Zhibin Gou +4
HyperSeg: Towards Universal Visual Segmentation with Large Language Model
Cong Wei, Yujie Zhong, Haoxian Tan +4
NewsDialogues: Towards Proactive News Grounded Conversation
Siheng Li, Yichun Yin, Cheng Yang +7
Generalizable Black-Box Adversarial Attack with Meta Learning
Fei Yin, Yong Zhang, Baoyuan Wu +4
Velocity-Space 3D Asset Editing
Hao Liu, Yuxuan Lin, Jingfeng Guo +4
D2Match: Leveraging Deep Learning and Degeneracy for Subgraph Matching
Xuanzhou Liu, Lin Zhang, Jiaqi Sun +2
FlowSteer: Guiding Few-Step Image Synthesis with Authentic Trajectories
Lei Ke, Hubery Yin, Gongye Liu +6
HSCJN: A Holistic Semantic Constraint Joint Network for Diverse Response Generation
Yiru Wang, Pengda Si, Zeyang Lei +2
AirMoE: Statistic-Augmented Over-the-Air MoE for Collaborative Intelligence
Wei-Bin Kou, Jingreng Lei, Guangxu Zhu +1
Modeling Fine-grained Information via Knowledge-aware Hierarchical Graph for Zero-shot Entity Retrieval
Taiqiang Wu, Xingyu Bai, Weigang Guo +3
Question Answering as Programming for Solving Time-Sensitive Questions
Xinyu Zhu, Cheng Yang, Bei Chen +3
ProReflow: Progressive Reflow with Decomposed Velocity
Lei Ke, Haohang Xu, Xuefei Ning +7
A Multi-sentiment-resource Enhanced Attention Network for Sentiment Classification
Zeyang Lei, Yujiu Yang, Min Yang +1
Mitigating the Reasoning Tax in Vision-Language Fine-Tuning with Input-Adaptive Depth Aggregation
Yiming Ren, Yujiu Yang, Junjie Wang
Augmenting Proposals by the Detector Itself
Xiaopei Wan, Zhenhua Guo, Chao He +2
Solving Math Word Problems via Cooperative Reasoning induced Language Models
Xinyu Zhu, Junjie Wang, Lin Zhang +4
Towards Real-World Video Deblurring by Exploring Blur Formation Process
Mingdeng Cao, Zhihang Zhong, Yanbo Fan +5
EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers
Qingyan Guo, Rui Wang, Junliang Guo +6
ChartMimic: Evaluating LMM's Cross-Modal Reasoning Capability via Chart-to-Code Generation
Cheng Yang, Chufan Shi, Yaxin Liu +11
Real-time Human-Centric Segmentation for Complex Video Scenes
Ran Yu, Chenyu Tian, Weihao Xia +3
SIN-Bench: Tracing Native Evidence Chains in Long-Context Multimodal Scientific Interleaved Literature
Yiming Ren, Junjie Wang, Yuxin Meng +11
PixelCraft: A Multi-Agent System for High-Fidelity Visual Reasoning on Structured Images
Shuoshuo Zhang, Zijian Li, Yizhen Zhang +6
Self-supervised Feature Learning for 3D Medical Images by Playing a Rubik's Cube
Xinrui Zhuang, Yuexiang Li, Yifan Hu +3
VeriEvol: Scaling Multimodal Mathematical Reasoning via Verifiable Evol-Instruct
Haoling Li, Kai Zheng, Jie Wu +4
Augmenting Anchors by the Detector Itself
Xiaopei Wan, Guoqiu Li, Yujiu Yang +1
Reward Modeling from Natural Language Human Feedback
Zongqi Wang, Rui Wang, Yuchuan Wu +5
Attentions Help CNNs See Better: Attention-based Hybrid Image Quality Assessment Network
Shanshan Lao, Yuan Gong, Shuwei Shi +5
Understanding Multimodal Deep Neural Networks: A Concept Selection View
Chenming Shang, Hengyuan Zhang, Hao Wen +1
Recouple Event Field via Probabilistic Bias for Event Extraction
Xingyu Bai, Taiqiang Wu, Han Guo +7
Domain Fingerprints for No-reference Image Quality Assessment
Weihao Xia, Yujiu Yang, Jing-Hao Xue +1
Teaching Your Models to Understand Code via Focal Preference Alignment
Jie Wu, Haoling Li, Xin Zhang +8
Frequency-domain Learning with Kernel Prior for Blind Image Deblurring
Jixiang Sun, Fei Lei, Jiawei Zhang +2
TediGAN: Text-Guided Diverse Face Image Generation and Manipulation
Weihao Xia, Yujiu Yang, Jing-Hao Xue +1
SCAN: Structured Capability Assessment and Navigation for LLMs
Zongqi Wang, Tianle Gu, Chen Gong +3
PaSBench-Video: A Streaming Video Benchmark for Proactive Safety Warning
Yusong Zhao, Yuejin Xie, Youliang Yuan +4
A Comprehensive Study of Multimodal Large Language Models for Image Quality Assessment
Tianhe Wu, Kede Ma, Jie Liang +2
Generative Universal Verifier as Multimodal Meta-Reasoner
Xinchen Zhang, Xiaoying Zhang, Youbin Wu +5
Probing the Robustness of Large Language Models Safety to Latent Perturbations
Tianle Gu, Kexin Huang, Zongqi Wang +7
OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration
Xinchen Zhang, Bowei Liu, Jiale Liu +7
Seeing What You Miss: Vision-Language Pre-training with Semantic Completion Learning
Yatai Ji, Rongcheng Tu, Jie Jiang +6
Rho-1: Not All Tokens Are What You Need
Zhenghao Lin, Zhibin Gou, Yeyun Gong +8
O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing
Yuqing Chen, Junjie Wang, Lin Liu +4
Hint-enhanced In-Context Learning wakes Large Language Models up for knowledge-intensive tasks
Yifan Wang, Qingyan Guo, Xinzhe Ni +4
WebRISE: Requirement-Induced State Evaluation for MLLM-Generated Web Artifacts
Yuxin Meng, Yuhan Suo, Junjie Wang +9
3D GAN Inversion with Facial Symmetry Prior
Fei Yin, Yong Zhang, Xuan Wang +8
Distributional Clarity: The Hidden Driver of RL-Friendliness in Large Language Models
Shaoning Sun, Mingzhu Cai, Huang He +5
RIFormer: Keep Your Vision Backbone Effective While Removing Token Mixer
Jiahao Wang, Songyang Zhang, Yong Liu +6
Coarse-to-Fine Searching for Efficient Generative Adversarial Networks
Jiahao Wang, Han Shu, Weihao Xia +2
LLM2: Let Large Language Models Harness System 2 Reasoning
Cheng Yang, Chufan Shi, Siheng Li +3
Cooperative Semantic Segmentation and Image Restoration in Adverse Environmental Conditions
Weihao Xia, Zhanglin Cheng, Yujiu Yang +1
Unlocking Multimodal Mathematical Reasoning via Process Reward Model
Ruilin Luo, Zhuofan Zheng, Yifan Wang +9
CoSeR: Bridging Image and Language for Cognitive Super-Resolution
Haoze Sun, Wenbo Li, Jianzhuang Liu +5
Region-Adaptive Deformable Network for Image Quality Assessment
Shuwei Shi, Qingyan Bai, Mingdeng Cao +4
PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
Yizhen Zhang, Yang Ding, Shuoshuo Zhang +9
LaSagnA: Language-based Segmentation Assistant for Complex Queries
Cong Wei, Haoxian Tan, Yujie Zhong +2
Assessor360: Multi-sequence Network for Blind Omnidirectional Image Quality Assessment
Tianhe Wu, Shuwei Shi, Haoming Cai +4
RealCompo: Balancing Realism and Compositionality Improves Text-to-Image Diffusion Models
Xinchen Zhang, Ling Yang, Yaqi Cai +8
VDTR: Video Deblurring with Transformer
Mingdeng Cao, Yanbo Fan, Yong Zhang +2
ShifCon: Enhancing Non-Dominant Language Capabilities with a Shift-based Multilingual Contrastive Framework
Hengyuan Zhang, Chenming Shang, Sizhe Wang +6
NTIRE 2021 Challenge on Perceptual Image Quality Assessment
Jinjin Gu, Haoming Cai, Chao Dong +47
Continuous Invariance Learning
Yong Lin, Fan Zhou, Lu Tan +8
AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation
Zeyue Tian, Lei Ke, Zhaoyang Liu +8
OmniISR: A Unified Framework for Centralized and Federated Learning via Intermediate Supervision and Regularization
Wei-Bin Kou, Guangxu Zhu, Ming Tang +4