Publications (287)
Cones: Concept Neurons in Diffusion Models for Customized Generation
Zhiheng Liu, Ruili Feng, Kai Zhu +6
Perception, Verdict, and Evolution: Hindsight-Driven Self-Refining Forensics Agent for AI-Generated Image Detection
Yangjun Wu, Keyu Yan, Yu Liu +5
Qwen Technical Report
Jinze Bai, Shuai Bai, Yunfei Chu +45
FlashP: An Analytical Pipeline for Real-time Forecasting of Time-Series Relational Data
Shuyuan Yan, Bolin Ding, Wei Guo +4
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
Boyi Deng, Xu Wang, Yaoning Wang +15
Breaking Entropy Bounds: Accelerating RL Training via MTP with Rejection Sampling
Yucheng Li, Huiqiang Jiang, Yang Xu +14
WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
Zhengwei Tao, Haiyang Shen, Baixuan Li +11
PANDA: Facilitating Usable AI Development
Jinyang Gao, Wei Wang, Meihui Zhang +7
Efficient Vector Search in the Wild: One Model for Multi-K Queries
Yifan Peng, Jiafei Fan, Xingda Wei +7
AsymKV: Enabling 1-Bit Quantization of KV Cache with Layer-Wise Asymmetric Quantization Configurations
Qian Tao, Wenyuan Yu, Jingren Zhou
Banyan: A Scoped Dataflow Engine for Graph Query Service
Li Su, Xiaoming Qin, Zichao Zhang +6
On Knowledge Editing in Federated Learning: Perspectives, Challenges, and Future Directions
Leijie Wu, Song Guo, Junxiao Wang +3
RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
Hao Xiang, Tianyi Tang, Yang Su +10
AliGraph: A Comprehensive Graph Neural Network Platform
Rong Zhu, Kun Zhao, Hongxia Yang +5
OccuQuest: Mitigating Occupational Bias for Inclusive Large Language Models
Mingfeng Xue, Dayiheng Liu, Kexin Yang +5
Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment
Keming Lu, Bowen Yu, Chang Zhou +1
ACE: All-round Creator and Editor Following Instructions via Diffusion Transformer
Zhen Han, Zeyinzi Jiang, Yulin Pan +5
QwenPaw-Data: Bridging Facts, Methodology, and Execution for Autonomous Enterprise Data Analytics
Tianjing Zeng, Yuntao Hong, Zhongjun Ding +17
The paper presents QwenPaw-Data, an autonomous agent system that turns natural‑language requests into end‑to‑end enterprise data analysis workflows by integrating semantic groundin…
I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models
Shiwei Zhang, Jiayu Wang, Yingya Zhang +6
Chinese CLIP: Contrastive Vision-Language Pretraining in Chinese
An Yang, Junshu Pan, Junyang Lin +4
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
Baixuan Li, Dingchu Zhang, Jialong Wu +9
Towards a Converged Relational-Graph Optimization Framework
Yunkai Lou, Longbin Lai, Bingqing Lyu +5
A Survey on Self-Evolution of Large Language Models
Zhengwei Tao, Ting-En Lin, Xiancai Chen +7
M6-Rec: Generative Pretrained Language Models are Open-Ended Recommender Systems
Zeyu Cui, Jianxin Ma, Chang Zhou +2
Rethinking Efficient Tuning Methods from a Unified Perspective
Zeyinzi Jiang, Chaojie Mao, Ziyuan Huang +3
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
Haoming Meng, Kexin Huang, Shaohang Wei +6
The Lessons of Developing Process Reward Models in Mathematical Reasoning
Zhenru Zhang, Chujie Zheng, Yangzhen Wu +6
XiYan-SQL: A Novel Multi-Generator Framework For Text-to-SQL
Yifu Liu, Yin Zhu, Yingqi Gao +8
Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models
Haoqi Yuan, Zhixuan Liang, Anzhe Chen +20
FederatedScope: A Flexible Federated Learning Platform for Heterogeneity
Yuexiang Xie, Zhen Wang, Dawei Gao +6
DreamVideo: Composing Your Dream Videos with Customized Subject and Motion
Yujie Wei, Shiwei Zhang, Zhiwu Qing +6
Lipschitz Singularities in Diffusion Models
Zhantao Yang, Ruili Feng, Han Zhang +8
ProcessBench: Identifying Process Errors in Mathematical Reasoning
Chujie Zheng, Zhenru Zhang, Beichen Zhang +6
mPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video
Haiyang Xu, Qinghao Ye, Ming Yan +12
M6-UFC: Unifying Multi-Modal Controls for Conditional Image Synthesis via Non-Autoregressive Generative Transformers
Zhu Zhang, Jianxin Ma, Chang Zhou +6
Reliable Adversarial Distillation with Unreliable Teachers
Jianing Zhu, Jiangchao Yao, Bo Han +6
MAI-UI Technical Report: Real-World Centric Foundation GUI Agents
Hanzhang Zhou, Xu Zhang, Panrong Tong +8
AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents
Zhaopeng Feng, Liangcai Su, Zhen Zhang +16
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
Peng Wang, Shuai Bai, Sinan Tan +16
Towards Knowledge-Based Personalized Product Description Generation in E-commerce
Qibin Chen, Junyang Lin, Yichang Zhang +3
Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model
Chenhan Yuan, Fei Huang, Ru Peng +4
Wan-Image: Pushing the Boundaries of Generative Visual Intelligence
Chaojie Mao, Chen-Wei Xie, Chongyang Zhong +55
Video = World + Event Stream
Lianghua Huang, Zhi-Fan Wu, Yupeng Shi +24
The paper introduces Wan-Streamer v0.3, a model that treats video as a combination of a persistent world and a dynamic event stream, enabling real-time multimodal audio‑visual inte…
EE-LLM: Large-Scale Training and Inference of Early-Exit Large Language Models with 3D Parallelism
Yanxi Chen, Xuchen Pan, Yaliang Li +2
GastCoCo: Graph Storage and Coroutine-Based Prefetch Co-Design for Dynamic Graph Processing
Hongfu Li, Qian Tao, Song Yu +6
Very Large-Scale Multi-Agent Simulation in AgentScope
Xuchen Pan, Dawei Gao, Yuexiang Xie +6
Cardinality Estimation in DBMS: A Comprehensive Benchmark Evaluation
Yuxing Han, Ziniu Wu, Peizhi Wu +11
Qwen2.5-Coder Technical Report
Binyuan Hui, Jian Yang, Zeyu Cui +21
BridgeScope: A Universal Toolkit for Bridging Large Language Models and Databases
Lianggui Weng, Dandan Liu, Rong Zhu +2
Qwen2.5 Technical Report
Qwen, :, An Yang +41
On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation
Kexin Huang, Haoming Meng, Junkang Wu +10
SLPT: Selective Labeling Meets Prompt Tuning on Label-Limited Lesion Segmentation
Fan Bai, Ke Yan, Xiaoyu Bai +6
A Pluggable Learned Index Method via Sampling and Gap Insertion
Yaliang Li, Daoyuan Chen, Bolin Ding +2
Qwen2-Audio Technical Report
Yunfei Chu, Jin Xu, Qian Yang +9
Learning to be a Statistician: Learned Estimator for Number of Distinct Values
Renzhi Wu, Bolin Ding, Xu Chu +4
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
Fanqi Wan, Weizhou Shen, Shengyi Liao +7
Devil is in the Queries: Advancing Mask Transformers for Real-world Medical Image Segmentation and Out-of-Distribution Localization
Mingze Yuan, Yingda Xia, Hexin Dong +13
mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models
Jiabo Ye, Haiyang Xu, Haowei Liu +6
Baihe: SysML Framework for AI-driven Databases
Andreas Pfadler, Rong Zhu, Wei Chen +4
FederatedScope-LLM: A Comprehensive Package for Fine-tuning Large Language Models in Federated Learning
Weirui Kuang, Bingchen Qian, Zitao Li +7
In-Context LoRA for Diffusion Transformers
Lianghua Huang, Wei Wang, Zhi-Fan Wu +6
Gated Attention for Large Language Models: Non-linearity, Sparsity, and Attention-Sink-Free
Zihan Qiu, Zekun Wang, Bo Zheng +10
Linear-Time Self Attention with Codeword Histogram for Efficient Recommendation
Yongji Wu, Defu Lian, Neil Zhenqiang Gong +4
InterBERT: Vision-and-Language Interaction for Multi-modal Pretraining
Junyang Lin, An Yang, Yichang Zhang +3
Sampling-based Estimation of the Number of Distinct Values in Distributed Environment
Jiajun Li, Zhewei Wei, Bolin Ding +3
FSPN: A New Class of Probabilistic Graphical Model
Ziniu Wu, Rong Zhu, Andreas Pfadler +5
Language Models can Self-Lengthen to Generate Long Texts
Shanghaoran Quan, Tianyi Tang, Bowen Yu +7
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
Hao Xiang, Bowen Yu, Hongyu Lin +7
Continual Segment: Towards a Single, Unified and Accessible Continual Segmentation Model of 143 Whole-body Organs in CT Scans
Zhanghexuan Ji, Dazhou Guo, Puyang Wang +9
Stabilizing Reinforcement Learning with LLMs: Formulation and Practices
Chujie Zheng, Kai Dang, Bowen Yu +10
WordArt Designer: User-Driven Artistic Typography Synthesis using Large Language Models
Jun-Yan He, Zhi-Qi Cheng, Chenyang Li +10
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
Yanzhao Zhang, Mingxin Li, Dingkun Long +9
AdaBERT: Task-Adaptive BERT Compression with Differentiable Neural Architecture Search
Daoyuan Chen, Yaliang Li, Minghui Qiu +7
Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models
Yunfei Chu, Jin Xu, Xiaohuan Zhou +5
Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding
Xuanming Zhang, Sining Zhoubian, Yuxuan Chen +8
Matching in the Wild: Learning Anatomical Embeddings for Multi-Modality Images
Xiaoyu Bai, Fan Bai, Xiaofei Huo +10
Qwen-Image-Flash: Beyond Objective Design
Tianhe Wu, Kun Yan, Zikai Zhou +21
IterResearch: Rethinking Long-Horizon Agents with Interaction Scaling
Guoxin Chen, Zile Qiao, Xuanzhong Chen +13
Wan: Open and Advanced Large-Scale Video Generative Models
Team Wan, Ang Wang, Baole Ai +58
TrainMover: An Interruption-Resilient Runtime for ML Training
ChonLam Lao, Jiaqi Gao, Jiamin Cao +13
VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation
Zhengxiong Luo, Dayou Chen, Yingya Zhang +6
Layph: Making Change Propagation Constraint in Incremental Graph Processing by Layering Graph
Song Yu, Shufeng Gong, Yanfeng Zhang +7
WorldPM: Scaling Human Preference Modeling
Binghai Wang, Runji Lin, Keming Lu +17
Qwen3Guard Technical Report
Haiquan Zhao, Chenhan Yuan, Fei Huang +40
ModelScope-Agent: Building Your Customizable Agent System with Open-source Large Language Models
Chenliang Li, Hehong Chen, Ming Yan +11
Mobile-Agent-v3.5: Multi-platform Fundamental GUI Agents
Haiyang Xu, Xi Zhang, Haowei Liu +16
Dynamic Memory based Attention Network for Sequential Recommendation
Qiaoyu Tan, Jianwei Zhang, Ninghao Liu +4
Provable Scaling Laws for the Test-Time Compute of Large Language Models
Yanxi Chen, Xuchen Pan, Yaliang Li +2
WebSailor: Navigating Super-human Reasoning for Web Agent
Kuan Li, Zhongwang Zhang, Huifeng Yin +16
Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System
Jiazhao Zhang, Gengze Zhou, Hale Yin +32
Glue: Adaptively Merging Single Table Cardinality to Estimate Join Query Size
Rong Zhu, Tianjing Zeng, Andreas Pfadler +3
AmbiSQL: Interactive Ambiguity Detection and Resolution for Text-to-SQL
Zhongjun Ding, Yin Lin, Tianjing Zeng +3
Learning to Rehearse in Long Sequence Memorization
Zhu Zhang, Chang Zhou, Jianxin Ma +4
ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization
Xixi Wu, Kuan Li, Yida Zhao +13
PRICE: A Pretrained Model for Cross-Database Cardinality Estimation
Tianjing Zeng, Junwei Lan, Jiahong Ma +7
AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension
Qian Yang, Jin Xu, Wenrui Liu +8
Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models
Lianghua Huang, Zhi-Fan Wu, Wei Wang +22
mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding
Anwen Hu, Haiyang Xu, Jiabo Ye +8
Qwen3-VL Technical Report
Shuai Bai, Yuxuan Cai, Ruizhe Chen +61
Group Diffusion Transformers are Unsupervised Multitask Learners
Lianghua Huang, Wei Wang, Zhi-Fan Wu +6