papers

Publications (48)

cs.CL2020

Single-/Multi-Source Cross-Lingual NER via Teacher-Student Learning on Unlabeled Data in Target Language

Qianhui Wu, Zijia Lin, Börje F. Karlsson +2

cs.LG2025

CartesianMoE: Boosting Knowledge Sharing among Experts via Cartesian Product Routing in Mixture-of-Experts

Zhenpeng Su, Xing Wu, Zijia Lin +6

cs.CL2025

Finedeep: Mitigating Sparse Activation in Dense LLMs via Multi-Layer Fine-Grained Experts

Leiyu Pan, Zhenpeng Su, Minxuan Lv +10

cs.CV2024

RepViT-SAM: Towards Real-Time Segmenting Anything

Ao Wang, Hui Chen, Zijia Lin +2

cs.CV2020

Shallow Feature Based Dense Attention Network for Crowd Counting

Yunqi Miao, Zijia Lin, Guiguang Ding +1

cs.CL2023

KwaiYiiMath: Technical Report

Jiayi Fu, Lei Lin, Xiaoyang Gao +18

cs.CL2024

Scaffold-BPE: Enhancing Byte Pair Encoding for Large Language Models with Simple and Effective Scaffold Token Removal

Haoran Lian, Yizhe Xiong, Jianwei Niu +7

cs.CV2024

YOLOv10: Real-Time End-to-End Object Detection

Ao Wang, Hui Chen, Lihao Liu +4

cs.IR2024

Drop your Decoder: Pre-training with Bag-of-Word Prediction for Dense Passage Retrieval

Guangyuan Ma, Xing Wu, Zijia Lin +1

cs.CL2025

EntropyLong: Effective Long-Context Training via Predictive Uncertainty

Junlong Jia, Ziyang Chen, Xing Wu +5

cs.CL2025

NExtLong: Toward Effective Long-Context Training without Long Documents

Chaochen Gao, Xing Wu, Zijia Lin +2

cs.AI2024

Evaluating Readability and Faithfulness of Concept-based Explanations

Meng Li, Haoran Jin, Ruixuan Huang +5

cs.CV2025

PrefixKV: Adaptive Prefix KV Cache is What Vision Instruction-Following Models Need for Efficient Generation

Ao Wang, Hui Chen, Jiaxin Li +6

cs.CV2025

Neutralizing Token Aggregation via Information Augmentation for Efficient Test-Time Adaptation

Yizhe Xiong, Zihan Zhou, Yiwen Liang +6

cs.CL2024

Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs

Chenxi Sun, Hongzhi Zhang, Zijia Lin +8

cs.CL2026

UniAttn: Reducing Inference Costs via Softmax Unification for Post-Training LLMs

Yizhe Xiong, Wei Huang, Xin Ye +6

cs.CV2020

IMRAM: Iterative Matching with Recurrent Attention Memory for Cross-Modal Image-Text Retrieval

Hui Chen, Guiguang Ding, Xudong Liu +3

cs.CV2025

Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations

Yiwen Liang, Hui Chen, Yizhe Xiong +7

cs.CV2024

Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual Persistence

Mengyao Lyu, Tianxiang Hao, Xinhao Xu +4

cs.CL2020

UniTrans: Unifying Model Transfer and Data Transfer for Cross-Lingual Named Entity Recognition with Unlabeled Data

Qianhui Wu, Zijia Lin, Börje F. Karlsson +2

cs.LG2026

Entropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning

Zhenpeng Su, Leiyu Pan, Minxuan Lv +7

cs.CL2024

LBPE: Long-token-first Tokenization to Improve Large Language Models

Haoran Lian, Yizhe Xiong, Zijia Lin +5

cs.CL2025

Temporal Scaling Law for Large Language Models

Yizhe Xiong, Xiansheng Chen, Xin Ye +8

cs.CV2025

CAIT: Triple-Win Compression towards High Accuracy, Fast Inference, and Favorable Transferability For ViTs

Ao Wang, Hui Chen, Zijia Lin +3

cs.CL2025

Fast Quiet-STaR: Thinking Without Thought Tokens

Wei Huang, Yizhe Xiong, Xin Ye +4

cs.CV2024

Promptable Anomaly Segmentation with SAM Through Self-Perception Tuning

Hui-Yue Yang, Hui Chen, Ao Wang +7

cs.CL2023

CoT-MAE v2: Contextual Masked Auto-Encoder with Multi-view Modeling for Passage Retrieval

Xing Wu, Guangyuan Ma, Peng Wang +4

cs.CV2024

[CLS] Token Tells Everything Needed for Training-free Efficient MLLMs

Ao Wang, Fengyuan Sun, Hui Chen +3

cs.CL2022

InfoCSE: Information-aggregated Contrastive Learning of Sentence Embeddings

Xing Wu, Chaochen Gao, Zijia Lin +3

cs.CV2023

Confidence-based Visual Dispersal for Few-shot Unsupervised Domain Adaptation

Yizhe Xiong, Hui Chen, Zijia Lin +2

cs.CL2019

GRN: Gated Relation Network to Enhance Convolutional Neural Network for Named Entity Recognition

Hui Chen, Zijia Lin, Guiguang Ding +3

cs.CL2025

DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs

Minxuan Lv, Zhenpeng Su, Leiyu Pan +10

cs.CL2025

LongMagpie: A Self-synthesis Method for Generating Large-scale Long-context Instructions

Chaochen Gao, Xing Wu, Zijia Lin +2

cs.CV2024

Video DataFlywheel: Resolving the Impossible Data Trinity in Video-Language Understanding

Xiao Wang, Jianlong Wu, Zijia Lin +3

cs.CV2022

RaP: Redundancy-aware Video-language Pre-training for Text-Video Retrieval

Xing Wu, Chaochen Gao, Zijia Lin +3

cs.CV2024

Context Enhancement with Reconstruction as Sequence for Unified Unsupervised Anomaly Detection

Hui-Yue Yang, Hui Chen, Lihao Liu +5

cs.CV2024

PYRA: Parallel Yielding Re-Activation for Training-Inference Efficient Task Adaptation

Yizhe Xiong, Hui Chen, Tianxiang Hao +6

cs.CL2022

ConTextual Masked Auto-Encoder for Dense Passage Retrieval

Xing Wu, Guangyuan Ma, Meng Lin +3

cs.CL2024

Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language Models

Haoran Lian, Junmin Chen, Wei Huang +8

cs.CV2025

YOLOE: Real-Time Seeing Anything

Ao Wang, Lihao Liu, Hui Chen +3

cs.IR2023

Query-as-context Pre-training for Dense Passage Retrieval

Xing Wu, Guangyuan Ma, Wanhui Qian +2

cs.CV2025

LSNet: See Large, Focus Small

Ao Wang, Hui Chen, Zijia Lin +2

cs.CL2026

MiLe Loss: a New Entropy-Weighed Loss for Mitigating the Bias of Learning Difficulties in Large Language Models

Zhenpeng Su, Xing Wu, Xue Bai +5

cs.CL2025

LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs

Junlong Jia, Xing Wu, Chaochen Gao +8

cs.CL2020

Enhanced Meta-Learning for Cross-lingual Named Entity Recognition with Minimal Resources

Qianhui Wu, Zijia Lin, Guoxin Wang +4

cs.CL2024

MaskMoE: Boosting Token-Level Learning via Routing Mask in Mixture-of-Experts

Zhenpeng Su, Zijia Lin, Xue Bai +8

cs.IR2023

Pre-training with Large Language Model-based Document Expansion for Dense Passage Retrieval

Guangyuan Ma, Xing Wu, Peng Wang +2

cs.CV2024

RepViT: Revisiting Mobile CNN From ViT Perspective

Ao Wang, Hui Chen, Zijia Lin +2