Selective Encoding for Abstractive Sentence Summarization
arXiv:1704.07073 · doi:10.18653/v1/P17-1101
Abstract
We propose a selective encoding model to extend the sequence-to-sequence framework for abstractive sentence summarization. It consists of a sentence encoder, a selective gate network, and an attention equipped decoder. The sentence encoder and decoder are built with recurrent neural networks. The selective gate network constructs a second level sentence representation by controlling the information flow from encoder to decoder. The second level representation is tailored for sentence summarization task, which leads to better performance. We evaluate our model on the English Gigaword, DUC 2004 and MSR abstractive sentence summarization datasets. The experimental results show that the proposed selective encoding model outperforms the state-of-the-art baseline models.
10 pages; To appear in ACL 2017
References in corpus (3)
Cited by in corpus (58)
- Explainable Outfit Recommendation with Joint Outfit Matching and Comment Generation
- Abstract Meaning Representation for Multi-Document Summarization
- Fast Abstractive Summarization with Reinforce-Selected Sentence Rewriting
- Structure-Infused Copy Mechanisms for Abstractive Summarization
- Neural Abstractive Text Summarization with Sequence-to-Sequence Models
- Abstractive Summarization of Reddit Posts with Multi-level Memory Networks
- Topic-Guided Variational Autoencoders for Text Generation
- Sticking to the Facts: Confident Decoding for Faithful Data-to-Text Generation
- S-Net: From Answer Extraction to Answer Generation for Machine Reading Comprehension
- Actor-Critic based Training Framework for Abstractive Summarization
- Abstractive Summarization with Combination of Pre-trained Sequence-to-Sequence and Saliency Models
- A Reinforced Topic-Aware Convolutional Sequence-to-Sequence Model for Abstractive Text Summarization
- Neural Language Generation: Formulation, Methods, and Evaluation
- SEQ^3: Differentiable Sequence-to-Sequence-to-Sequence Autoencoder for Unsupervised Abstractive Sentence Compression
- Global Encoding for Abstractive Summarization
- Adapting the Neural Encoder-Decoder Framework from Single to Multi-Document Summarization
- Connecting the Dots Between MLE and RL for Sequence Prediction
- Source-side Prediction for Neural Headline Generation
- One Size Does Not Fit All: Generating and Evaluating Variable Number of Keyphrases
- Entity Commonsense Representation for Neural Abstractive Summarization
- Positional Encoding to Control Output Sequence Length
- Synchronous Bidirectional Inference for Neural Sequence Generation
- Scoring Sentence Singletons and Pairs for Abstractive Summarization
- Attend to Medical Ontologies: Content Selection for Clinical Abstractive Summarization
- Concept Pointer Network for Abstractive Summarization
- Sequential Copying Networks
- Multi-Task Learning for Cross-Lingual Abstractive Summarization
- Mixture Content Selection for Diverse Sequence Generation
- ESA: Entity Summarization with Attention
- From Standard Summarization to New Tasks and Beyond: Summarization with Manifold Information
- FineText: Text Classification via Attention-based Language Model Fine-tuning
- Deep-speare: A Joint Neural Model of Poetic Language, Meter and Rhyme
- Multi-stage Pretraining for Abstractive Summarization
- Select and Attend: Towards Controllable Content Selection in Text Generation
- Diverse, Controllable, and Keyphrase-Aware: A Corpus and Method for News Multi-Headline Generation
- Improving the Similarity Measure of Determinantal Point Processes for Extractive Multi-Document Summarization
- Learning to Encode Text as Human-Readable Summaries using Generative Adversarial Networks
- Attention Head Masking for Inference Time Content Selection in Abstractive Summarization
- Unsupervised Summarization by Jointly Extracting Sentences and Keywords
- Salience Estimation with Multi-Attention Learning for Abstractive Text Summarization
- A Deep Neural Information Fusion Architecture for Textual Network Embeddings
- Direct Output Connection for a High-Rank Language Model
- Contrastive Attention Mechanism for Abstractive Sentence Summarization
- Abstractive Text Summarization by Incorporating Reader Comments
- BiSET: Bi-directional Selective Encoding with Template for Abstractive Summarization
- Character n-gram Embeddings to Improve RNN Language Models
- Alleviate Exposure Bias in Sequence Prediction \\ with Recurrent Neural Networks
- Clickbait? Sensational Headline Generation with Auto-tuned Reinforcement Learning
- A New Approach to Overgenerating and Scoring Abstractive Summaries
- Selective Attention Encoders by Syntactic Graph Convolutional Networks for Document Summarization
- Sequence Generation: From Both Sides to the Middle
- A Novel ILP Framework for Summarizing Content with High Lexical Variety
- Learning Syntactic and Dynamic Selective Encoding for Document Summarization
- Abstractive Summarization Improved by WordNet-based Extractive Sentences
- A Large-Scale Multi-Length Headline Corpus for Analyzing Length-Constrained Headline Generation Model Evaluation
- Learning to Summarize Passages: Mining Passage-Summary Pairs from Wikipedia Revision Histories
- Improving Truthfulness of Headline Generation
- Enhanced Seq2Seq Autoencoder via Contrastive Learning for Abstractive Text Summarization