SOTAVerified

Text Summarization

Text Summarization is a natural language processing (NLP) task that involves condensing a lengthy text document into a shorter, more compact version while still retaining the most important information and meaning. The goal is to produce a summary that accurately represents the content of the original text in a concise form.

There are different approaches to text summarization, including extractive methods that identify and extract important sentences or phrases from the text, and abstractive methods that generate new text based on the content of the original text.

Papers

Showing 301–350 of 1340 papers

TitleStatusHype
More is More: Addition Bias in Large Language ModelsCode0
Abstractive Text Summarization: State of the Art, Challenges, and Improvements—0
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback—0
Scaling Up Summarization: Leveraging Large Language Models for Long Text Extractive Summarization—0
Measuring text summarization factuality using atomic facts entailment metrics in the context of retrieval augmented generation—0
Bidirectional Awareness Induction in Autoregressive Seq2Seq Models—0
Using generative AI to support standardization work -- the case of 3GPP—0
'Finance Wizard' at the FinLLM Challenge Task: Financial Text Summarization—0
L3iTC at the FinLLM Challenge Task: Quantization for Financial Text Classification & Summarization—0
A Framework for Fine-Tuning LLMs using Heterogeneous Feedback—0
Reconsidering Degeneration of Token Embeddings with Definitions for Encoder-based Pre-trained Language Models—0
Tensor Train Low-rank Approximation (TT-LoRA): Democratizing AI with Accelerated LLMs—0
Automatic Pull Request Description Generation Using LLMs: A T5 Model Approach—0
Sentence-wise Speech Summarization: Task, Datasets, and End-to-End Modeling with LM Knowledge Distillation—0
Improving Faithfulness of Large Language Models in Summarization via Sliding Generation and Self-Consistency—0
PLANTS: A Novel Problem and Dataset for Summarization of Planning-Like (PL) Tasks—0
Turning Generative Models Degenerate: The Power of Data Poisoning Attacks—0
AdaptEval: Evaluating Large Language Models on Domain Adaptation for Text SummarizationCode0
Tamil Language Computing: the Present and the Future—0
SATS: simplification aware text summarization of scientific documents—0
A Guide To Effectively Leveraging LLMs for Low-Resource Text Summarization: Data Augmentation and Semi-supervised Approaches—0
Large Language Models for Judicial Entity Extraction: A Comparative Study—0
Query-Guided Self-Supervised Summarization of Nursing Notes—0
An End-to-End Speech Summarization Using Large Language Model—0
CatMemo at the FinLLM Challenge Task: Fine-Tuning Large Language Models using Data Fusion in Financial Applications—0
A Comparative Study of Quality Evaluation Methods for Text Summarization—0
Applying RLAIF for Code Generation with API-usage in Lightweight LLMs—0
Can We Trust the Performance Evaluation of Uncertainty Estimation Methods in Text Summarization?Code0
Discrete Diffusion Language Model for Long Text Summarization—0
Enhancing Scientific Figure Captioning Through Cross-modal Learning—0
Real-time Speech Summarization for Medical Conversations—0
Factual Dialogue Summarization via Learning from Large Language Models—0
The Fire Thief Is Also the Keeper: Balancing Usability and Privacy in Prompts—0
Detecting Errors through Ensembling Prompts (DEEP): An End-to-End LLM Framework for Detecting Factual ErrorsCode0
A Systematic Survey of Text Summarization: From Statistical Methods to Large Language Models—0
Demonstration Notebook: Finding the Most Suited In-Context Learning Example from Interactions—0
Improving Autoregressive Training with Dynamic Oracles—0
Transformer Models in Education: Summarizing Science Textbooks with AraBART, MT5, AraT5, and mBART—0
Do LLMs Recognize me, When I is not me: Assessment of LLMs Understanding of Turkish Indexical Pronouns in Indexical Shift Contexts—0
Key-Element-Informed sLLM Tuning for Document Summarization—0
HeSum: a Novel Dataset for Abstractive Text Summarization in HebrewCode0
Gender Bias Detection in Court Decisions: A Brazilian Case StudyCode0
Artemis: Towards Referential Understanding in Complex Videos—0
Prompt Chaining or Stepwise Prompt? Refinement in Text Summarization—0
Multi-Dimensional Optimization for Text Summarization via Reinforcement Learning—0
Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF—0
Quo Vadis ChatGPT? From Large Language Models to Large Knowledge Models—0
RealitySummary: Exploring On-Demand Mixed Reality Text Summarization and Question Answering using Large Language Models—0
M-RAG: Reinforcing Large Language Model Performance through Retrieval-Augmented Generation with Multiple Partitions—0
5W1H Extraction With Large Language Models—0
Show:102550
← PrevPage 7 of 27Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1OpenAI/o3-miniROUGE-160.12—Unverified
2Riple/Saanvi-v0.1ROUGE-152.21—Unverified
3Pegasus+DotProdROUGE-140.6—Unverified
4BART-RXFROUGE-140.45—Unverified
5MUPPET BART LargeROUGE-140.4—Unverified
6Transformer+Rep(Uni)ROUGE-139.81—Unverified
7OFAROUGE-139.81—Unverified
8Transformer+WdropROUGE-139.66—Unverified
9ProphetNetROUGE-139.51—Unverified
10ERNIE-GENLARGE (large-scale text corpora)ROUGE-139.46—Unverified
#ModelMetricClaimedVerifiedStatus
1Top Down Transformer (AdaPool) (464M)ROUGE-151.05—Unverified
2eyeglaxsROUGE-150.34—Unverified
3BART-LSROUGE-150.3—Unverified
4LongT5ROUGE-150.23—Unverified
5GoSum (extractive)ROUGE-149.83—Unverified
6Lodoss-full-large (extractive)ROUGE-149.38—Unverified
7MemSum (extractive)ROUGE-149.25—Unverified
8Lodoss-full-base (extractive)ROUGE-148.93—Unverified
9HAT-BARTROUGE-148.25—Unverified
10GRETELROUGE-148.2—Unverified
#ModelMetricClaimedVerifiedStatus
1Top Down Transformer (AdaPool) (464M)ROUGE-150.95—Unverified
2BART-LSROUGE-150.2—Unverified
3Pegasus-XROUGE-150—Unverified
4ExtSum + oracle segmentation (extractive)ROUGE-149.49—Unverified
5FactorSumROUGE-149.32—Unverified
6ExtSum + supervised segmentation (extractive)ROUGE-149.11—Unverified
7Lodoss-full-large (extractive)ROUGE-148.45—Unverified
8MemSum (extractive)ROUGE-148.42—Unverified
9LongT5ROUGE-148.35—Unverified
10Lodoss-full-base (extractive)ROUGE-148.2—Unverified
#ModelMetricClaimedVerifiedStatus
1SelfmemROUGE-150.3—Unverified
2BRIOROUGE-149.07—Unverified
3PEGASUS + SummaRerankerROUGE-148.12—Unverified
4PEGASUS + SimCLSROUGE-147.61—Unverified
5PEGASUSLARGEROUGE-147.21—Unverified
6HAT-BARTROUGE-145.92—Unverified
7BARTROUGE-145.14—Unverified
8BertSumExtAbsROUGE-138.81—Unverified
9T-ConvS2SROUGE-131.89—Unverified
10Baseline : Extractive OracleROUGE-129.79—Unverified
#ModelMetricClaimedVerifiedStatus
1HSSASROUGE-142.3—Unverified
2SWAP-NETROUGE-141.6—Unverified
3RNES w/o coherenceROUGE-141.25—Unverified
4ML+RL ROUGE+Novel, with LMROUGE-140.02—Unverified
5GANROUGE-139.92—Unverified
6ML+RL, with intra-attentionROUGE-139.87—Unverified
7rnn-ext + abs + RL + rerankROUGE-139.66—Unverified
8SummaRuNNerROUGE-139.6—Unverified
9Lead-3 baselineROUGE-139.2—Unverified
10KIGN+Prediction-guideROUGE-138.95—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer+WDropROUGE-133.06—Unverified
2Transformer+LRPE+PE+Re-ranking+EnsembleROUGE-132.85—Unverified
3Transformer+LRPE+PE+ALONE+Re-rankingROUGE-132.57—Unverified
4EndDec+WFEROUGE-132.28—Unverified
5DRGDROUGE-131.79—Unverified
6Reinforced-Topic-ConvS2SROUGE-131.15—Unverified
7Seq2seq + selective + MTL + ERAMROUGE-129.33—Unverified
8SEASSROUGE-129.21—Unverified
9RAS-ElmanROUGE-128.97—Unverified
10words-lvt5k-1sentROUGE-128.61—Unverified
#ModelMetricClaimedVerifiedStatus
1OmniVec2ROUGE-159.1—Unverified
2InstructDSROUGE-155.3—Unverified
3MoCaROUGE-155.13—Unverified
4PEGASUS 2B + SliCROUGE-154.37—Unverified
5ConDigSumROUGE-154.3—Unverified
6SICKROUGE-153.73—Unverified
7HAT-CNNDMROUGE-153.01—Unverified
8BART-LargeROUGE-152.6—Unverified
9HAT-CNNDM RLROUGE-L48.84—Unverified
10CriSPO 3-shotROUGE-147.2—Unverified
#ModelMetricClaimedVerifiedStatus
1PEGASUS 2B + SLiCROUGE-132.03—Unverified
2BART+R3FROUGE-130.31—Unverified
3MUPPET BART LargeROUGE-130.3—Unverified
4PEGASUS + SummaRerankerROUGE-129.83—Unverified
5MatchSumROUGE-125.09—Unverified
#ModelMetricClaimedVerifiedStatus
1PRIMERROUGE-147.6—Unverified
2DeepPyramidionROUGE-147.15—Unverified
3Blockwise (baseline)ROUGE-146.85—Unverified
4Claude Instant + SigExtROUGE-145.2—Unverified
#ModelMetricClaimedVerifiedStatus
1InstructDSRouge147.8—Unverified
2OmniVec2Rouge147.6—Unverified
3OmniVecRouge146.91—Unverified
4SICKRouge146.26—Unverified
#ModelMetricClaimedVerifiedStatus
1Luhn's algorithm (25 sentences)ROUGE-132—Unverified
2Lead-kROUGE-125—Unverified
3Lead-3ROUGE-117.5—Unverified
4Full articleROUGE-116.98—Unverified
#ModelMetricClaimedVerifiedStatus
1Echoes-Extractive-AbstractiveROUGE42.13—Unverified
2BART-LSROUGE38.5—Unverified
3Top Down Transformer (AdaPool) (464M)ROUGE38.3—Unverified
#ModelMetricClaimedVerifiedStatus
1ERNIE-GENLARGE (large-scale text corpora)ROUGE-L33.23—Unverified
2ERNIE-GENLARGEROUGE-L32.5—Unverified
3ERNIE-GENBASEROUGE-L31.35—Unverified
#ModelMetricClaimedVerifiedStatus
1BertSumROUGE-135.91—Unverified
2MatchSum (BERT-base)ROUGE-131.85—Unverified
3Pointer-generator + coverageROUGE-128.53—Unverified
#ModelMetricClaimedVerifiedStatus
1LongT5ROUGE-176.87—Unverified
2BigBird-PegasusROUGE-160.64—Unverified
#ModelMetricClaimedVerifiedStatus
1BART-LSROUGE-162—Unverified
2FactorSumROUGE-160.1—Unverified
#ModelMetricClaimedVerifiedStatus
1Ground-truth transcript + Action with Hierarchical AttnContent F148.9—Unverified
2BertSumContent F136.4—Unverified
#ModelMetricClaimedVerifiedStatus
1CriSPO 3-shotROUGE-L54.1—Unverified
2Claude Instant + SigExtROUGE-L31.9—Unverified
#ModelMetricClaimedVerifiedStatus
1MiniLM-L12-multilingualSpearman Correlation30.67—Unverified
2ContrieverSpearman Correlation30.36—Unverified
#ModelMetricClaimedVerifiedStatus
1mBARThez (OrangeSum abstract)ROUGE-132.67—Unverified
2BARThez (OrangeSum abstract)ROUGE-131.44—Unverified
#ModelMetricClaimedVerifiedStatus
1CriSPO 3-shotROUGE-163.1—Unverified
#ModelMetricClaimedVerifiedStatus
1HAT-CNNDMROUGE-152.27—Unverified
#ModelMetricClaimedVerifiedStatus
1BigBird-PegasusROUGE-146.63—Unverified
#ModelMetricClaimedVerifiedStatus
1MatchSumROUGE-124.86—Unverified
#ModelMetricClaimedVerifiedStatus
1Longformer Encoder Decoderrouge138.65—Unverified
#ModelMetricClaimedVerifiedStatus
1GCN HybridROUGE-233.88—Unverified
#ModelMetricClaimedVerifiedStatus
1GenCompareSumROUGE-141.02—Unverified
#ModelMetricClaimedVerifiedStatus
1SATSAvg. Test Rouge134.24—Unverified