SOTAVerified

Text Summarization

Text Summarization is a natural language processing (NLP) task that involves condensing a lengthy text document into a shorter, more compact version while still retaining the most important information and meaning. The goal is to produce a summary that accurately represents the content of the original text in a concise form.

There are different approaches to text summarization, including extractive methods that identify and extract important sentences or phrases from the text, and abstractive methods that generate new text based on the content of the original text.

Papers

Showing 1–50 of 1340 papers

TitleStatusHype
LongLoRA: Efficient Fine-tuning of Long-Context Large Language ModelsCode6
h2oGPT: Democratizing Large Language ModelsCode6
Long Document Summarization with Top-down and Bottom-up InferenceCode6
Scaling Up Biomedical Vision-Language Models: Fine-Tuning, Instruction Tuning, and Multi-Modal LearningCode4
FinBen: A Holistic Financial Benchmark for Large Language ModelsCode4
MTEB: Massive Text Embedding BenchmarkCode4
Z-Code++: A Pre-trained Language Model Optimized for Abstractive SummarizationCode4
A Survey of Large Language Models in Finance (FinLLMs)Code3
NLG Evaluation Metrics Beyond Correlation Analysis: An Empirical Metric Preference ChecklistCode3
Investigating Efficiently Extending Transformers for Long Input SummarizationCode3
Attention Is All You NeedCode3
Differential TransformerCode2
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation AccuracyCode2
BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical TasksCode2
Towards a Unified Multi-Dimensional Evaluator for Text GenerationCode2
CoNT: Contrastive Neural Text GenerationCode2
BRIO: Bringing Order to Abstractive SummarizationCode2
Few-Shot Text Generation with Pattern-Exploiting TrainingCode2
Abstractive Summarization of Spoken andWritten Instructions with BERTCode2
PEGASUS: Pre-training with Extracted Gap-sentences for Abstractive SummarizationCode2
MASS: Masked Sequence to Sequence Pre-training for Language GenerationCode2
Improving large language models with concept-aware fine-tuningCode1
Curiosity-Driven Reinforcement Learning from Human FeedbackCode1
Large Language Models Reflect the Ideology of their CreatorsCode1
CriSPO: Multi-Aspect Critique-Suggestion-guided Automatic Prompt Optimization for Text GenerationCode1
MA-RLHF: Reinforcement Learning from Human Feedback with Macro ActionsCode1
FineSurE: Fine-grained Summarization Evaluation using LLMsCode1
FastMem: Fast Memorization of Prompt Improves Context Awareness of Large Language ModelsCode1
LaMDA: Large Model Fine-Tuning via Spectrally Decomposed Low-Dimensional AdaptationCode1
Hierarchical Prompting Taxonomy: A Universal Evaluation Framework for Large Language Models Aligned with Human Cognitive PrinciplesCode1
Text-Tuple-Table: Towards Information Integration in Text-to-Table Generation via Global Tuple ExtractionCode1
Accelerating Inference in Large Language Models with a Unified Layer Skipping StrategyCode1
FENICE: Factuality Evaluation of summarization based on Natural language Inference and Claim ExtractionCode1
TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue SummarizationCode1
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity AllocationCode1
Personalized Language Modeling from Personalized Human FeedbackCode1
The Radiation Oncology NLP DatabaseCode1
Ascle: A Python Natural Language Processing Toolkit for Medical Text GenerationCode1
DynaPipe: Optimizing Multi-task Training through Dynamic PipelinesCode1
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable SummarizationCode1
Zero-shot Faithfulness Evaluation for Text Summarization with Foundation Language ModelCode1
Adapted Large Language Models Can Outperform Medical Experts in Clinical Text SummarizationCode1
AskIt: Unified Programming Interface for Programming with Large Language ModelsCode1
Conformal Language ModelingCode1
MMSum: A Dataset for Multimodal Summarization and Thumbnail Generation of VideosCode1
Rewarded soups: towards Pareto-optimal alignment by interpolating weights fine-tuned on diverse rewardsCode1
Echoes from Alexandria: A Large Resource for Multilingual Book SummarizationCode1
Interactive Editing for Text SummarizationCode1
Preference-grounded Token-level Guidance for Language Model Fine-tuningCode1
A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark DatasetsCode1
Show:102550
← PrevPage 1 of 27Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1OpenAI/o3-miniROUGE-160.12—Unverified
2Riple/Saanvi-v0.1ROUGE-152.21—Unverified
3Pegasus+DotProdROUGE-140.6—Unverified
4BART-RXFROUGE-140.45—Unverified
5MUPPET BART LargeROUGE-140.4—Unverified
6Transformer+Rep(Uni)ROUGE-139.81—Unverified
7OFAROUGE-139.81—Unverified
8Transformer+WdropROUGE-139.66—Unverified
9ProphetNetROUGE-139.51—Unverified
10ERNIE-GENLARGE (large-scale text corpora)ROUGE-139.46—Unverified
#ModelMetricClaimedVerifiedStatus
1Top Down Transformer (AdaPool) (464M)ROUGE-151.05—Unverified
2eyeglaxsROUGE-150.34—Unverified
3BART-LSROUGE-150.3—Unverified
4LongT5ROUGE-150.23—Unverified
5GoSum (extractive)ROUGE-149.83—Unverified
6Lodoss-full-large (extractive)ROUGE-149.38—Unverified
7MemSum (extractive)ROUGE-149.25—Unverified
8Lodoss-full-base (extractive)ROUGE-148.93—Unverified
9HAT-BARTROUGE-148.25—Unverified
10GRETELROUGE-148.2—Unverified
#ModelMetricClaimedVerifiedStatus
1Top Down Transformer (AdaPool) (464M)ROUGE-150.95—Unverified
2BART-LSROUGE-150.2—Unverified
3Pegasus-XROUGE-150—Unverified
4ExtSum + oracle segmentation (extractive)ROUGE-149.49—Unverified
5FactorSumROUGE-149.32—Unverified
6ExtSum + supervised segmentation (extractive)ROUGE-149.11—Unverified
7Lodoss-full-large (extractive)ROUGE-148.45—Unverified
8MemSum (extractive)ROUGE-148.42—Unverified
9LongT5ROUGE-148.35—Unverified
10Lodoss-full-base (extractive)ROUGE-148.2—Unverified
#ModelMetricClaimedVerifiedStatus
1SelfmemROUGE-150.3—Unverified
2BRIOROUGE-149.07—Unverified
3PEGASUS + SummaRerankerROUGE-148.12—Unverified
4PEGASUS + SimCLSROUGE-147.61—Unverified
5PEGASUSLARGEROUGE-147.21—Unverified
6HAT-BARTROUGE-145.92—Unverified
7BARTROUGE-145.14—Unverified
8BertSumExtAbsROUGE-138.81—Unverified
9T-ConvS2SROUGE-131.89—Unverified
10Baseline : Extractive OracleROUGE-129.79—Unverified
#ModelMetricClaimedVerifiedStatus
1HSSASROUGE-142.3—Unverified
2SWAP-NETROUGE-141.6—Unverified
3RNES w/o coherenceROUGE-141.25—Unverified
4ML+RL ROUGE+Novel, with LMROUGE-140.02—Unverified
5GANROUGE-139.92—Unverified
6ML+RL, with intra-attentionROUGE-139.87—Unverified
7rnn-ext + abs + RL + rerankROUGE-139.66—Unverified
8SummaRuNNerROUGE-139.6—Unverified
9Lead-3 baselineROUGE-139.2—Unverified
10KIGN+Prediction-guideROUGE-138.95—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer+WDropROUGE-133.06—Unverified
2Transformer+LRPE+PE+Re-ranking+EnsembleROUGE-132.85—Unverified
3Transformer+LRPE+PE+ALONE+Re-rankingROUGE-132.57—Unverified
4EndDec+WFEROUGE-132.28—Unverified
5DRGDROUGE-131.79—Unverified
6Reinforced-Topic-ConvS2SROUGE-131.15—Unverified
7Seq2seq + selective + MTL + ERAMROUGE-129.33—Unverified
8SEASSROUGE-129.21—Unverified
9RAS-ElmanROUGE-128.97—Unverified
10words-lvt5k-1sentROUGE-128.61—Unverified
#ModelMetricClaimedVerifiedStatus
1OmniVec2ROUGE-159.1—Unverified
2InstructDSROUGE-155.3—Unverified
3MoCaROUGE-155.13—Unverified
4PEGASUS 2B + SliCROUGE-154.37—Unverified
5ConDigSumROUGE-154.3—Unverified
6SICKROUGE-153.73—Unverified
7HAT-CNNDMROUGE-153.01—Unverified
8BART-LargeROUGE-152.6—Unverified
9HAT-CNNDM RLROUGE-L48.84—Unverified
10CriSPO 3-shotROUGE-147.2—Unverified
#ModelMetricClaimedVerifiedStatus
1PEGASUS 2B + SLiCROUGE-132.03—Unverified
2BART+R3FROUGE-130.31—Unverified
3MUPPET BART LargeROUGE-130.3—Unverified
4PEGASUS + SummaRerankerROUGE-129.83—Unverified
5MatchSumROUGE-125.09—Unverified
#ModelMetricClaimedVerifiedStatus
1PRIMERROUGE-147.6—Unverified
2DeepPyramidionROUGE-147.15—Unverified
3Blockwise (baseline)ROUGE-146.85—Unverified
4Claude Instant + SigExtROUGE-145.2—Unverified
#ModelMetricClaimedVerifiedStatus
1InstructDSRouge147.8—Unverified
2OmniVec2Rouge147.6—Unverified
3OmniVecRouge146.91—Unverified
4SICKRouge146.26—Unverified
#ModelMetricClaimedVerifiedStatus
1Luhn's algorithm (25 sentences)ROUGE-132—Unverified
2Lead-kROUGE-125—Unverified
3Lead-3ROUGE-117.5—Unverified
4Full articleROUGE-116.98—Unverified
#ModelMetricClaimedVerifiedStatus
1Echoes-Extractive-AbstractiveROUGE42.13—Unverified
2BART-LSROUGE38.5—Unverified
3Top Down Transformer (AdaPool) (464M)ROUGE38.3—Unverified
#ModelMetricClaimedVerifiedStatus
1ERNIE-GENLARGE (large-scale text corpora)ROUGE-L33.23—Unverified
2ERNIE-GENLARGEROUGE-L32.5—Unverified
3ERNIE-GENBASEROUGE-L31.35—Unverified
#ModelMetricClaimedVerifiedStatus
1BertSumROUGE-135.91—Unverified
2MatchSum (BERT-base)ROUGE-131.85—Unverified
3Pointer-generator + coverageROUGE-128.53—Unverified
#ModelMetricClaimedVerifiedStatus
1LongT5ROUGE-176.87—Unverified
2BigBird-PegasusROUGE-160.64—Unverified
#ModelMetricClaimedVerifiedStatus
1BART-LSROUGE-162—Unverified
2FactorSumROUGE-160.1—Unverified
#ModelMetricClaimedVerifiedStatus
1Ground-truth transcript + Action with Hierarchical AttnContent F148.9—Unverified
2BertSumContent F136.4—Unverified
#ModelMetricClaimedVerifiedStatus
1CriSPO 3-shotROUGE-L54.1—Unverified
2Claude Instant + SigExtROUGE-L31.9—Unverified
#ModelMetricClaimedVerifiedStatus
1MiniLM-L12-multilingualSpearman Correlation30.67—Unverified
2ContrieverSpearman Correlation30.36—Unverified
#ModelMetricClaimedVerifiedStatus
1mBARThez (OrangeSum abstract)ROUGE-132.67—Unverified
2BARThez (OrangeSum abstract)ROUGE-131.44—Unverified
#ModelMetricClaimedVerifiedStatus
1CriSPO 3-shotROUGE-163.1—Unverified
#ModelMetricClaimedVerifiedStatus
1HAT-CNNDMROUGE-152.27—Unverified
#ModelMetricClaimedVerifiedStatus
1BigBird-PegasusROUGE-146.63—Unverified
#ModelMetricClaimedVerifiedStatus
1MatchSumROUGE-124.86—Unverified
#ModelMetricClaimedVerifiedStatus
1Longformer Encoder Decoderrouge138.65—Unverified
#ModelMetricClaimedVerifiedStatus
1GCN HybridROUGE-233.88—Unverified
#ModelMetricClaimedVerifiedStatus
1GenCompareSumROUGE-141.02—Unverified
#ModelMetricClaimedVerifiedStatus
1SATSAvg. Test Rouge134.24—Unverified