Use case

Best AI models for summarization

Summarization is mostly a long-context + instruction-following problem. The winners overlap with the long-context list.

Top 25 models for document summarization

#ModelProviderContextInput price / 1MTier
1DeepSeek: DeepSeek V4 Flash 0423DeepSeek1.0M
Ultra context (1M+)
$0.09Budget
2DeepSeek: DeepSeek V4 Flash 0731DeepSeek1.3M
Ultra context (1M+)
$0.04Budget
3DeepSeek: DeepSeek V4 Flash 0731 (free)DeepSeek1.0M
Ultra context (1M+)
$0.00Budget
4Google: Gemini 2.0 Flash LiteGoogle1.0M
Ultra context (1M+)
$0.07Budget
5Google: Gemini 2.5 Flash Lite (batch)Google1.0M
Ultra context (1M+)
$0.05Budget
6Google: Lyria 3 Clip PreviewGoogle1.0M
Ultra context (1M+)
$0.00Budget
7Google: Lyria 3 Pro PreviewGoogle1.0M
Ultra context (1M+)
$0.00Budget
8MiniMax: MiniMax M3 (free)Minimax1.0M
Ultra context (1M+)
$0.00Budget
9NVIDIA: Nemotron 3 Ultra (free)Nvidia1M
Ultra context (1M+)
$0.00Budget
10NVIDIA: Nemotron 3.5 Lightning (free)Nvidia1M
Ultra context (1M+)
$0.00Budget
11OpenAI: GPT-4.1 Nano (batch)OpenAI1.0M
Ultra context (1M+)
$0.05Budget
12OpenAI: GPT-6 Luna (batch)OpenAI1.1M
Ultra context (1M+)
$0.05Budget
13OpenAI: GPT-6 Luna Pro (batch)OpenAI1.1M
Ultra context (1M+)
$0.05Budget
14Auto RouterOpenrouter2M
Ultra context (1M+)
$-1000000.00Budget
15Auto Router (Beta)Openrouter2M
Ultra context (1M+)
$-1000000.00Budget
16OpenRouter: FusionOpenrouter1M
Ultra context (1M+)
$-1000000.00Budget
17Pareto Code RouterOpenrouter2M
Ultra context (1M+)
$-1000000.00Budget
18Poolside: Laguna S 2.1Poolside1.0M
Ultra context (1M+)
$0.09Budget
19Qwen: Qwen3.5-FlashQwen1M
Ultra context (1M+)
$0.07Budget
20Qwen: Qwen3.6 Plus Preview (free)Qwen1M
Ultra context (1M+)
$0.00Budget
21Qwen: Qwen3.7 FlashQwen1M
Ultra context (1M+)
$0.03Budget
22Ox AlphaStealth1.0M
Ultra context (1M+)
$0.00Budget
23Thinking Machines: Inkling (free)Thinkingmachines1.0M
Ultra context (1M+)
$0.00Budget
24Thinking Machines: Inkling Small (free)Thinkingmachines1.0M
Ultra context (1M+)
$0.00Budget
25Z.ai: GLM 5.3 Flash (batch)Z Ai1.0M
Ultra context (1M+)
$0.06Budget

Frequently asked questions

Should I use a small or large model for summarization?

Smaller models are fine for simple TL;DR. For domain-specific or accuracy-sensitive summaries (legal, medical, technical), use frontier models.

Related use cases