Open-weight models
Open-weight models you can download, fine-tune, and run on your own infrastructure. No vendor lock-in, no per-token cost.
15 models in this category. See also the “Best open-source AI models” ranking with editorial picks and FAQ.
| Model | Provider | Context | Input price / 1M | Tier |
|---|---|---|---|---|
| DeepSeek Chat (legacy id) deepseek/deepseek-chat | DeepSeek | 1M Ultra context (1M+) | Custom | Variable |
| DeepSeek Reasoner (legacy id) deepseek/deepseek-reasoner | DeepSeek | 1M Ultra context (1M+) | Custom | Variable |
| DeepSeek V4 Flash deepseek/deepseek-v4-flash | DeepSeek | 1M Ultra context (1M+) | Custom | Variable |
| DeepSeek V4 Pro deepseek/deepseek-v4-pro | DeepSeek | 1M Ultra context (1M+) | Custom | Variable |
| DeepSeek R1 deepseek/deepseek-r1 | DeepSeek | 128K Long context (128K+) | Custom | Variable |
| DeepSeek V3 deepseek/deepseek-v3 | DeepSeek | 128K Long context (128K+) | Custom | Variable |
| Qwen2.5 72B Instruct qwen/qwen2.5-72b-instruct | Qwen | 128K Long context (128K+) | Custom | Variable |
| Qwen2.5 Coder 32B qwen/qwen2.5-coder-32b | Qwen | 128K Long context (128K+) | Custom | Variable |
| o1 openai/o1 | OpenAI | 200K Long context (128K+) | Custom | Variable |
| o3-mini openai/o3-mini | OpenAI | 200K Long context (128K+) | Custom | Variable |
| GPT-4o openai/gpt-4o | OpenAI | 128K Long context (128K+) | Custom | Variable |
| GPT-4o mini openai/gpt-4o-mini | OpenAI | 128K Long context (128K+) | Custom | Variable |
| Llama 3.1 405B Instruct meta/llama-3.1-405b-instruct | Meta | 128K Long context (128K+) | Custom | Variable |
| Llama 3.1 70B Instruct meta/llama-3.1-70b-instruct | Meta | 128K Long context (128K+) | Custom | Variable |
| Llama 3.1 8B Instruct meta/llama-3.1-8b-instruct | Meta | 128K Long context (128K+) | Custom | Variable |