Blaxel is joining Baseten. Read more

Model library

Browse our library of open source models that are ready to deploy behind an API endpoint in seconds.

100 large language models

DeepSeek Logo
Model API
LLM

DeepSeek V4.1 Flash

V4.1 - Flash
Thinking Machines Lab Logo
Model API
LLM

Inkling

B200
Meta AI logo
LLM

Llama 3.3 70B Instruct

3.3 - TRT-LLM - H100
Z AI Logo
LLM

GLM 5

5
Z AI Logo
Model API
LLM

GLM-5.3 Fast

5.3
Qwen Logo
LLM

Qwen3.5 35B-A3B

V1 - Latency - vLLM - H100
Z AI Logo
Model API
LLM

GLM-5.3

5.3
Kimi
Model API
LLM

Kimi K3

K3
Z AI Logo
Model API
LLM

GLM-5.3-Flash

5.3 - Flash
Qwen Logo
LLM

Qwen3.5 122B-A10B

V1 - Latency - vLLM - H100
NVIDIA logo
Model API
LLM

NVIDIA Nemotron 3 Ultra

Ultra
DeepSeek Logo
Model API
LLM

DeepSeek V4 Pro 0813

V4 - Pro 0813
poolside
LLM

Laguna S 2.1

S 2.1
Kimi
Model API
LLM

Kimi K2.6

2.6
Kimi
Model API
LLM

Kimi K2.7 Code

2.7 - Code
Z AI Logo
Model API
LLM

GLM 4.7

4.7
Z AI Logo
Model API
LLM

GLM-5.2 Fast

5.2 - Fast
Z AI Logo
Model API
LLM

GLM-5.2

5.2
OpenAI logo
Model API
LLM

GPT OSS 120B

MoE
DeepSeek Logo
Model API
LLM

DeepSeek V4 Pro

V4 Pro - B200
Thinking Machines Lab Logo
Model API
LLM

Inkling-Small

Small - B200
Kimi
Model API
LLM

Kimi K2.5

2.5
NVIDIA logo
Model API
LLM

NVIDIA Nemotron 3 Super

Super
Z AI Logo
Model API
LLM

GLM 5.1

5.1
poolside
LLM

Laguna M.1

H100
Qwen Logo
LLM

Qwen3.6 27B

V1 - Latency - H100
NVIDIA logo
LLM

Nemotron 3 Nano Omni

V1 - Latency - H100
Z AI Logo
LLM

GLM 4.6

4.6
DeepSeek Logo
Model API
LLM

DeepSeek V3.1

V3.1 - B200
Kimi
LLM

Kimi K2 Thinking

Thinking - K2
gemma
LLM

Gemma 4 E2B IT

4 - Latency - H100
gemma
LLM

Gemma 4 E4B IT

4 - Latency - H100
gemma
LLM

Gemma 4 26B A4B IT

4 - Latency - H100
gemma
LLM

Gemma 4 31B IT

4 - Latency - H100
Qwen Logo
LLM

Qwen3.5 9B

V1 - Latency - vLLM - H100
Qwen Logo
LLM

Qwen3.5 4B

V1 - Latency - vLLM - H100
DeepSeek Logo
LLM

DeepSeek V3.2

V3.2 - B200
Z AI Logo
LLM

GLM-4.6V

4.6 - Vision
Qwen Logo
Model API
LLM

Qwen3 Coder 480B

3 - Coder
Qwen Logo
LLM

Qwen3 VL 235B

3 - Vision Language
Z AI Logo
LLM

GLM-4.5V

4.5 - Vision
Z AI Logo
LLM

GLM-4.5 Air

4.5 - Air
Qwen Logo
LLM

Qwen 3 235B

V3 - SGLang - H100
Qwen Logo
LLM

Qwen 3 4B

V3 - TRT-LLM - H100
Mistral AI logo
LLM

Mistral Small 3.1

3.1 - vLLM - H100
Meta AI logo
LLM

Llama 3.1 405B Instruct

3.1 - Instruct - H100
Meta AI logo
LLM

Llama 3.2 11B Vision Instruct

3.2 - Vision - A100
inclusionAI logo
LLM

Ming-Image-0.1-Design

Design - H100
inclusionAI logo
LLM

Ming-Image-0.1-Design-Layer

Design Layer - H100
Z AI Logo
LLM

GLM 4.7 Flash

V1 - Latency - H100
Inception Labs Logo
Partner Model
LLM

Mercury 2.5

DeepSeek Logo
LLM

DeepSeek-V4-Flash-Vision-Exp

v4 - Flash-Vision-Exp - B200
Ornith AI Logo
Image processing

Ornith 1.5 35B-A3B

FP8
DeepSeek Logo
Model API
LLM

DeepSeek-V4-Flash-0731

v4 - Flash 0731
Mistral AI logo
Text classification

Mistral Shieldstral 1.0 3B

Inception Labs Logo
Partner Model API
LLM

Mercury 2

sid-ai
Partner Model API
LLM

SID 1

Subconscious Logo
Partner Model
LLM

Subconscious GLM 5.2

Stepfun logo icon
LLM

Step 3.7 Flash

3.7 - FP8 - vLLM - H100
poolside
LLM

Laguna XS 2.1

XS 2.1 - H100
H Company logo
LLM

Holo 3.1 35B-A3B

V1 - Throughput - H100
Qwen Logo
LLM

Qwen3.6 35B-A3B

V1 - Latency - H100
Meta AI logo
LLM

Llama 4 Maverick

V4.0 - Instruct - vLLM - B200
DeepSeek Logo
Model API
LLM

DeepSeek V3 0324

V3 - 0324 - B200
Meta AI logo
LLM

Llama 4 Scout

V4.0 - Instruct - vLLM - H100
DeepSeek Logo
LLM

DeepSeek R1 0528

R1 - 0528 - B200
NVIDIA logo
LLM

Llama 3.1 Nemotron Ultra 253B

3.1 - Nemotron - TRT-LLM - H100
DeepSeek Logo
LLM

DeepSeek-R1 Zero

R1 - Zero - SGLang - H200
Meta AI logo
LLM

Llama 3.2 90B Vision Instruct

3.2 - Vision - H100
DeepSeek Logo
LLM

DeepSeek Prover V2 671B

V2 - Prover - SGLang

🔥 Trending models