circle-check\ Introducing Unsloth Studio: a new web UI for local AI\ \ πŸ¦₯chevron-right close

Unsloth LLMs directory for all our Dynamicarrow-up-right GGUF, 4-bit, 16-bit models on Hugging Face.

β€’ GGUF + 4-bit

β€’ Instruct 16-bit

β€’ Base 4 & 16-bit

β€’ FP8

Qwen DeepSeek Gemma Llama Mistral GLM

GGUFs let you run models in tools like Unsloth Studio ✨, Ollama and llama.cpp. Instruct (4-bit) safetensors can be used for inference or fine-tuning via Unsloth.

hashtag New & recommended models:

Model

Variant

GGUF

Instruct (4-bit)

Qwen3.6

27B

linkarrow-up-right

β€”

35B-A3B

linkarrow-up-right

β€”

Gemma 4

26B-A4B

linkarrow-up-right

β€”

31B

linkarrow-up-right

linkarrow-up-right

E4B

linkarrow-up-right

linkarrow-up-right

E2B

linkarrow-up-right

linkarrow-up-right

Kimi

K2.6

linkarrow-up-right

β€”

NVIDIA Nemotron 3

Nano-Omni-30B-A3B

linkarrow-up-right

β€”

Qwen3.5 arrow-up-right

35B-A3B

linkarrow-up-right

β€”

27B

linkarrow-up-right

β€”

122B-A10B

linkarrow-up-right

β€”

0.8B

linkarrow-up-right

β€”

2B

linkarrow-up-right

β€”

4B

linkarrow-up-right

β€”

9B

linkarrow-up-right

β€”

397B-A17B

linkarrow-up-right

β€”

Qwen3

Coder-Next

linkarrow-up-right

β€”

NVIDIA Nemotron 3

Super-120B-A12B

linkarrow-up-right

linkarrow-up-right

Nano-4B

linkarrow-up-right

β€”

GLM

4.7-Flash

linkarrow-up-right

β€”

5

linkarrow-up-right

β€”

Kimi

K2.5

linkarrow-up-right

β€”

gpt-oss

120B

linkarrow-up-right

linkarrow-up-right

20B

linkarrow-up-right

linkarrow-up-right

MiniMax

M2.5

linkarrow-up-right

β€”

NVIDIA Nemotron 3

30B

linkarrow-up-right

β€”

Qwen-Image

2512

linkarrow-up-right

β€”

Edit-2511

linkarrow-up-right

β€”

Ministral 3

3B

Instructarrow-up-right β€’ Reasoningarrow-up-right

Instructarrow-up-right β€’ Reasoningarrow-up-right

8B

Instructarrow-up-right β€’ Reasoningarrow-up-right

Instructarrow-up-right β€’ Reasoningarrow-up-right

14B

Instructarrow-up-right β€’ Reasoningarrow-up-right

Instructarrow-up-right β€’ Reasoningarrow-up-right

Devstral 2

24B

linkarrow-up-right

β€”

123B

linkarrow-up-right

β€”

Mistral Large 3

675B

linkarrow-up-right

linkarrow-up-right

Qwen3-Next

80B-A3B-Instruct

linkarrow-up-right

linkarrow-up-right

80B-A3B-Thinking

linkarrow-up-right

β€”

Qwen3-VL

2B-Instruct

linkarrow-up-right

linkarrow-up-right

2B-Thinking

linkarrow-up-right

linkarrow-up-right

4B-Instruct

linkarrow-up-right

linkarrow-up-right

4B-Thinking

linkarrow-up-right

linkarrow-up-right

8B-Instruct

linkarrow-up-right

linkarrow-up-right

8B-Thinking

linkarrow-up-right

linkarrow-up-right

30B-A3B-Instruct

linkarrow-up-right

β€”

30B-A3B-Thinking

linkarrow-up-right

β€”

32B-Instruct

linkarrow-up-right

linkarrow-up-right

32B-Thinking

linkarrow-up-right

linkarrow-up-right

235B-A22B-Instruct

linkarrow-up-right

β€”

235B-A22B-Thinking

linkarrow-up-right

β€”

Qwen3-2507

30B-A3B-Instruct

linkarrow-up-right

β€”

30B-A3B-Thinking

linkarrow-up-right

β€”

235B-A22B-Instruct

linkarrow-up-right

β€”

Qwen3-Coder

30B-A3B

linkarrow-up-right

β€”

GLM

4.7

linkarrow-up-right

β€”

4.6V-Flash

linkarrow-up-right

β€”

DeepSeek-V3.1

Terminus

linkarrow-up-right

β€”

V3.1

linkarrow-up-right

β€”

Granite-4.0

H-Small

linkarrow-up-right

linkarrow-up-right

Kimi-K2

Thinking

linkarrow-up-right

β€”

0905

linkarrow-up-right

β€”

hashtag DeepSeek models:

Model

Variant

GGUF

Instruct (4-bit)

DeepSeek-V3.1

Terminus

linkarrow-up-right

V3.1

linkarrow-up-right

DeepSeek-V3

V3-0324

linkarrow-up-right

β€”

V3

linkarrow-up-right

β€”

DeepSeek-R1

R1-0528

linkarrow-up-right

β€”

R1-0528-Qwen3-8B

linkarrow-up-right

linkarrow-up-right

R1

linkarrow-up-right

β€”

R1 Zero

linkarrow-up-right

β€”

Distill Llama 3 8 B

linkarrow-up-right

linkarrow-up-right

Distill Llama 3.3 70 B

linkarrow-up-right

linkarrow-up-right

Distill Qwen 2.5 1.5 B

linkarrow-up-right

linkarrow-up-right

Distill Qwen 2.5 7 B

linkarrow-up-right

linkarrow-up-right

Distill Qwen 2.5 14 B

linkarrow-up-right

linkarrow-up-right

Distill Qwen 2.5 32 B

linkarrow-up-right

linkarrow-up-right

hashtag Llama models:

Model

Variant

GGUF

Instruct (4-bit)

Llama 4

Scout 17 B-16 E

linkarrow-up-right

linkarrow-up-right

Maverick 17 B-128 E

linkarrow-up-right

β€”

Llama 3.3

70 B

linkarrow-up-right

linkarrow-up-right

Llama 3.2

1 B

linkarrow-up-right

linkarrow-up-right

3 B

linkarrow-up-right

linkarrow-up-right

11 B Vision

β€”

linkarrow-up-right

90 B Vision

β€”

linkarrow-up-right

Llama 3.1

8 B

linkarrow-up-right

linkarrow-up-right

70 B

β€”

linkarrow-up-right

405 B

β€”

linkarrow-up-right

Llama 3

8 B

β€”

linkarrow-up-right

70 B

β€”

linkarrow-up-right

Llama 2

7 B

β€”

linkarrow-up-right

13 B

β€”

linkarrow-up-right

CodeLlama

7 B

β€”

linkarrow-up-right

13 B

β€”

linkarrow-up-right

34 B

β€”

linkarrow-up-right

hashtag Gemma models:

Model

Variant

GGUF

Instruct (4-bit)

Gemma 4

E2B

linkarrow-up-right

linkarrow-up-right

E4B

linkarrow-up-right

linkarrow-up-right

26B-A4B

linkarrow-up-right

β€”

31B

linkarrow-up-right

linkarrow-up-right

FunctionGemma

270M

linkarrow-up-right

β€”

Gemma 3n

E2B

​ linkarrow-up-right

linkarrow-up-right

E4B

linkarrow-up-right

linkarrow-up-right

Gemma 3

270M

linkarrow-up-right

linkarrow-up-right

1 B

linkarrow-up-right

linkarrow-up-right

4 B

linkarrow-up-right

linkarrow-up-right

12 B

linkarrow-up-right

linkarrow-up-right

27 B

linkarrow-up-right

linkarrow-up-right

MedGemma

4 B (vision)

linkarrow-up-right

linkarrow-up-right

27 B (vision)

linkarrow-up-right

linkarrow-up-right

Gemma 2

2 B

linkarrow-up-right

linkarrow-up-right

9 B

β€”

linkarrow-up-right

27 B

β€”

linkarrow-up-right

hashtag Qwen models:

Model

Variant

GGUF

Instruct (4-bit)

Qwen3.6

27B

linkarrow-up-right

β€”

35B-A3B

linkarrow-up-right

β€”

Qwen3.5 arrow-up-right

35B-A3B

linkarrow-up-right

β€”

27B

linkarrow-up-right

β€”

122B-A10B

linkarrow-up-right

β€”

0.8B

linkarrow-up-right

β€”

2B

linkarrow-up-right

β€”

4B

linkarrow-up-right

β€”

9B

linkarrow-up-right

β€”

397B-A17B

linkarrow-up-right

β€”

Qwen3

Coder-Next

linkarrow-up-right

β€”

Qwen-Image

2512

linkarrow-up-right

β€”

Edit-2511

linkarrow-up-right

β€”

Qwen3-VL

2B-Instruct

linkarrow-up-right

linkarrow-up-right

2B-Thinking

linkarrow-up-right

linkarrow-up-right

4B-Instruct

linkarrow-up-right

linkarrow-up-right

4B-Thinking

linkarrow-up-right

linkarrow-up-right

8B-Instruct

linkarrow-up-right

linkarrow-up-right

8B-Thinking

linkarrow-up-right

linkarrow-up-right

Qwen3-Coder

30B-A3B

linkarrow-up-right

β€”

480B-A35B

linkarrow-up-right

β€”

Qwen3-2507

30B-A3B-Instruct

linkarrow-up-right

β€”

30B-A3B-Thinking

linkarrow-up-right

β€”

235B-A22B-Thinking

linkarrow-up-right

β€”

235B-A22B-Instruct

linkarrow-up-right

β€”

Qwen 3

0.6 B

linkarrow-up-right

linkarrow-up-right

1.7 B

linkarrow-up-right

linkarrow-up-right

4 B

linkarrow-up-right

linkarrow-up-right

8 B

linkarrow-up-right

linkarrow-up-right

14 B

linkarrow-up-right

linkarrow-up-right

30 B-A3B

linkarrow-up-right

linkarrow-up-right

32 B

linkarrow-up-right

linkarrow-up-right

235 B-A22B

linkarrow-up-right

β€”

Qwen 2.5 Omni

3 B

linkarrow-up-right

β€”

7 B

linkarrow-up-right

β€”

Qwen 2.5 VL

3 B

linkarrow-up-right

linkarrow-up-right

7 B

linkarrow-up-right

linkarrow-up-right

32 B

linkarrow-up-right

linkarrow-up-right

72 B

linkarrow-up-right

linkarrow-up-right

Qwen 2.5

0.5 B

β€”

linkarrow-up-right

1.5 B

β€”

linkarrow-up-right

3 B

β€”

linkarrow-up-right

7 B

β€”

linkarrow-up-right

14 B

β€”

linkarrow-up-right

32 B

β€”

linkarrow-up-right

72 B

β€”

linkarrow-up-right

Qwen 2.5 Coder (128 K)

0.5 B

linkarrow-up-right

linkarrow-up-right

1.5 B

linkarrow-up-right

linkarrow-up-right

3 B

linkarrow-up-right

linkarrow-up-right

7 B

linkarrow-up-right

linkarrow-up-right

14 B

linkarrow-up-right

linkarrow-up-right

32 B

linkarrow-up-right

linkarrow-up-right

QwQ

32 B

linkarrow-up-right

linkarrow-up-right

QVQ (preview)

72 B

β€”

linkarrow-up-right

Qwen 2 (chat)

1.5 B

β€”

linkarrow-up-right

7 B

β€”

linkarrow-up-right

72 B

β€”

linkarrow-up-right

Qwen 2 VL

2 B

β€”

linkarrow-up-right

7 B

β€”

linkarrow-up-right

72 B

β€”

linkarrow-up-right

hashtag GLM models:

Model

Variant

GGUF

Instruct (4-bit)

GLM

4.7-Flash

linkarrow-up-right

β€”

5

linkarrow-up-right

β€”

4.6V-Flash

linkarrow-up-right

β€”

4.6

linkarrow-up-right

β€”

4.5-Air

linkarrow-up-right

β€”

hashtag Mistral models:

Model

Variant

GGUF

Instruct (4-bit)

Magistral

Small (2506)

linkarrow-up-right

linkarrow-up-right

Small (2509)

linkarrow-up-right

linkarrow-up-right

Small (2507)

linkarrow-up-right

linkarrow-up-right

Mistral Small

3.2-24 B (2506)

linkarrow-up-right

linkarrow-up-right

3.1-24 B (2503)

linkarrow-up-right

linkarrow-up-right

3-24 B (2501)

linkarrow-up-right

linkarrow-up-right

2409-22 B

β€”

linkarrow-up-right

Devstral

Small-24 B (2507)

linkarrow-up-right

linkarrow-up-right

Small-24 B (2505)

linkarrow-up-right

linkarrow-up-right

Pixtral

12 B (2409)

β€”

linkarrow-up-right

Mistral NeMo

12 B (2407)

linkarrow-up-right

linkarrow-up-right

Mistral Large

2407

β€”

linkarrow-up-right

Mistral 7 B

v0.3

β€”

linkarrow-up-right

v0.2

β€”

linkarrow-up-right

Mixtral

8 Γ— 7 B

β€”

linkarrow-up-right

hashtag Phi models:

Model

Variant

GGUF

Instruct (4-bit)

Phi-4

Reasoning-plus

linkarrow-up-right

linkarrow-up-right

Reasoning

linkarrow-up-right

linkarrow-up-right

Mini-Reasoning

linkarrow-up-right

linkarrow-up-right

Phi-4 (instruct)

linkarrow-up-right

linkarrow-up-right

mini (instruct)

linkarrow-up-right

linkarrow-up-right

Phi-3.5

mini

β€”

linkarrow-up-right

Phi-3

mini

β€”

linkarrow-up-right

medium

β€”

linkarrow-up-right

hashtag Other (GLM, Orpheus, Smol, Llava etc.) models:

Model

Variant

GGUF

Instruct (4-bit)

GLM

4.5-Air

linkarrow-up-right

β€”

4.5

4.5arrow-up-right

β€”

4-32B-0414

4-32B-0414arrow-up-right

β€”

Grok 2

270B

linkarrow-up-right

β€”

Baidu-ERNIE

4.5-21B-A3B-Thinking

linkarrow-up-right

β€”

Hunyuan

A13B

linkarrow-up-right

β€”

Orpheus

0.1-ft (3B)

link

linkarrow-up-right

LLava

1.5 (7 B)

β€”

linkarrow-up-right

1.6 Mistral (7 B)

β€”

linkarrow-up-right

TinyLlama

Chat

β€”

linkarrow-up-right

SmolLM 2

135 M

linkarrow-up-right

linkarrow-up-right

360 M

linkarrow-up-right

linkarrow-up-right

1.7 B

linkarrow-up-right

linkarrow-up-right

Zephyr-SFT

7 B

β€”

linkarrow-up-right

Yi

6 B (v1.5)

β€”

linkarrow-up-right

6 B (v1.0)

β€”

linkarrow-up-right

34 B (chat)

β€”

linkarrow-up-right

34 B (base)

β€”

linkarrow-up-right

16-bit and 8-bit Instruct models are used for inference or fine-tuning in Unsloth Studio:

New models:

Model

Variant

Instruct (16-bit)

gpt-oss (new)

20b

linkarrow-up-right

120b

linkarrow-up-right

Gemma 3n

E2B

linkarrow-up-right

E4B

linkarrow-up-right

DeepSeek-R1-0528

R1-0528-Qwen3-8B

linkarrow-up-right

R1-0528

linkarrow-up-right

Mistral

Small 3.2 24B (2506)

linkarrow-up-right

Small 3.1 24B (2503)

linkarrow-up-right

Small 3.0 24B (2501)

linkarrow-up-right

Magistral Small (2506)

linkarrow-up-right

Qwen 3

0.6 B

linkarrow-up-right

1.7 B

linkarrow-up-right

4 B

linkarrow-up-right

8 B

linkarrow-up-right

14 B

linkarrow-up-right

30B-A3B

linkarrow-up-right

32 B

linkarrow-up-right

235B-A22B

linkarrow-up-right

Llama 4

Scout 17B-16E

linkarrow-up-right

Maverick 17B-128E

linkarrow-up-right

Qwen 2.5 Omni

3 B

linkarrow-up-right

7 B

linkarrow-up-right

Phi-4

Reasoning-plus

linkarrow-up-right

Reasoning

linkarrow-up-right

DeepSeek models

Model

Variant

Instruct (16-bit)

DeepSeek-V3

V3-0324

linkarrow-up-right

V3

linkarrow-up-right

DeepSeek-R1

R1-0528

linkarrow-up-right

R1-0528-Qwen3-8B

linkarrow-up-right

R1

linkarrow-up-right

R1 Zero

linkarrow-up-right

Distill Llama 3 8B

linkarrow-up-right

Distill Llama 3.3 70B

linkarrow-up-right

Distill Qwen 2.5 1.5B

linkarrow-up-right

Distill Qwen 2.5 7B

linkarrow-up-right

Distill Qwen 2.5 14B

linkarrow-up-right

Distill Qwen 2.5 32B

linkarrow-up-right

Llama models

Family

Variant

Instruct (16-bit)

Llama 4

Scout 17B-16E

linkarrow-up-right

Maverick 17B-128E

linkarrow-up-right

Llama 3.3

70 B

linkarrow-up-right

Llama 3.2

1 B

linkarrow-up-right

3 B

linkarrow-up-right

11 B Vision

linkarrow-up-right

90 B Vision

linkarrow-up-right

Llama 3.1

8 B

linkarrow-up-right

70 B

linkarrow-up-right

405 B

linkarrow-up-right

Llama 3

8 B

linkarrow-up-right

70 B

linkarrow-up-right

Llama 2

7 B

linkarrow-up-right

Gemma models:

Model

Variant

Instruct (16-bit)

Gemma 3n

E2B

linkarrow-up-right

E4B

linkarrow-up-right

Gemma 3

1 B

linkarrow-up-right

4 B

linkarrow-up-right

12 B

linkarrow-up-right

27 B

linkarrow-up-right

Gemma 2

2 B

linkarrow-up-right

9 B

linkarrow-up-right

27 B

linkarrow-up-right

Qwen models:

Family

Variant

Instruct (16-bit)

Qwen 3

0.6 B

linkarrow-up-right

1.7 B

linkarrow-up-right

4 B

linkarrow-up-right

8 B

linkarrow-up-right

14 B

linkarrow-up-right

30B-A3B

linkarrow-up-right

32 B

linkarrow-up-right

235B-A22B

linkarrow-up-right

Qwen 2.5 Omni

3 B

linkarrow-up-right

7 B

linkarrow-up-right

Qwen 2.5 VL

3 B

linkarrow-up-right

7 B

linkarrow-up-right

32 B

linkarrow-up-right

72 B

linkarrow-up-right

Qwen 2.5

0.5 B

linkarrow-up-right

1.5 B

linkarrow-up-right

3 B

linkarrow-up-right

7 B

linkarrow-up-right

14 B

linkarrow-up-right

32 B

linkarrow-up-right

72 B

linkarrow-up-right

Qwen 2.5 Coder 128 K

0.5 B

linkarrow-up-right

1.5 B

linkarrow-up-right

3 B

linkarrow-up-right

7 B

linkarrow-up-right

14 B

linkarrow-up-right

32 B

linkarrow-up-right

QwQ

32 B

linkarrow-up-right

QVQ (preview)

72 B

β€”

Qwen 2 (Chat)

1.5 B

linkarrow-up-right

7 B

linkarrow-up-right

72 B

linkarrow-up-right

Qwen 2 VL

2 B

linkarrow-up-right

7 B

linkarrow-up-right

72 B

linkarrow-up-right

Mistral models:

Model

Variant

Instruct (16-bit)

Mistral

Small 2409-22B

linkarrow-up-right

Mistral

Large 2407

linkarrow-up-right

Mistral

7B v0.3

linkarrow-up-right

Mistral

7B v0.2

linkarrow-up-right

Pixtral

12B 2409

linkarrow-up-right

Mixtral

8Γ—7B

linkarrow-up-right

Mistral NeMo

12B 2407

linkarrow-up-right

Devstral

Small 2505

linkarrow-up-right

Phi models:

Model

Variant

Instruct (16-bit)

Phi-4

Reasoning-plus

linkarrow-up-right

Reasoning

linkarrow-up-right

Phi-4 (core)

linkarrow-up-right

Mini-Reasoning

linkarrow-up-right

Mini

linkarrow-up-right

Phi-3.5

Mini

linkarrow-up-right

Phi-3

Mini

linkarrow-up-right

Medium

linkarrow-up-right

Text-to-Speech (TTS) models:

Model

Instruct (16-bit)

Orpheus-3B (v0.1 ft)

linkarrow-up-right

Orpheus-3B (v0.1 pt)

linkarrow-up-right

Sesame-CSM 1B

linkarrow-up-right

Whisper Large V3 (STT)

linkarrow-up-right

Llasa-TTS 1B

linkarrow-up-right

Spark-TTS 0.5B

linkarrow-up-right

Oute-TTS 1B

linkarrow-up-right

Base models are usually used for fine-tuning purposes:

New models:

Model

Variant

Base (16-bit)

Base (4-bit)

Gemma 3n

E2B

linkarrow-up-right

linkarrow-up-right

E4B

linkarrow-up-right

linkarrow-up-right

Qwen 3

0.6 B

linkarrow-up-right

linkarrow-up-right

1.7 B

linkarrow-up-right

linkarrow-up-right

4 B

linkarrow-up-right

linkarrow-up-right

8 B

linkarrow-up-right

linkarrow-up-right

14 B

linkarrow-up-right

linkarrow-up-right

30B-A3B

linkarrow-up-right

linkarrow-up-right

Llama 4

Scout 17B 16E

linkarrow-up-right

linkarrow-up-right

Maverick 17B 128E

linkarrow-up-right

β€”

Llama models:

Model

Variant

BaseΒ (16-bit)

BaseΒ (4-bit)

Llama 4

Scout 17B 16E

linkarrow-up-right

β€”

Maverick 17B 128E

linkarrow-up-right

β€”

Llama 3.3

70 B

linkarrow-up-right

β€”

Llama 3.2

1 B

linkarrow-up-right

β€”

3 B

linkarrow-up-right

β€”

11 B Vision

linkarrow-up-right

β€”

90 B Vision

linkarrow-up-right

β€”

Llama 3.1

8 B

linkarrow-up-right

β€”

70 B

linkarrow-up-right

β€”

Llama 3

8 B

linkarrow-up-right

linkarrow-up-right

Llama 2

7 B

linkarrow-up-right

linkarrow-up-right

13 B

linkarrow-up-right

linkarrow-up-right

Qwen models:

Model

Variant

BaseΒ (16-bit)

BaseΒ (4-bit)

Qwen 3

0.6 B

linkarrow-up-right

linkarrow-up-right

1.7 B

linkarrow-up-right

linkarrow-up-right

4 B

linkarrow-up-right

linkarrow-up-right

8 B

linkarrow-up-right

linkarrow-up-right

14 B

linkarrow-up-right

linkarrow-up-right

30B-A3B

linkarrow-up-right

linkarrow-up-right

Qwen 2.5

0.5 B

linkarrow-up-right

linkarrow-up-right

1.5 B

linkarrow-up-right

linkarrow-up-right

3 B

linkarrow-up-right

linkarrow-up-right

7 B

linkarrow-up-right

linkarrow-up-right

14 B

linkarrow-up-right

linkarrow-up-right

32 B

linkarrow-up-right

linkarrow-up-right

72 B

linkarrow-up-right

linkarrow-up-right

Qwen 2

1.5 B

linkarrow-up-right

linkarrow-up-right

7 B

linkarrow-up-right

linkarrow-up-right

Llama models:

Model

Variant

BaseΒ (16-bit)

BaseΒ (4-bit)

Llama 4

Scout 17B 16E

linkarrow-up-right

β€”

Maverick 17B 128E

linkarrow-up-right

β€”

Llama 3.3

70 B

linkarrow-up-right

β€”

Llama 3.2

1 B

linkarrow-up-right

β€”

3 B

linkarrow-up-right

β€”

11 B Vision

linkarrow-up-right

β€”

90 B Vision

linkarrow-up-right

β€”

Llama 3.1

8 B

linkarrow-up-right

β€”

70 B

linkarrow-up-right

β€”

Llama 3

8 B

linkarrow-up-right

linkarrow-up-right

Llama 2

7 B

linkarrow-up-right

linkarrow-up-right

13 B

linkarrow-up-right

linkarrow-up-right

Gemma models

Model

Variant

BaseΒ (16-bit)

BaseΒ (4-bit)

Gemma 3

1 B

linkarrow-up-right

linkarrow-up-right

4 B

linkarrow-up-right

linkarrow-up-right

12 B

linkarrow-up-right

linkarrow-up-right

27 B

linkarrow-up-right

linkarrow-up-right

Gemma 2

2 B

linkarrow-up-right

β€”

9 B

linkarrow-up-right

β€”

27 B

linkarrow-up-right

β€”

Mistral models:

Model

Variant

BaseΒ (16-bit)

BaseΒ (4-bit)

Mistral

Small 24B 2501

linkarrow-up-right

β€”

NeMo 12B 2407

linkarrow-up-right

β€”

7B v0.3

linkarrow-up-right

linkarrow-up-right

7B v0.2

linkarrow-up-right

linkarrow-up-right

Pixtral 12B 2409

linkarrow-up-right

β€”

Other (TTS, TinyLlama) models:

Model

Variant

BaseΒ (16-bit)

BaseΒ (4-bit)

TinyLlama

1.1 B (Base)

linkarrow-up-right

linkarrow-up-right

Orpheus-3b

0.1-pretrained

linkarrow-up-right

linkarrow-up-right

You can use our FP8 uploads for training or serving/deployment.

FP8 Dynamic offers slightly faster training and lower VRAM usage than FP8 Block, but with a small trade-off in accuracy.

Model

Variant

FP8 (Dynamic / Block)

Qwen3

Coder-Next

Dynamicarrow-up-right Β· Blockarrow-up-right

GLM

4.7-Flash

Dynamicarrow-up-right

Llama 3.3

70B Instruct

Dynamicarrow-up-right Β· Blockarrow-up-right

Llama 3.2

1B Base

Dynamicarrow-up-right Β· Blockarrow-up-right

1B Instruct

Dynamicarrow-up-right Β· Blockarrow-up-right

3B Base

Dynamicarrow-up-right Β· Blockarrow-up-right

3B Instruct

Dynamicarrow-up-right Β· Blockarrow-up-right

Llama 3.1

8B Base

Dynamicarrow-up-right Β· Blockarrow-up-right

8B Instruct

Dynamicarrow-up-right Β· Blockarrow-up-right

70B Base

Dynamicarrow-up-right Β· Blockarrow-up-right

Qwen3

0.6B

FP8arrow-up-right

1.7B

FP8arrow-up-right

4B

FP8arrow-up-right

8B

FP8arrow-up-right

14B

FP8arrow-up-right

32B

FP8arrow-up-right

235B-A22B

FP8arrow-up-right

Qwen3 (2507)

4B Instruct

FP8arrow-up-right

4B Thinking

FP8arrow-up-right

30B-A3B Instruct

FP8arrow-up-right

30B-A3B Thinking

FP8arrow-up-right

235B-A22B Instruct

FP8arrow-up-right

235B-A22B Thinking

FP8arrow-up-right

Qwen3-VL

4B Instruct

FP8arrow-up-right

4B Thinking

FP8arrow-up-right

8B Instruct

FP8arrow-up-right

8B Thinking

FP8arrow-up-right

Qwen3-Coder

480B-A35B Instruct

FP8arrow-up-right

Granite 4.0

h-tiny

FP8 Dynamicarrow-up-right

h-small

FP8 Dynamicarrow-up-right

Magistral Small

2509

FP8 Dynamicarrow-up-right Β· FP8 torchaoarrow-up-right

Mistral Small 3.2

24B Instruct-2506

FP8arrow-up-right

Gemma 3

270M-it torchao 270m β€” FP8arrow-up-right 1B β€” FP8arrow-up-right 4B β€” FP8arrow-up-right 12B β€” FP8arrow-up-right 27B β€” FP8arrow-up-right

FP8 torchaoarrow-up-right

PreviousUnsloth Notebookschevron-left NextInstallationchevron-right

Last updated 11 hours ago

Was this helpful?

This site uses cookies to deliver its service and to analyze traffic. By browsing this site, you accept the privacy policy.

close

AcceptReject