MLX Quantisations for Qwen 3.8 2B
🏗️ Building on HF
Siddh Jagani
SiddhJagani
AI & ML interests
Building local AI systems, LLM tools, RAG infrastructure, and MLX model deployments.
Recent Activity
updated a Space 25 days ago
SiddhJagani/Stats published a Space 25 days ago
SiddhJagani/Stats updated a model 25 days ago
SiddhJagani/Qwen3.8-4B-mlx-2BitOrganizations
Qwen 3.8 9B
MLX Quantisations for Qwen 3.8 9B
Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus
MLX Claude Opus 4.5
-
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q8
Text Generation • 15B • Updated • 6 -
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q6
Text Generation • 15B • Updated • 15 -
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q3
Text Generation • 15B • Updated • 7 -
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q2
Text Generation • 15B • Updated • 11
GPT-OSS:20b
MLX Non-Thinking Models
-
SiddhJagani/gpt-oss-20b-no-think-mlx-2Bit
Text Generation • 21B • Updated • 173 • 2 -
SiddhJagani/gpt-oss-20b-no-think-mlx-Q3
Text Generation • 21B • Updated • 47 -
SiddhJagani/gpt-oss-20b-no-think-mlx-Q4
Text Generation • 21B • Updated • 26 -
SiddhJagani/gpt-oss-20b-no-think-mlx-Q6
Text Generation • 21B • Updated • 24
Qwen 3.8 4B
MLX Quantisations for Qwen 3.8 4B
Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus
MLX 8B Claude Opus 4.5
-
SiddhJagani/Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q8
Text Generation • 8B • Updated • 7 -
SiddhJagani/Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q6
Text Generation • 8B • Updated • 16 -
SiddhJagani/Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q4
Text Generation • 8B • Updated • 7
GPT-OSS-safeguard:20b
MLX Based GPT-OSS-Safeguard models
-
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q2
Text Generation • 21B • Updated • 46 -
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q3
Text Generation • 21B • Updated • 37 -
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q4
Text Generation • 21B • Updated • 27 -
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q6
Text Generation • 21B • Updated • 29
Qwen 3.8 2B
MLX Quantisations for Qwen 3.8 2B
Qwen 3.8 4B
MLX Quantisations for Qwen 3.8 4B
Qwen 3.8 9B
MLX Quantisations for Qwen 3.8 9B
Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus
MLX 8B Claude Opus 4.5
-
SiddhJagani/Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q8
Text Generation • 8B • Updated • 7 -
SiddhJagani/Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q6
Text Generation • 8B • Updated • 16 -
SiddhJagani/Nemotron-Cascade-8B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q4
Text Generation • 8B • Updated • 7
Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus
MLX Claude Opus 4.5
-
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q8
Text Generation • 15B • Updated • 6 -
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q6
Text Generation • 15B • Updated • 15 -
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q3
Text Generation • 15B • Updated • 7 -
SiddhJagani/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill-mlx-Q2
Text Generation • 15B • Updated • 11
GPT-OSS-safeguard:20b
MLX Based GPT-OSS-Safeguard models
-
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q2
Text Generation • 21B • Updated • 46 -
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q3
Text Generation • 21B • Updated • 37 -
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q4
Text Generation • 21B • Updated • 27 -
SiddhJagani/gpt-oss-safeguard-20b-mlx-Q6
Text Generation • 21B • Updated • 29
GPT-OSS:20b
MLX Non-Thinking Models
-
SiddhJagani/gpt-oss-20b-no-think-mlx-2Bit
Text Generation • 21B • Updated • 173 • 2 -
SiddhJagani/gpt-oss-20b-no-think-mlx-Q3
Text Generation • 21B • Updated • 47 -
SiddhJagani/gpt-oss-20b-no-think-mlx-Q4
Text Generation • 21B • Updated • 26 -
SiddhJagani/gpt-oss-20b-no-think-mlx-Q6
Text Generation • 21B • Updated • 24