← Back to all models

LLaDA2.0 mini

General model by inclusionai · 16.26B parameters · Released 2025-11-25

Chip
Unified Memory
Bandwidth 307 GB/s 16-core GPU, the lowest of 2 bins at this memory
Available for Models ~21 GB

Everything this chip runs, machine by machine: MacBook Pro 14" M5 Pro, MacBook Pro 16" M5 Pro, Mac mini M5 Pro

Fit unconfirmed

LLaDA2.0 mini needs at least 15.9 of the 20.6 GiB available for models at Q8_0. The context cache, the recurrent state and the runtime's working memory are not measured, so the total is unconfirmed.

tok/s
Q8_0at least 15.9 GiBBenchmark needed
Confirm it on your Mac. Download freeToolPiper measures the file on your Mac before it loads.

Specifications

Parameters16.3B
Architecturellada2_moe
Context Length33K
CategoryGeneral
Mixture of Experts 256 experts, 8 active
Formatgguf
Minimum RAM9.1 GB
Licenseapache-2.0
HuggingFace Downloads143,914

Quantization Options

Unvalidated forecasts for an 8K text context under a declared full-GPU scenario, at the lowest GPU bin sold with the chosen memory. Memory is reported as its components: exact artifact bytes and a KV allocation derived from a declared attention layout where the catalog carries them, a parameter proxy with no error bound where it does not, and the runtime's working memory, which a browser cannot measure. A fit is confirmed only when every component is known, so a model whose known memory fits reads "Fit unconfirmed" until ToolPiper measures it on your Mac, and one whose known memory alone exceeds the budget reads "Won't fit". Estimated speed ignores prompt length and prefill, and can overstate long-context performance. No measured speed error range is available. The recommendation score weighs declared preferences, not measured answer quality, and becomes a range where evidence is missing.

QuantizationMemorySpeedVerdict
Q8_0 Recommended at least 15.9 GiB Benchmark needed Fit unconfirmed
Q6_K at least 12.1 GiB Benchmark needed Fit unconfirmed
Q5_K_M at least 10.3 GiB Benchmark needed Fit unconfirmed
Q4_K_M at least 8.8 GiB Benchmark needed Fit unconfirmed
Q3_K_M at least 7.3 GiB Benchmark needed Fit unconfirmed
Q2_K at least 5.6 GiB Benchmark needed Fit unconfirmed

Which Mac Can Run LLaDA2.0 mini?

Affiliate disclosure: the shop icons in this table are Amazon affiliate links. As an Amazon Associate, ModelPiper earns from qualifying purchases. Every fit rating, quantization and tok/s figure below is computed from the hardware specs and is not influenced by that.

Unvalidated forecasts for an 8K text context under a declared full-GPU scenario, at the lowest GPU bin sold with the chosen memory. Memory is reported as its components: exact artifact bytes and a KV allocation derived from a declared attention layout where the catalog carries them, a parameter proxy with no error bound where it does not, and the runtime's working memory, which a browser cannot measure. A fit is confirmed only when every component is known, so a model whose known memory fits reads "Fit unconfirmed" until ToolPiper measures it on your Mac, and one whose known memory alone exceeds the budget reads "Won't fit". Estimated speed ignores prompt length and prefill, and can overstate long-context performance. No measured speed error range is available. The recommendation score weighs declared preferences, not measured answer quality, and becomes a range where evidence is missing.

Minimum Mac

MacBook Pro 14" — M3 Pro 18GB

Q6_K · benchmark needed · 67% RAM · Fit unconfirmed

Known memory leaves the good-fit margin free; the runtime's working memory is not measured.

MacQuanttok/sRAM %
MacBook Air · M1 8GB Q2_K 70%
MacBook Air · M1 16GB Q6_K 76%
MacBook Air · M2 8GB Q2_K 70%
MacBook Air · M2 16GB Q6_K 76%
MacBook Air · M2 24GB Q8_0 66%
MacBook Air · M3 8GB Q2_K 70%
MacBook Air · M3 16GB Q6_K 76%
MacBook Air · M3 24GB Q8_0 66%
MacBook Air · M4 16GB Q6_K 76%
MacBook Air · M4 24GB Q8_0 66%
MacBook Air · M4 32GB Q8_0 50%
MacBook Air · M5 16GB Q6_K 76%
MacBook Air · M5 24GB Q8_0 66%
MacBook Air · M5 32GB Q8_0 50%
MacBook Pro 14" · M1 Pro 16GB Q6_K 76%
MacBook Pro 14" · M1 Pro 32GB Q8_0 50%
MacBook Pro 14" · M1 Max 32GB Q8_0 50%
MacBook Pro 14" · M1 Max 64GB Q8_0 25%
MacBook Pro 14" · M2 Pro 16GB Q6_K 76%
MacBook Pro 14" · M2 Pro 32GB Q8_0 50%
MacBook Pro 14" · M2 Max 32GB Q8_0 50%
MacBook Pro 14" · M2 Max 64GB Q8_0 25%
MacBook Pro 14" · M2 Max 96GB Q8_0 17%
MacBook Pro 14" · M3 8GB Q2_K 70%
MacBook Pro 14" · M3 16GB Q6_K 76%
MacBook Pro 14" · M3 24GB Q8_0 66%
MacBook Pro 14" · M3 Pro 18GB Q6_K 67%
MacBook Pro 14" · M3 Pro 36GB Q8_0 44%
MacBook Pro 14" · M3 Max 36GB Q8_0 44%
MacBook Pro 14" · M3 Max 48GB Q8_0 33%
MacBook Pro 14" · M3 Max 64GB Q8_0 25%
MacBook Pro 14" · M3 Max 96GB Q8_0 17%
MacBook Pro 14" · M3 Max 128GB Q8_0 12%
MacBook Pro 14" · M4 16GB Q6_K 76%
MacBook Pro 14" · M4 24GB Q8_0 66%
MacBook Pro 14" · M4 32GB Q8_0 50%
MacBook Pro 14" · M4 Pro 24GB Q8_0 66%
MacBook Pro 14" · M4 Pro 48GB Q8_0 33%
MacBook Pro 14" · M4 Max 36GB Q8_0 44%
MacBook Pro 14" · M4 Max 48GB Q8_0 33%
MacBook Pro 14" · M4 Max 64GB Q8_0 25%
MacBook Pro 14" · M4 Max 128GB Q8_0 12%
MacBook Pro 14" · M5 16GB Q6_K 76%
MacBook Pro 14" · M5 24GB Q8_0 66%
MacBook Pro 14" · M5 32GB Q8_0 50%
MacBook Pro 14" · M5 Pro 24GB Q8_0 66%
MacBook Pro 14" · M5 Pro 48GB Q8_0 33%
MacBook Pro 14" · M5 Pro 64GB Q8_0 25%
MacBook Pro 14" · M5 Max 36GB Q8_0 44%
MacBook Pro 14" · M5 Max 48GB Q8_0 33%
MacBook Pro 14" · M5 Max 64GB Q8_0 25%
MacBook Pro 14" · M5 Max 128GB Q8_0 12%
MacBook Pro 16" · M1 Pro 16GB Q6_K 76%
MacBook Pro 16" · M1 Pro 32GB Q8_0 50%
MacBook Pro 16" · M1 Max 32GB Q8_0 50%
MacBook Pro 16" · M1 Max 64GB Q8_0 25%
MacBook Pro 16" · M2 Pro 16GB Q6_K 76%
MacBook Pro 16" · M2 Pro 32GB Q8_0 50%
MacBook Pro 16" · M2 Max 32GB Q8_0 50%
MacBook Pro 16" · M2 Max 64GB Q8_0 25%
MacBook Pro 16" · M2 Max 96GB Q8_0 17%
MacBook Pro 16" · M3 Pro 18GB Q6_K 67%
MacBook Pro 16" · M3 Pro 36GB Q8_0 44%
MacBook Pro 16" · M3 Max 36GB Q8_0 44%
MacBook Pro 16" · M3 Max 48GB Q8_0 33%
MacBook Pro 16" · M3 Max 64GB Q8_0 25%
MacBook Pro 16" · M3 Max 96GB Q8_0 17%
MacBook Pro 16" · M3 Max 128GB Q8_0 12%
MacBook Pro 16" · M4 Pro 24GB Q8_0 66%
MacBook Pro 16" · M4 Pro 48GB Q8_0 33%
MacBook Pro 16" · M4 Max 36GB Q8_0 44%
MacBook Pro 16" · M4 Max 48GB Q8_0 33%
MacBook Pro 16" · M4 Max 64GB Q8_0 25%
MacBook Pro 16" · M4 Max 128GB Q8_0 12%
MacBook Pro 16" · M5 Pro 24GB Q8_0 66%
MacBook Pro 16" · M5 Pro 48GB Q8_0 33%
MacBook Pro 16" · M5 Pro 64GB Q8_0 25%
MacBook Pro 16" · M5 Max 36GB Q8_0 44%
MacBook Pro 16" · M5 Max 48GB Q8_0 33%
MacBook Pro 16" · M5 Max 64GB Q8_0 25%
MacBook Pro 16" · M5 Max 128GB Q8_0 12%
Mac mini · M1 8GB Q2_K 70%
Mac mini · M1 16GB Q6_K 76%
Mac mini · M2 8GB Q2_K 70%
Mac mini · M2 16GB Q6_K 76%
Mac mini · M2 24GB Q8_0 66%
Mac mini · M2 Pro 16GB Q6_K 76%
Mac mini · M2 Pro 32GB Q8_0 50%
Mac mini · M4 16GB Q6_K 76%
Mac mini · M4 24GB Q8_0 66%
Mac mini · M4 32GB Q8_0 50%
Mac mini · M4 Pro 24GB Q8_0 66%
Mac mini · M4 Pro 48GB Q8_0 33%
Mac mini · M4 Pro 64GB Q8_0 25%
Mac mini · M5 Pro 24GB Q8_0 66%
Mac mini · M5 Pro 48GB Q8_0 33%
Mac mini · M5 Pro 64GB Q8_0 25%
Mac mini · M6 16GB Q6_K 76%
Mac mini · M6 24GB Q8_0 66%
Mac mini · M6 32GB Q8_0 50%
Mac Studio · M1 Max 32GB Q8_0 50%
Mac Studio · M1 Max 64GB Q8_0 25%
Mac Studio · M1 Ultra 64GB Q8_0 25%
Mac Studio · M1 Ultra 128GB Q8_0 12%
Mac Studio · M2 Max 32GB Q8_0 50%
Mac Studio · M2 Max 64GB Q8_0 25%
Mac Studio · M2 Max 96GB Q8_0 17%
Mac Studio · M2 Ultra 64GB Q8_0 25%
Mac Studio · M2 Ultra 128GB Q8_0 12%
Mac Studio · M2 Ultra 192GB Q8_0 8%
Mac Studio · M4 Max 36GB Q8_0 44%
Mac Studio · M4 Max 48GB Q8_0 33%
Mac Studio · M4 Max 64GB Q8_0 25%
Mac Studio · M4 Max 128GB Q8_0 12%
Mac Studio · M3 Ultra 96GB Q8_0 17%
Mac Studio · M3 Ultra 256GB Q8_0 6%
Mac Studio · M3 Ultra 512GB Q8_0 3%
Mac Studio · M5 Max 36GB Q8_0 44%
Mac Studio · M5 Max 48GB Q8_0 33%
Mac Studio · M5 Max 64GB Q8_0 25%
Mac Studio · M5 Max 128GB Q8_0 12%
Mac Studio · M5 Ultra 96GB Q8_0 17%
Mac Studio · M5 Ultra 256GB Q8_0 6%
Mac Studio · M5 Ultra 512GB Q8_0 3%
iMac · M1 8GB Q2_K 70%
iMac · M1 16GB Q6_K 76%
iMac · M3 8GB Q2_K 70%
iMac · M3 16GB Q6_K 76%
iMac · M3 24GB Q8_0 66%
iMac · M4 16GB Q6_K 76%
iMac · M4 24GB Q8_0 66%
iMac · M4 32GB Q8_0 50%

Run LLaDA2.0 mini locally on your Mac

ToolPiper downloads, manages, and runs models with one click. Apple Silicon optimized.

Get ToolPiper free