← Back to all models

Instella MoE 16B A3B Pretrain

General model by amd · 15.86B parameters

Chip
Unified Memory
Bandwidth 307 GB/s 16-core GPU, the lowest of 2 bins at this memory
Available for Models ~21 GB

Everything this chip runs, machine by machine: MacBook Pro 14" M5 Pro, MacBook Pro 16" M5 Pro, Mac mini M5 Pro

Fit unconfirmed

Instella MoE 16B A3B Pretrain needs at least 15.5 of the 20.6 GiB available for models at Q8_0. The context cache, the recurrent state and the runtime's working memory are not measured, so the total is unconfirmed.

—tok/s
Q8_0at least 15.5 GiBBenchmark needed
Confirm it on your Mac. Download freeToolPiper measures the file on your Mac before it loads.

Specifications

Parameters15.9B
Architecturedeepseek_v3
Context Length164K
CategoryGeneral
Mixture of Experts 64 experts, 6 active
Formatgguf
Minimum RAM8.9 GB
Licenseresearchrail

Quantization Options

Unvalidated forecasts for an 8K text context under a declared full-GPU scenario, at the lowest GPU bin sold with the chosen memory. Memory is reported as its components: exact artifact bytes and a KV allocation derived from a declared attention layout where the catalog carries them, a parameter proxy with no error bound where it does not, and the runtime's working memory, which a browser cannot measure. A fit is confirmed only when every component is known, so a model whose known memory fits reads "Fit unconfirmed" until ToolPiper measures it on your Mac, and one whose known memory alone exceeds the budget reads "Won't fit". Estimated speed ignores prompt length and prefill, and can overstate long-context performance. No measured speed error range is available. The recommendation score weighs declared preferences, not measured answer quality, and becomes a range where evidence is missing.

QuantizationMemorySpeedVerdict
Q8_0 Recommended at least 15.5 GiB Benchmark needed Fit unconfirmed
Q6_K at least 11.8 GiB Benchmark needed Fit unconfirmed
Q5_K_M at least 10.0 GiB Benchmark needed Fit unconfirmed
Q4_K_M at least 8.6 GiB Benchmark needed Fit unconfirmed
Q3_K_M at least 7.1 GiB Benchmark needed Fit unconfirmed
Q2_K at least 5.5 GiB Benchmark needed Fit unconfirmed

Which Mac Can Run Instella MoE 16B A3B Pretrain?

Affiliate disclosure: the shop icons in this table are Amazon affiliate links. As an Amazon Associate, ModelPiper earns from qualifying purchases. Every fit rating, quantization and tok/s figure below is computed from the hardware specs and is not influenced by that.

Unvalidated forecasts for an 8K text context under a declared full-GPU scenario, at the lowest GPU bin sold with the chosen memory. Memory is reported as its components: exact artifact bytes and a KV allocation derived from a declared attention layout where the catalog carries them, a parameter proxy with no error bound where it does not, and the runtime's working memory, which a browser cannot measure. A fit is confirmed only when every component is known, so a model whose known memory fits reads "Fit unconfirmed" until ToolPiper measures it on your Mac, and one whose known memory alone exceeds the budget reads "Won't fit". Estimated speed ignores prompt length and prefill, and can overstate long-context performance. No measured speed error range is available. The recommendation score weighs declared preferences, not measured answer quality, and becomes a range where evidence is missing.

Minimum Mac

MacBook Pro 14" — M3 Pro 18GB

Q6_K · benchmark needed · 66% RAM · Fit unconfirmed

Known memory leaves the good-fit margin free; the runtime's working memory is not measured.

MacQuanttok/sRAM %
MacBook Air · M1 8GB Q2_K — 68%
MacBook Air · M1 16GB Q6_K — 74%
MacBook Air · M2 8GB Q2_K — 68%
MacBook Air · M2 16GB Q6_K — 74%
MacBook Air · M2 24GB Q8_0 — 65%
MacBook Air · M3 8GB Q2_K — 68%
MacBook Air · M3 16GB Q6_K — 74%
MacBook Air · M3 24GB Q8_0 — 65%
MacBook Air · M4 16GB Q6_K — 74%
MacBook Air · M4 24GB Q8_0 — 65%
MacBook Air · M4 32GB Q8_0 — 48%
MacBook Air · M5 16GB Q6_K — 74%
MacBook Air · M5 24GB Q8_0 — 65%
MacBook Air · M5 32GB Q8_0 — 48%
MacBook Pro 14" · M1 Pro 16GB Q6_K — 74%
MacBook Pro 14" · M1 Pro 32GB Q8_0 — 48%
MacBook Pro 14" · M1 Max 32GB Q8_0 — 48%
MacBook Pro 14" · M1 Max 64GB Q8_0 — 24%
MacBook Pro 14" · M2 Pro 16GB Q6_K — 74%
MacBook Pro 14" · M2 Pro 32GB Q8_0 — 48%
MacBook Pro 14" · M2 Max 32GB Q8_0 — 48%
MacBook Pro 14" · M2 Max 64GB Q8_0 — 24%
MacBook Pro 14" · M2 Max 96GB Q8_0 — 16%
MacBook Pro 14" · M3 8GB Q2_K — 68%
MacBook Pro 14" · M3 16GB Q6_K — 74%
MacBook Pro 14" · M3 24GB Q8_0 — 65%
MacBook Pro 14" · M3 Pro 18GB Q6_K — 66%
MacBook Pro 14" · M3 Pro 36GB Q8_0 — 43%
MacBook Pro 14" · M3 Max 36GB Q8_0 — 43%
MacBook Pro 14" · M3 Max 48GB Q8_0 — 32%
MacBook Pro 14" · M3 Max 64GB Q8_0 — 24%
MacBook Pro 14" · M3 Max 96GB Q8_0 — 16%
MacBook Pro 14" · M3 Max 128GB Q8_0 — 12%
MacBook Pro 14" · M4 16GB Q6_K — 74%
MacBook Pro 14" · M4 24GB Q8_0 — 65%
MacBook Pro 14" · M4 32GB Q8_0 — 48%
MacBook Pro 14" · M4 Pro 24GB Q8_0 — 65%
MacBook Pro 14" · M4 Pro 48GB Q8_0 — 32%
MacBook Pro 14" · M4 Max 36GB Q8_0 — 43%
MacBook Pro 14" · M4 Max 48GB Q8_0 — 32%
MacBook Pro 14" · M4 Max 64GB Q8_0 — 24%
MacBook Pro 14" · M4 Max 128GB Q8_0 — 12%
MacBook Pro 14" · M5 16GB Q6_K — 74%
MacBook Pro 14" · M5 24GB Q8_0 — 65%
MacBook Pro 14" · M5 32GB Q8_0 — 48%
MacBook Pro 14" · M5 Pro 24GB Q8_0 — 65%
MacBook Pro 14" · M5 Pro 48GB Q8_0 — 32%
MacBook Pro 14" · M5 Pro 64GB Q8_0 — 24%
MacBook Pro 14" · M5 Max 36GB Q8_0 — 43%
MacBook Pro 14" · M5 Max 48GB Q8_0 — 32%
MacBook Pro 14" · M5 Max 64GB Q8_0 — 24%
MacBook Pro 14" · M5 Max 128GB Q8_0 — 12%
MacBook Pro 16" · M1 Pro 16GB Q6_K — 74%
MacBook Pro 16" · M1 Pro 32GB Q8_0 — 48%
MacBook Pro 16" · M1 Max 32GB Q8_0 — 48%
MacBook Pro 16" · M1 Max 64GB Q8_0 — 24%
MacBook Pro 16" · M2 Pro 16GB Q6_K — 74%
MacBook Pro 16" · M2 Pro 32GB Q8_0 — 48%
MacBook Pro 16" · M2 Max 32GB Q8_0 — 48%
MacBook Pro 16" · M2 Max 64GB Q8_0 — 24%
MacBook Pro 16" · M2 Max 96GB Q8_0 — 16%
MacBook Pro 16" · M3 Pro 18GB Q6_K — 66%
MacBook Pro 16" · M3 Pro 36GB Q8_0 — 43%
MacBook Pro 16" · M3 Max 36GB Q8_0 — 43%
MacBook Pro 16" · M3 Max 48GB Q8_0 — 32%
MacBook Pro 16" · M3 Max 64GB Q8_0 — 24%
MacBook Pro 16" · M3 Max 96GB Q8_0 — 16%
MacBook Pro 16" · M3 Max 128GB Q8_0 — 12%
MacBook Pro 16" · M4 Pro 24GB Q8_0 — 65%
MacBook Pro 16" · M4 Pro 48GB Q8_0 — 32%
MacBook Pro 16" · M4 Max 36GB Q8_0 — 43%
MacBook Pro 16" · M4 Max 48GB Q8_0 — 32%
MacBook Pro 16" · M4 Max 64GB Q8_0 — 24%
MacBook Pro 16" · M4 Max 128GB Q8_0 — 12%
MacBook Pro 16" · M5 Pro 24GB Q8_0 — 65%
MacBook Pro 16" · M5 Pro 48GB Q8_0 — 32%
MacBook Pro 16" · M5 Pro 64GB Q8_0 — 24%
MacBook Pro 16" · M5 Max 36GB Q8_0 — 43%
MacBook Pro 16" · M5 Max 48GB Q8_0 — 32%
MacBook Pro 16" · M5 Max 64GB Q8_0 — 24%
MacBook Pro 16" · M5 Max 128GB Q8_0 — 12%
Mac mini · M1 8GB Q2_K — 68%
Mac mini · M1 16GB Q6_K — 74%
Mac mini · M2 8GB Q2_K — 68%
Mac mini · M2 16GB Q6_K — 74%
Mac mini · M2 24GB Q8_0 — 65%
Mac mini · M2 Pro 16GB Q6_K — 74%
Mac mini · M2 Pro 32GB Q8_0 — 48%
Mac mini · M4 16GB Q6_K — 74%
Mac mini · M4 24GB Q8_0 — 65%
Mac mini · M4 32GB Q8_0 — 48%
Mac mini · M4 Pro 24GB Q8_0 — 65%
Mac mini · M4 Pro 48GB Q8_0 — 32%
Mac mini · M4 Pro 64GB Q8_0 — 24%
Mac mini · M5 Pro 24GB Q8_0 — 65%
Mac mini · M5 Pro 48GB Q8_0 — 32%
Mac mini · M5 Pro 64GB Q8_0 — 24%
Mac mini · M6 16GB Q6_K — 74%
Mac mini · M6 24GB Q8_0 — 65%
Mac mini · M6 32GB Q8_0 — 48%
Mac Studio · M1 Max 32GB Q8_0 — 48%
Mac Studio · M1 Max 64GB Q8_0 — 24%
Mac Studio · M1 Ultra 64GB Q8_0 — 24%
Mac Studio · M1 Ultra 128GB Q8_0 — 12%
Mac Studio · M2 Max 32GB Q8_0 — 48%
Mac Studio · M2 Max 64GB Q8_0 — 24%
Mac Studio · M2 Max 96GB Q8_0 — 16%
Mac Studio · M2 Ultra 64GB Q8_0 — 24%
Mac Studio · M2 Ultra 128GB Q8_0 — 12%
Mac Studio · M2 Ultra 192GB Q8_0 — 8%
Mac Studio · M4 Max 36GB Q8_0 — 43%
Mac Studio · M4 Max 48GB Q8_0 — 32%
Mac Studio · M4 Max 64GB Q8_0 — 24%
Mac Studio · M4 Max 128GB Q8_0 — 12%
Mac Studio · M3 Ultra 96GB Q8_0 — 16%
Mac Studio · M3 Ultra 256GB Q8_0 — 6%
Mac Studio · M3 Ultra 512GB Q8_0 — 3%
Mac Studio · M5 Max 36GB Q8_0 — 43%
Mac Studio · M5 Max 48GB Q8_0 — 32%
Mac Studio · M5 Max 64GB Q8_0 — 24%
Mac Studio · M5 Max 128GB Q8_0 — 12%
Mac Studio · M5 Ultra 96GB Q8_0 — 16%
Mac Studio · M5 Ultra 256GB Q8_0 — 6%
Mac Studio · M5 Ultra 512GB Q8_0 — 3%
iMac · M1 8GB Q2_K — 68%
iMac · M1 16GB Q6_K — 74%
iMac · M3 8GB Q2_K — 68%
iMac · M3 16GB Q6_K — 74%
iMac · M3 24GB Q8_0 — 65%
iMac · M4 16GB Q6_K — 74%
iMac · M4 24GB Q8_0 — 65%
iMac · M4 32GB Q8_0 — 48%

Run Instella MoE 16B A3B Pretrain locally on your Mac

ToolPiper downloads, manages, and runs models with one click. Apple Silicon optimized.

Get ToolPiper free