Retour index
Qwen3.6 / MoE
Qwen3.6 35B-A3B
MoE moderne avec bon ratio qualite/calcul pour agents locaux exigeants.
VRAM min22 Go
Contexte262 144
Params35B
Actifs3B
Quantizations
Memoire estimee et runtimes
| Format | VRAM/RAM | Runtimes | Source |
|---|---|---|---|
| FP8 | 36 Go | vLLM | vLLM recipe |
| NVFP4 | 22 Go | vLLM | vLLM recipe |
| Q4_K_M | 22 Go | llama.cpp, LM Studio | Approximation consumer a partir des GGUF locaux. |
Sources
Liens de reference
Tok/s
Mesures tok/s GPU
| GPU | VRAM/RAM | Runtime | App | Quant | Contexte | Tok/s |
|---|---|---|---|---|---|---|
| Aucune mesure tok/s locale pour ce modele. | ||||||