Retour index
Gemma 4 / Dense
Gemma 4 12B
Taille centrale Gemma pour chat local, vision et GPU grand public confortables.
VRAM min6.7 Go
Contexte128 000
Params12B
Actifs-
Quantizations
Memoire estimee et runtimes
| Format | VRAM/RAM | Runtimes | Source |
|---|---|---|---|
| BF16 | 26.7 Go | vLLM | Google AI memory table |
| SFP8 | 13.4 Go | vLLM | Google AI memory table |
| Q4_0 | 6.7 Go | llama.cpp, Ollama, LM Studio, Atomic Chat | Google AI memory table |
Sources
Liens de reference
Tok/s
Mesures tok/s GPU
| GPU | VRAM/RAM | Runtime | App | Quant | Contexte | Tok/s |
|---|---|---|---|---|---|---|
| Aucune mesure tok/s locale pour ce modele. | ||||||