Retour index

Gemma 4 / Dense

Gemma 4 12B

Taille centrale Gemma pour chat local, vision et GPU grand public confortables.

VRAM min6.7 Go
Contexte128 000
Params12B
Actifs-

Lecture benchmarks

Intelligence4/5
Vitesse3/5

Quantizations

Memoire estimee et runtimes

FormatVRAM/RAMRuntimesSource
BF1626.7 GovLLMGoogle AI memory table
SFP813.4 GovLLMGoogle AI memory table
Q4_06.7 Gollama.cpp, Ollama, LM Studio, Atomic ChatGoogle AI memory table

Sources

Liens de reference

Tok/s

Mesures tok/s GPU

GPUVRAM/RAMRuntimeAppQuantContexteTok/s
Aucune mesure tok/s locale pour ce modele.