Retour index
Gemma 4 / Edge
Gemma 4 E4B
Petit Gemma QAT pour garder une bonne reactivite en local avec vision.
VRAM min2.5 Go
Contexte128 000
Params4B
Actifs-
Quantizations
Memoire estimee et runtimes
| Format | VRAM/RAM | Runtimes | Source |
|---|---|---|---|
| BF16 | 17.9 Go | vLLM | Google AI memory table |
| Q4_0 | 4.5 Go | llama.cpp, Ollama, LM Studio | Google AI memory table |
| Mobile | 2.5 Go | LiteRT-LM, Transformers.js | Google QAT blog |
Sources
Liens de reference
Tok/s
Mesures tok/s GPU
| GPU | VRAM/RAM | Runtime | App | Quant | Contexte | Tok/s |
|---|---|---|---|---|---|---|
| Aucune mesure tok/s locale pour ce modele. | ||||||