LocalIndex

Catalogue modeles

Filtre. Compare. Ouvre la fiche.

Resultats

23 modeles

Affichage 1-6
LFM2.5Edge

LFM2.5 1.2B Instruct

Modele edge tres rapide pour RAG, extraction et assistants locaux simples.

Intelligence3/5
Vitesse5/5
Params1.17B
Actifs-
VRAM0.72 Go
Tok/saucun
edgeconsumer GPU friendlytool usefast CPU
Fiche
LFM2.5Edge

LFM2.5 1.2B Thinking

Variante thinking sous 2B pour raisonner localement sans grosse machine.

Intelligence3/5
Vitesse5/5
Params1.17B
Actifs-
VRAM0.86 Go
Tok/saucun
thinkingedgeconsumer GPU friendlyfast CPU
Fiche
Gemma 4Edge

Gemma 4 E2B

Gemma edge tres leger pour mobile, laptop et essais multimodaux rapides.

Intelligence2/5
Vitesse5/5
Params2B
Actifs-
VRAM1.1 Go
Tok/saucun
QATconsumer GPU friendlyedge
Fiche
Gemma 4Edge

Gemma 4 E4B

Petit Gemma QAT pour garder une bonne reactivite en local avec vision.

Intelligence3/5
Vitesse4/5
Params4B
Actifs-
VRAM2.5 Go
Tok/saucun
QATconsumer GPU friendlyedge
Fiche
Qwen3.5Dense

Qwen3.5 0.8B

Modele minuscule pour tests rapides, agents simples et machines tres limitees.

Intelligence1/5
Vitesse5/5
Params0.8B
Actifs-
VRAM3.5 Go
Tok/saucun
consumer GPU friendlylong contextsmall
Fiche
Qwen3.5Dense

Qwen3.5 2B

Petit Qwen local pour chat leger, extraction et workflows longs a faible cout.

Intelligence2/5
Vitesse5/5
Params2B
Actifs-
VRAM3.5 Go
Tok/saucun
consumer GPU friendlylong contextsmall
Fiche