LFM2.5Edge
LFM2.5 1.2B Instruct
Modele edge tres rapide pour RAG, extraction et assistants locaux simples.
Params1.17B
Actifs-
VRAM0.72 Go
Tok/saucun
edgeconsumer GPU friendlytool usefast CPU
FicheFiltre. Compare. Ouvre la fiche.
Modele edge tres rapide pour RAG, extraction et assistants locaux simples.
Variante thinking sous 2B pour raisonner localement sans grosse machine.
Gemma edge tres leger pour mobile, laptop et essais multimodaux rapides.
Petit Gemma QAT pour garder une bonne reactivite en local avec vision.
Modele minuscule pour tests rapides, agents simples et machines tres limitees.
Petit Qwen local pour chat leger, extraction et workflows longs a faible cout.