Retour index

LFM2.5 / Edge

LFM2.5 1.2B Thinking

Variante thinking sous 2B pour raisonner localement sans grosse machine.

VRAM min0.86 Go
Contexte32 768
Params1.17B
Actifs-

Lecture benchmarks

Intelligence3/5
Vitesse5/5

Quantizations

Memoire estimee et runtimes

FormatVRAM/RAMRuntimesSource
BF162.4 GoTransformers, vLLM, SGLangLiquidAI model card
Q4_00.86 Gollama.cpp, LM Studio, OllamaLiquidAI speed table
Mobile0.9 GoONNX Runtime, MLXLiquidAI edge formats

Tok/s

Mesures tok/s GPU

GPUVRAM/RAMRuntimeAppQuantContexteTok/s
Aucune mesure tok/s locale pour ce modele.