edc9f42da1
vllm-lfm25 on ana-ml2 GPU1 :8021 (LiquidAI/LFM2.5-2.6B, util 0.09 into unreserved slack, max-len 16384, no reasoning-parser so content is non-empty). LiteLLM alias lfm2.5-2.6b with vendor sampling baked as default (temp 0.1; top_k 50 + repetition_penalty 1.1 via extra_body). Eval-only, not in any routing chain, pending operator ruling on LFM Open License production use.