SQUAWK · REPO

mudler/vllm.cpp

Portage complet du serving stack vLLM en C++20 (binaire de 66 Mo, sans Python), très utile pour embarquer de l'inférence LLM dans une app sans la lourdeur d'un environnement Python.

Voir sur GitHub →repéré le 07/08/2026

INSTALL

cmake -S . -B build && cmake --build build -j

APPARITIONS DANS LE DIGEST

Portage de vLLM en C++20 sans dépendance Pythonapparu le 2026-08-07

Portage complet du serving stack vLLM en C++20 (binaire de 66 Mo, sans Python), très utile pour embarquer de l'inférence LLM dans une app sans la lourdeur d'un environnement Python.