SQUAWK · REPO
mudler/vllm.cpp
A full port of the vLLM serving stack to C++20 (66MB binary, no Python required) — great for embedding LLM inference in an app without dragging in a Python environment.
Voir sur GitHub →repéré le 07/08/2026
INSTALL
cmake -S . -B build && cmake --build build -jAPPARITIONS DANS LE DIGEST
Portage de vLLM en C++20 sans dépendance Pythonapparu le 2026-08-07
Portage complet du serving stack vLLM en C++20 (binaire de 66 Mo, sans Python), très utile pour embarquer de l'inférence LLM dans une app sans la lourdeur d'un environnement Python.