SQUAWK · REPO
antirez/ds4
DeepSeek 4 Flash and PRO local inference engine for Metal, CUDA and ROCm
Voir sur GitHub →repéré le 02/08/2026
APPARITIONS DANS LE DIGEST
DeepSeek-V4-Flash : benchmarks d'inférence locale sur GPU grand publicapparu le 2026-08-02
Multiples retours d'utilisateurs faisant tourner DeepSeek-V4-Flash en local sur des configs variées (RTX 3090, MI50, A6000) avec llama.cpp, utile pour qui veut évaluer le coût/perf d'un LLM open-weight sans API payante.