SQUAWK · REPO

antirez/ds4

DeepSeek 4 Flash and PRO local inference engine for Metal, CUDA and ROCm

Voir sur GitHub →repéré le 02/08/2026

APPARITIONS DANS LE DIGEST

DeepSeek-V4-Flash : benchmarks d'inférence locale sur GPU grand publicapparu le 2026-08-02

Multiples retours d'utilisateurs faisant tourner DeepSeek-V4-Flash en local sur des configs variées (RTX 3090, MI50, A6000) avec llama.cpp, utile pour qui veut évaluer le coût/perf d'un LLM open-weight sans API payante.