comparer
GPUStack vs llama.cpp
Les mêmes faits pour les deux, lus sur GitHub chaque nuit, et la relation qu'une personne a relue.
| Fait | GPUStack | llama.cpp |
|---|---|---|
| Langage | Python | C++ |
| Licence | Apache-2.0 | MIT |
| Étoiles | 5.8k | 130k |
| Dernière release | v2.2.3 | v0.6.0 |
| Dernier push | 2026-09-30 | 2026-10-06 |
| Rythme des releases | trop peu de releases | trop peu de releases |
| Contributeurs actifs | 27 auteurs de commits sur la branche par défaut ces 90 derniers jours | 173+ auteurs de commits sur la branche par défaut ces 90 derniers jours |
| Signalements | aucun | aucun |
Ce qui les relie
Les deux remplacent ChatGPT. Alternatives à ChatGPT →
PartielGPUStackManages a cluster of GPUs and serves open-weight models across it behind an OpenAI-compatible API.
Partielllama.cppRuns open-weight models on CPU or GPU, with a built-in server and a minimal web chat.
GPUStack
- v2.3.0rc22026-09-30pré-release
- v2.3.0rc12026-09-01pré-release
- v2.2.32026-07-31Fixed an issue where vLLM services routed through GPUStack were incompatible with Claude Code. (Issue #5934)
- v2.2.3rc12026-07-31pré-release
- v2.2.22026-07-24This release fixes two security vulnerabilities. Users are strongly advised to upgrade immediately.
llama.cpp
- b114452026-10-06vulkan : check for null vkEnumerateInstanceVersion (#29872)pré-release
- b114432026-10-06models : consolidate nextn row cropping into shared helpers (#30017)pré-release
- b114402026-10-06llama : re-reserve the sched when the nextn extraction flags change (#30020)pré-release
- b114392026-10-06ggml: refactor selective expert copying to user code (#29943)pré-release
- b114382026-10-06test-llama-archs : initialize backends before generating models (#30034)pré-release
GPUStack
non signée La dernière release, v2.2.3, ne porte aucune signature que GitHub puisse vérifier.
Chargement du rapport de sécurité
llama.cpp
non signée La dernière release, v0.6.0, ne porte aucune signature que GitHub puisse vérifier.
Chargement du rapport de sécurité