vergleichen
GPUStack vs llama.cpp
Dieselben Fakten für beide, jede Nacht von GitHub gelesen, dazu die von Hand geprüfte Beziehung.
| Fakt | GPUStack | llama.cpp |
|---|---|---|
| Sprache | Python | C++ |
| Lizenz | Apache-2.0 | MIT |
| Sterne | 5.8k | 130k |
| Neuestes Release | v2.2.3 | v0.6.0 |
| Letzter Push | 2026-09-30 | 2026-10-06 |
| Release-Rhythmus | zu wenige Releases | zu wenige Releases |
| Aktive Mitwirkende | 27 Commit-Autoren auf dem Standard-Branch in den letzten 90 Tagen | 173+ Commit-Autoren auf dem Standard-Branch in den letzten 90 Tagen |
| Hinweise | keine | keine |
Wie sie zusammenhängen
Beide ersetzen ChatGPT. Alternativen zu ChatGPT →
TeilweiseGPUStackManages a cluster of GPUs and serves open-weight models across it behind an OpenAI-compatible API.
Teilweisellama.cppRuns open-weight models on CPU or GPU, with a built-in server and a minimal web chat.
GPUStack
- v2.3.0rc22026-09-30Pre-Release
- v2.3.0rc12026-09-01Pre-Release
- v2.2.32026-07-31Fixed an issue where vLLM services routed through GPUStack were incompatible with Claude Code. (Issue #5934)
- v2.2.3rc12026-07-31Pre-Release
- v2.2.22026-07-24This release fixes two security vulnerabilities. Users are strongly advised to upgrade immediately.
llama.cpp
- b114452026-10-06vulkan : check for null vkEnumerateInstanceVersion (#29872)Pre-Release
- b114432026-10-06models : consolidate nextn row cropping into shared helpers (#30017)Pre-Release
- b114402026-10-06llama : re-reserve the sched when the nextn extraction flags change (#30020)Pre-Release
- b114392026-10-06ggml: refactor selective expert copying to user code (#29943)Pre-Release
- b114382026-10-06test-llama-archs : initialize backends before generating models (#30034)Pre-Release
GPUStack
unsigniert Das neueste Release, v2.2.3, trägt keine Signatur, die GitHub prüfen könnte.
Der Sicherheitsbericht wird geladen
llama.cpp
unsigniert Das neueste Release, v0.6.0, trägt keine Signatur, die GitHub prüfen könnte.
Der Sicherheitsbericht wird geladen