comparar
llama.cpp vs LMDeploy
Los mismos datos para ambos, leídos de GitHub cada noche, y la relación que revisó una persona.
| Dato | llama.cpp | LMDeploy |
|---|---|---|
| Lenguaje | C++ | Python |
| Licencia | MIT | Apache-2.0 |
| Estrellas | 130k | 8.1k |
| Última versión | v0.6.0 | v0.18.0 |
| Último push | 2026-10-06 | 2026-09-28 |
| Ritmo de versiones | muy pocas versiones | alrededor de 23 días entre versiones |
| Colaboradores activos | 173+ autores de commits en la rama por defecto en los últimos 90 días | 28 autores de commits en la rama por defecto en los últimos 90 días |
| Avisos | ninguno | ninguno |
Cómo se relacionan
Ambos sustituyen a ChatGPT. Alternativas a ChatGPT →
Parcialllama.cppRuns open-weight models on CPU or GPU, with a built-in server and a minimal web chat.
ParcialLMDeployServes open-weight models behind an OpenAI-compatible API, with quantisation and batching.
llama.cpp
- b114452026-10-06vulkan : check for null vkEnumerateInstanceVersion (#29872)versión preliminar
- b114432026-10-06models : consolidate nextn row cropping into shared helpers (#30017)versión preliminar
- b114402026-10-06llama : re-reserve the sched when the nextn extraction flags change (#30020)versión preliminar
- b114392026-10-06ggml: refactor selective expert copying to user code (#29943)versión preliminar
- b114382026-10-06test-llama-archs : initialize backends before generating models (#30034)versión preliminar
llama.cpp
sin firmar La última versión, v0.6.0, no lleva ninguna firma que GitHub haya podido verificar.
Cargando el informe de seguridad
LMDeploy
✓ firmada La última versión, v0.18.0, lleva una firma que GitHub ha verificado.
Cargando el informe de seguridad