comparar
llama.cpp vs TensorRT-LLM
Los mismos datos para ambos, leídos de GitHub cada noche, y la relación que revisó una persona.
| Dato | llama.cpp | TensorRT-LLM |
|---|---|---|
| Lenguaje | C++ | Python |
| Licencia | MIT | Other |
| Estrellas | 130k | 15k |
| Última versión | v0.6.0 | v1.2.1 |
| Último push | 2026-10-06 | 2026-10-06 |
| Ritmo de versiones | muy pocas versiones | muy pocas versiones |
| Colaboradores activos | 173+ autores de commits en la rama por defecto en los últimos 90 días | 125+ autores de commits en la rama por defecto en los últimos 90 días |
| Avisos | ninguno | ninguno |
Cómo se relacionan
Ambos sustituyen a ChatGPT. Alternativas a ChatGPT →
Parcialllama.cppRuns open-weight models on CPU or GPU, with a built-in server and a minimal web chat.
ParcialTensorRT-LLMServes open-weight models on NVIDIA GPUs behind an OpenAI-compatible API.
llama.cpp
- b114452026-10-06vulkan : check for null vkEnumerateInstanceVersion (#29872)versión preliminar
- b114432026-10-06models : consolidate nextn row cropping into shared helpers (#30017)versión preliminar
- b114402026-10-06llama : re-reserve the sched when the nextn extraction flags change (#30020)versión preliminar
- b114392026-10-06ggml: refactor selective expert copying to user code (#29943)versión preliminar
- b114382026-10-06test-llama-archs : initialize backends before generating models (#30034)versión preliminar
TensorRT-LLM
- v1.3.0rc292026-09-29Model Supportversión preliminar
- v1.3.0rc282026-09-23Known Issuesversión preliminar
- v1.3.0rc272026-09-18Known Issuesversión preliminar
- v1.3.0rc262026-09-09Known Issuesversión preliminar
- v1.3.0rc252026-08-31Annoucementsversión preliminar
llama.cpp
sin firmar La última versión, v0.6.0, no lleva ninguna firma que GitHub haya podido verificar.
Cargando el informe de seguridad
TensorRT-LLM
✓ firmada La última versión, v1.2.1, lleva una firma que GitHub ha verificado.
Cargando el informe de seguridad