comparar

llama.cpp vs TensorRT-LLM

Os mesmos fatos para os dois, lidos do GitHub toda noite, e a relação que uma pessoa revisou.

llama.cpp vs TensorRT-LLM
Fatollama.cppTensorRT-LLM
LinguagemC++Python
LicençaMITOther
Estrelas130k15k
Última releasev0.6.0v1.2.1
Último push2026-10-062026-10-06
Ritmo de releasespoucas releasespoucas releases
Contribuidores ativos173+ autores de commits na branch padrão nos últimos 90 dias125+ autores de commits na branch padrão nos últimos 90 dias
Alertasnenhumnenhum
  • Os dois substituem ChatGPT. Alternativas a ChatGPT →

    Parcialllama.cppRuns open-weight models on CPU or GPU, with a built-in server and a minimal web chat.

    ParcialTensorRT-LLMServes open-weight models on NVIDIA GPUs behind an OpenAI-compatible API.