comparar

llama.cpp vs LMDeploy

Os mesmos fatos para os dois, lidos do GitHub toda noite, e a relação que uma pessoa revisou.

llama.cpp vs LMDeploy
Fatollama.cppLMDeploy
LinguagemC++Python
LicençaMITApache-2.0
Estrelas130k8.1k
Última releasev0.6.0v0.18.0
Último push2026-10-062026-09-28
Ritmo de releasespoucas releasescerca de 23 dias entre releases
Contribuidores ativos173+ autores de commits na branch padrão nos últimos 90 dias28 autores de commits na branch padrão nos últimos 90 dias
Alertasnenhumnenhum
  • Os dois substituem ChatGPT. Alternativas a ChatGPT →

    Parcialllama.cppRuns open-weight models on CPU or GPU, with a built-in server and a minimal web chat.

    ParcialLMDeployServes open-weight models behind an OpenAI-compatible API, with quantisation and batching.