comparar
DeepEval vs promptfoo
Los mismos datos para ambos, leídos de GitHub cada noche, y la relación que revisó una persona.
| Dato | DeepEval | promptfoo |
|---|---|---|
| Lenguaje | Python | TypeScript |
| Licencia | Apache-2.0 | MIT |
| Estrellas | 19k | 26k |
| Última versión | python-v4.2.4 | code-scan-action-0.2.1 |
| Último push | 2026-10-05 | 2026-10-06 |
| Ritmo de versiones | alrededor de 4 días entre versiones | alrededor de 10 días entre versiones |
| Colaboradores activos | 25+ autores de commits en la rama por defecto en los últimos 90 días | 51+ autores de commits en la rama por defecto en los últimos 90 días |
| Avisos | ninguno | ninguno |
Cómo se relacionan
Ambos sustituyen a Braintrust. Alternativas a Braintrust →
ParcialDeepEvalPytest-style evaluations with LLM-as-judge metrics, in Python.
ParcialpromptfooEvals and red-teaming from a YAML config, run from the CLI or in CI, with a local web viewer.
DeepEval
- python-v4.2.42026-09-22Introducing Jev in DeepEval
- typescript-v0.9.132026-08-24TypeScript 0.9.13versión preliminar
- python-v4.2.02026-08-24Python 4.2.0
- typescript-v0.9.112026-08-21TypeScript 0.9.11
- python-v4.1.92026-08-21DeepEval - 4.1.9
promptfoo
- code-scan-action-0.2.12026-10-06code-scan-action: 0.2.1
- 0.124.02026-10-06providers: remove hosted ChatKit provider (#11434)
- 0.123.12026-09-18bedrock: refresh auth across HTTP adapters (#10123) (9d3f063)
- 0.123.02026-09-10providers: default GPT-5.6+ to Responses (#10803)
- code-scan-action-0.2.02026-08-28code-scan-action: 0.2.0
DeepEval
sin firmar La última versión, python-v4.2.4, no lleva ninguna firma que GitHub haya podido verificar.
Cargando el informe de seguridad
promptfoo
✓ firmada La última versión, code-scan-action-0.2.1, lleva una firma que GitHub ha verificado.
Cargando el informe de seguridad