返回雷达English

confident-ai/deepeval vs promptfoo/promptfoo

基于当前公开核验快照比较 confident-ai/deepeval 与 promptfoo/promptfoo 的定位、License、部署方式、适用场景、限制和原始来源。

confident-ai/deepeval

deepeval 是一个类似于 Pytest 的开源大语言模型评估框架,专门用于对 LLM 应用进行单元测试,以评估系统质量并防止 Prompt 漂移。它通过提供一系列现成的指标,帮助开发者在输入数据集后输出量化的指标分数。

License
Apache-2.0
部署
查看项目说明
适用场景
知识问答
更新时间
2026-07-15T18:18:33Z

原始项目链接

promptfoo/promptfoo

promptfoo 是一个面向开发者的声明式 LLM 测试、自动化评估与红队安全扫描工具,旨在替代手工试错流程。它以本地 CLI 运行为核心,支持在 CI/CD 流水线中自动化检测提示词、模型及 RAG 系统的回归与安全问题。

License
MIT
部署
查看项目说明
适用场景
需要将 LLM 测试和评估集成到自动化流水线中的开发团队。 · 希望在本地快速测试和迭代提示词,且关注数据隐私的 AI 工程师。
更新时间
2026-07-16T18:26:38Z

原始项目链接

如何选择

先按必须满足的部署、License 和使用场景排除不合适选项,再打开各自详情核对限制与直接证据。