Agenta
开源 LLMOps 平台:集提示词实验场、提示词管理、LLM 评估和 LLM 可观测性于一体。
仍在活跃开发:最近 90 天有 8,945 次提交,最近一次提交在 2026-09-30。
GitHub 星数
4,799
近 30 天涨星
+130
近 90 天提交
8,945
近 6 个月发版
10
Agenta 是一个开源的 LLMOps 平台,为大语言模型应用开发提供端到端的解决方案。该平台将提示词实验场、提示词管理、LLM 评估和可观测性功能整合在一个统一的界面中,帮助开发者更快速地构建可靠的 LLM 应用。作为开源项目,Agenta 采用 MIT 许可证,为开发者提供了灵活的使用和定制权利。平台既提供自托管版本,也有云服务选项,满足不同规模团队的需求。通过集成的工作流,开发者可以在同一平台上进行提示词实验、管理版本、评估模型性能,并监控生产环境中的应用表现。这种一体化的方法显著简化了 LLM 应用的开发和运维流程,减少了在多个工具间切换的复杂性。
和同类工具的区别
统一的开源 LLMOps 平台,将提示词实验场、版本控制、20+ 个评估器和 OTel 原生可观测性整合在一个工具中,而非为每项功能使用独立工具
主要能力
- 支持并排对比的交互式 LLM 实验场
- 支持版本控制和分支的提示词管理
- 提供 20+ 个预置评估器的 LLM 评估
- 以 LLM 为裁判的评估
- OpenTelemetry 原生可观测性
- 人工反馈集成
- 多模型支持(50+ 个模型)
- 成本和延迟跟踪
适合
- 需要集成提示词管理 + 评估 + 可观测性的团队
- 与领域专家协作开展提示词工程的产品团队
- 希望采用开源 LLMOps 替代方案的组织
不太适合
- 单人开发的业余项目
- 仅需要模型服务而不需要评估的团队
局限
- 自托管需要配置 Docker Compose
- 评估套件侧重于文本生成(多模态支持有限)
- 重度依赖 UI,可能不适合完全以 API 为先的团队
- 与成熟的 MLOps 平台相比,较为新兴
Agenta 的替代品
常见问题
- Agenta 是做什么的?
- Agenta 是一个开源的 LLMOps 平台,为大语言模型应用开发提供端到端的解决方案。该平台将提示词实验场、提示词管理、LLM 评估和可观测性功能整合在一个统一的界面中,帮助开发者更快速地构建可靠的 LLM 应用。作为开源项目,Agenta 采用 MIT 许可证,为开发者提供了灵活的使用和定制权利。平台既提供自托管版本,也有云服务选项,满足不同规模团队的需求。通过集成的工作流,开发者可以在同一平台上进行提示词实验、管理版本、评估模型性能,并监控生产环境中的应用表现。这种一体化的方法显著简化了 LLM 应用的开发和运维流程,减少了在多个工具间切换的复杂性。
- Agenta 还在维护吗?
- 仍在活跃开发:最近 90 天有 8,945 次提交,最近一次提交在 2026-09-30。
- Agenta 有哪些替代品?
- 和 Agenta 最接近的开源替代品有 Pezzo、Langfuse、phoenix、OpenLIT、langwatch、TensorZero。
星数、提交和发版数据来自 GitHub API,每天自动刷新。介绍文字由 AI 从英文翻译,并经过第二个模型的回译校对。 项目地址:github.com/Agenta-AI/agenta