Agenta

开源 LLMOps 平台:集提示词实验场、提示词管理、LLM 评估和 LLM 可观测性于一体。

仍在活跃开发:最近 90 天有 8,945 次提交,最近一次提交在 2026-09-30。

GitHub 星数
4,799
近 30 天涨星
+130
近 90 天提交
8,945
近 6 个月发版
10

Agenta 是一个开源的 LLMOps 平台,为大语言模型应用开发提供端到端的解决方案。该平台将提示词实验场、提示词管理、LLM 评估和可观测性功能整合在一个统一的界面中,帮助开发者更快速地构建可靠的 LLM 应用。作为开源项目,Agenta 采用 MIT 许可证,为开发者提供了灵活的使用和定制权利。平台既提供自托管版本,也有云服务选项,满足不同规模团队的需求。通过集成的工作流,开发者可以在同一平台上进行提示词实验、管理版本、评估模型性能,并监控生产环境中的应用表现。这种一体化的方法显著简化了 LLM 应用的开发和运维流程,减少了在多个工具间切换的复杂性。

和同类工具的区别

统一的开源 LLMOps 平台,将提示词实验场、版本控制、20+ 个评估器和 OTel 原生可观测性整合在一个工具中,而非为每项功能使用独立工具

主要能力

  • 支持并排对比的交互式 LLM 实验场
  • 支持版本控制和分支的提示词管理
  • 提供 20+ 个预置评估器的 LLM 评估
  • 以 LLM 为裁判的评估
  • OpenTelemetry 原生可观测性
  • 人工反馈集成
  • 多模型支持(50+ 个模型)
  • 成本和延迟跟踪

适合

  • 需要集成提示词管理 + 评估 + 可观测性的团队
  • 与领域专家协作开展提示词工程的产品团队
  • 希望采用开源 LLMOps 替代方案的组织

不太适合

  • 单人开发的业余项目
  • 仅需要模型服务而不需要评估的团队

局限

  • 自托管需要配置 Docker Compose
  • 评估套件侧重于文本生成(多模态支持有限)
  • 重度依赖 UI,可能不适合完全以 API 为先的团队
  • 与成熟的 MLOps 平台相比,较为新兴

Agenta 的替代品

  • Pezzo(3,277星)
  • Langfuse:用于可观测性、评估、提示词和数据集管理的开源 LLM 工程平台(3.5 万星)
  • phoenix:AI 可观测性与评估(1.2 万星)
  • OpenLIT(2,809星)
  • langwatch:用于 LLM 评估和 AI Agent 测试的平台(4,894星)
  • TensorZero(1.2 万星)

查看完整替代品对比(英文)→

常见问题

Agenta 是做什么的?
Agenta 是一个开源的 LLMOps 平台,为大语言模型应用开发提供端到端的解决方案。该平台将提示词实验场、提示词管理、LLM 评估和可观测性功能整合在一个统一的界面中,帮助开发者更快速地构建可靠的 LLM 应用。作为开源项目,Agenta 采用 MIT 许可证,为开发者提供了灵活的使用和定制权利。平台既提供自托管版本,也有云服务选项,满足不同规模团队的需求。通过集成的工作流,开发者可以在同一平台上进行提示词实验、管理版本、评估模型性能,并监控生产环境中的应用表现。这种一体化的方法显著简化了 LLM 应用的开发和运维流程,减少了在多个工具间切换的复杂性。
Agenta 还在维护吗?
仍在活跃开发:最近 90 天有 8,945 次提交,最近一次提交在 2026-09-30。
Agenta 有哪些替代品?
和 Agenta 最接近的开源替代品有 Pezzo、Langfuse、phoenix、OpenLIT、langwatch、TensorZero。

星数、提交和发版数据来自 GitHub API,每天自动刷新。介绍文字由 AI 从英文翻译,并经过第二个模型的回译校对。 项目地址:github.com/Agenta-AI/agenta

你也在做 AI Agent 工具?

可以免费提交收录,也可以付费加急审核。

提交你的工具 →