AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

用于构建、测试和监控AI功能的协作式AI开发平台

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

建立、评估和改进业务自动化的 AI 代理

4.8 (4)
Free
Log10 logo
#3

Log10

利用自动实时错误检测来规模化专家级LLM评估

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

"开放性的大型语言模型工程平台,提供可观测性、度量、评估和提示管理,用于调试和增强大型语言模型应用"

4.2 (6)
Freemium
Latitude logo
#5

Latitude

从单个提示建造生产级AI代理,内置评估和可观察性。

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

实时监控与评估平台,对于搜索、RAG和代理的 AI 失败实时监测。

4.4 (5)
Free
V
#7

Vijil

构建、评估和操作可靠、安全的AI代理,拥有可靠性和安全性障壁

4.8 (5)
Free
LangSmith logo
#8

LangSmith

观察性、评估和调试平台

4.8 (5)
Freemium
K
#9

Keywords AI

基于 LLM 的可靠应用发布平台

4.8 (4)
Paid
Coval logo
#10

Coval

面向大规模测试 AI 语音和聊天代理的仿真评估平台

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

从始至终的语音 AI 平台,让您能构建、观察和评估可靠的对话语音代理。

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

集成式开发平台,为构建、监控和扩展LLM应用提供统一的解决方案

5.0 (6)
Free
P
#13

Phoenix

开源观察性和评估平台,用于追踪和改进 AI 应用程序。

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

全语言、对话式的大规模研究和评估访谈平台

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

为 Databricks 提供一整套用来构建、部署和评估高质量 AI 代理和 RAG 应用的工具。

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

企业级大型语言模型评估和(prompt)管理平台,用于部署可靠的 AI 功能。

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

LLM 优化工作室,专为生产环境中监测、评估和改进 AI 应用的工具。

4.6 (5)
Freemium