#Evaluation
17 tools tagged “Evaluation”
A
#1
Athina AI
用于构建、测试和监控AI功能的协作式AI开发平台
4.5 (4)
28Freemium
#2
FoundryAI
建立、评估和改进业务自动化的 AI 代理
4.8 (4)
Free
#3
Log10
利用自动实时错误检测来规模化专家级LLM评估
4.6 (5)
Freemium
#4
Langfuse
"开放性的大型语言模型工程平台,提供可观测性、度量、评估和提示管理,用于调试和增强大型语言模型应用"
4.2 (6)
Freemium
#5
Latitude
从单个提示建造生产级AI代理,内置评估和可观察性。
4.8 (5)
Free
#6
Quotient AI
实时监控与评估平台,对于搜索、RAG和代理的 AI 失败实时监测。
4.4 (5)
Free
V
#7
Vijil
构建、评估和操作可靠、安全的AI代理,拥有可靠性和安全性障壁
4.8 (5)
Free
#8
LangSmith
观察性、评估和调试平台
4.8 (5)
Freemium
K
#9
Keywords AI
基于 LLM 的可靠应用发布平台
4.8 (4)
Paid
#10
Coval
面向大规模测试 AI 语音和聊天代理的仿真评估平台
4.5 (6)
Freemium
#11
Phonic Voice AI
从始至终的语音 AI 平台,让您能构建、观察和评估可靠的对话语音代理。
4.7 (6)
Freemium
#12
KeywordsAI
集成式开发平台,为构建、监控和扩展LLM应用提供统一的解决方案
5.0 (6)
Free
P
#13
Phoenix
开源观察性和评估平台,用于追踪和改进 AI 应用程序。
4.5 (4)
Free
#14
QualiaInterviews
全语言、对话式的大规模研究和评估访谈平台
4.3 (4)
Freemium
#15
Mosaic AI Agent Framework
为 Databricks 提供一整套用来构建、部署和评估高质量 AI 代理和 RAG 应用的工具。
4.0 (4)
Contact
#16
Humanloop
企业级大型语言模型评估和(prompt)管理平台,用于部署可靠的 AI 功能。
4.5 (4)
Freemium
#17
LangWatch
LLM 优化工作室,专为生产环境中监测、评估和改进 AI 应用的工具。
4.6 (5)
Freemium















