AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

Plataforma de desenvolvimento de IA colaborativa para construir, testar e monitorar recursos de IA.

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

Crie, avalie e melhore agentes de IA para automação de negócios

4.8 (4)
Free
Log10 logo
#3

Log10

Escale a avaliação especializada de LLM com detecção automatizada de erros em tempo real.

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

Uma plataforma de engenharia de LLM de código aberto que oferece observabilidade, métricas, avaliações e gerenciamento de prompts para depurar e aprimorar aplicações de modelo de linguagem grande...

4.2 (6)
Freemium
Latitude logo
#5

Latitude

Crie agentes de IA de produção a partir de um único prompt com avaliações integradas e observabilidade.

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

Plataforma de monitoramento e avaliação em tempo real para capturar falhas de IA em busca, RAG e agentes.

4.4 (5)
Free
V
#7

Vijil

Plataforma para construir, avaliar e operar agentes de IA confiáveis com salvaguardas de confiabilidade e segurança.

4.8 (5)
Free
LangSmith logo
#8

LangSmith

Plataforma de observabilidade, avaliação e depuração para aplicações LLM da equipe LangChain

4.8 (5)
Freemium
K
#9

Keywords AI

Plataforma de observabilidade e depuração para entregar aplicações confiáveis alimentadas por LLM mais rapidamente.

4.8 (4)
Paid
Coval logo
#10

Coval

Plataforma de simulação e avaliação para testar agentes de voz e chat de IA em escala

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

Plataforma de IA de voz ponta a ponta para construir, observar e avaliar agentes de voz conversacionais confiáveis.

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

Plataforma unificada de desenvolvedor para construir, monitorar e escalar aplicações LLM.

5.0 (6)
Free
P
#13

Phoenix

Plataforma de observabilidade e avaliação de código aberto para rastrear e melhorar aplicações de IA.

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

Plataforma liderada por IA para entrevistas de pesquisa e avaliação conversacionais multilíngues em escala.

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

Um conjunto de ferramentas da Databricks para construir, implantar e avaliar agentes de IA de alta qualidade e aplicações RAG.

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

Plataforma de avaliação de LLM e gerenciamento de prompts para empresas, para criar recursos de IA confiáveis.

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

Estúdio de otimização de LLM para monitorar, avaliar e melhorar aplicações de IA em produção.

4.6 (5)
Freemium