AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

Platforma współpracy w rozwoju AI do budowania, testowania i monitorowania funkcji AI.

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

Twórz, oceniaj i udoskonalaj agenty AI w automatyzacji procesów biznesowych

4.8 (4)
Free
Log10 logo
#3

Log10

Skaluj ekspercką ocenę LLM z automatycznym wykrywaniem błędów w czasie rzeczywistym.

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

Otwarte źródło platformy inżynierskiej LLM oferującej obserwowalność, metryki, oceny i zarządzanie zachętami do debugowania i ulepszania dużych aplikacji językowych

4.2 (6)
Freemium
Latitude logo
#5

Latitude

Tworz produkcyjne agenty AI z jednego podpowiedzi z wbudowanymi evalacjami i obserwowalnością.

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

Platforma monitorowania i oceny w czasie rzeczywistym, która wychwytuje błędy AI w wyszukiwaniu, RAG oraz agentach.

4.4 (5)
Free
V
#7

Vijil

Platforma do budowania, oceny i prowadzenia wiarygodnych agentów AI z zabezpieczeniami niezawodności i bezpieczeństwa.

4.8 (5)
Free
LangSmith logo
#8

LangSmith

Platforma obserwowalności, ewaluacji i debugowania aplikacji LLM od zespołu LangChain

4.8 (5)
Freemium
K
#9

Keywords AI

Platforma obserwowalności i debugowania do szybszego dostarczania niezawodnych aplikacji zasilanych LLM

4.8 (4)
Paid
Coval logo
#10

Coval

Platforma symulacji i oceny do testowania agentów głosowych i czatowych w skali

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

Platforma AI głosowa typu end-to-end do budowania, monitorowania i oceny niezawodnych głosowych agentów konwersacyjnych.

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

Zunifikowana platforma deweloperska do budowania, monitorowania i skalowania aplikacji LLM.

5.0 (6)
Free
P
#13

Phoenix

Platforma obserwowalności i oceny o otwartym kodzie źródłowym do śledzenia i ulepszania aplikacji AI.

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

Platforma oparta na AI do wielojęzycznych, konwersacyjnych badań i oceny wywiadów w skali masowej.

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

Zestaw narzędzi od Databricks do tworzenia, wdrażania i oceny wysokiej jakości agentów AI oraz aplikacji RAG.

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

Przedsiębiorcza platforma do oceny LLM i zarządzania promptami, umożliwiająca dostarczanie niezawodnych funkcji AI.

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

Studio optymalizacji LLM do monitorowania, oceny i poprawy aplikacji AI w produkcji.

4.6 (5)
Freemium