AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

Samarbetande AI-utvecklingsplattform för att bygga, testa och övervaka AI-funktioner.

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

Bygg, utvärdera och förbättra AI-agenter för företagsautomation

4.8 (4)
Free
Log10 logo
#3

Log10

Skala expertutvärdering av LLM med automatisk felidentifiering i realtid

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

En öppen källkodsplattform för LLM-utveckling som erbjuder överskådlighet, mått, utvärderingar och prompt-hantering för att felsöka och förbättra stora språkmodellers tillämpningar...

4.2 (6)
Freemium
Latitude logo
#5

Latitude

Skapa produktionsklara AI-agenter från en enda prompt med inbyggda utvärderingar och övervakning.

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

Plattform för real-tidsövervakning och utvärdering för att fånga AI-fel i sökningar, RAG och agenter.

4.4 (5)
Free
V
#7

Vijil

Plattform för att bygga, värdera och överblicka pålitliga AI-agenter med tillförlitlighet och säkerhetsbryggor.

4.8 (5)
Free
LangSmith logo
#8

LangSmith

Plattform för övervakning, utvärdering och felsökning av LLM-applikationer från LangChain-teamet

4.8 (5)
Freemium
K
#9

Keywords AI

Plattform för observabilitet och felsökning för att leverera tillförlitliga LLM-anslutna applikationer snabbare.

4.8 (4)
Paid
Coval logo
#10

Coval

Simulerings- och utvärderingsplattform för testning av AI-röst- och chatt-agenter i stor skala

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

Egendomlig plattform för röststyreduktion för att skapa, övervaka och utvärdera tillförlitliga konversationella röstagentarer.

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

Enhetlig utvecklarplattform för att bygga, övervaka och skala LLM-applikationer.

5.0 (6)
Free
P
#13

Phoenix

Öppen källkodsbaserad plattform för avancerad insikter och utvärdering av AI tillämpningar för spårning och förbättring.

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

Plattform för artificiell inledning av forsknings- och utvärderingsintervjuer i flera språk och konversation på skal

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

En svit av verktyg från Databricks för att bygga, distribuera och utvärdera högkvalitativa AI-agenter och RAG-applikationer.

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

Plattform för företagsstyrning och bedömning av LLM för leverans av tillförlitliga AI-funktioner.

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

LLM-optimeringsstudio för övervakning, utvärdering och förbättring av AI-applikationer i produktion

4.6 (5)
Freemium