AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

Piattaforma di sviluppo collaborativo per l'intelligenza artificiale per la creazione, il test e la monitoraggio delle funzionalità AI.

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

Costruisci, valuta e migliorati gli agenti di IA per l'automazione aziendale

4.8 (4)
Free
Log10 logo
#3

Log10

Scalare l'evaluation degli LMM con la detezione degli errori automatica in tempo reale.

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

Piattaforma open-source per l'ingegneria di modelli linguistici con osservabilità, metriche, valutazioni ed amministrazione di query per sviluppare e migliorare grandi applicazioni di modelli linguistici.

4.2 (6)
Freemium
Latitude logo
#5

Latitude

Crea in modo semplice agenti AI produttivi partendo da un singolo input con valutazioni interne e visibilità.

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

Piattaforma di monitoraggio e valutazione in tempo reale per la scoperta dei fallimenti AI negli esempi di ricerca, in RAG e negli agenti.

4.4 (5)
Free
V
#7

Vijil

Piattaforma per costruire, valutare ed operare agenti AI affidabili con barriere di sicurezza e affidabilità.

4.8 (5)
Free
LangSmith logo
#8

LangSmith

Piattaforma di osservabilità, valutazione e debugging per applicazioni basate su LLM dalla squadra di LangChain

4.8 (5)
Freemium
K
#9

Keywords AI

Piattaforma di osservabilità e debugging per lo shipping di applicazioni con modello di linguaggio LLM affidabili più velocemente.

4.8 (4)
Paid
Coval logo
#10

Coval

Piattaforma di simulazione e valutazione per testare gli agenti AI di conversazione su scala

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

Piattaforma end-to-end di AI vocale per costruire, osservare e valutare agenti vocali conversazionali affidabili.

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

Piattaforma unificata per sviluppatori per creare, monitorare e scalare applicazioni LLM

5.0 (6)
Free
P
#13

Phoenix

Piattaforma di osservabilità e valutazione open-source per il tracciamento e l'ottenimento delle prestazioni delle applicazioni AI.

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

Piattaforma guidata dall'intelligenza artificiale per la ricerca e l'valutazione qualitativa di interviste conversazionali a larga scala e linguistico molteplice.

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

Raccolta di strumenti di Databricks per la costruzione, la distribuzione e l'evaluazione di agenti AI di alta qualità e applicazioni RAG.

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

Piattaforma di valutazione e gestione dei prompt per il modello linguistico per l'invio di feature AI affidabili.

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

Studio di ottimizzazione per LLM per monitorare, valutare e migliorare le applicazioni AI in produzione.

4.6 (5)
Freemium