#Evaluation
17 tools tagged “Evaluation”
Athina AI
Piattaforma di sviluppo collaborativo per l'intelligenza artificiale per la creazione, il test e la monitoraggio delle funzionalità AI.
FoundryAI
Costruisci, valuta e migliorati gli agenti di IA per l'automazione aziendale
Log10
Scalare l'evaluation degli LMM con la detezione degli errori automatica in tempo reale.
Langfuse
Piattaforma open-source per l'ingegneria di modelli linguistici con osservabilità, metriche, valutazioni ed amministrazione di query per sviluppare e migliorare grandi applicazioni di modelli linguistici.
Latitude
Crea in modo semplice agenti AI produttivi partendo da un singolo input con valutazioni interne e visibilità.
Quotient AI
Piattaforma di monitoraggio e valutazione in tempo reale per la scoperta dei fallimenti AI negli esempi di ricerca, in RAG e negli agenti.
Vijil
Piattaforma per costruire, valutare ed operare agenti AI affidabili con barriere di sicurezza e affidabilità.
LangSmith
Piattaforma di osservabilità, valutazione e debugging per applicazioni basate su LLM dalla squadra di LangChain
Keywords AI
Piattaforma di osservabilità e debugging per lo shipping di applicazioni con modello di linguaggio LLM affidabili più velocemente.
Coval
Piattaforma di simulazione e valutazione per testare gli agenti AI di conversazione su scala
Phonic Voice AI
Piattaforma end-to-end di AI vocale per costruire, osservare e valutare agenti vocali conversazionali affidabili.
KeywordsAI
Piattaforma unificata per sviluppatori per creare, monitorare e scalare applicazioni LLM
Phoenix
Piattaforma di osservabilità e valutazione open-source per il tracciamento e l'ottenimento delle prestazioni delle applicazioni AI.
QualiaInterviews
Piattaforma guidata dall'intelligenza artificiale per la ricerca e l'valutazione qualitativa di interviste conversazionali a larga scala e linguistico molteplice.
Mosaic AI Agent Framework
Raccolta di strumenti di Databricks per la costruzione, la distribuzione e l'evaluazione di agenti AI di alta qualità e applicazioni RAG.
Humanloop
Piattaforma di valutazione e gestione dei prompt per il modello linguistico per l'invio di feature AI affidabili.
LangWatch
Studio di ottimizzazione per LLM per monitorare, valutare e migliorare le applicazioni AI in produzione.















