#Evaluation
17 tools tagged “Evaluation”
Athina AI
Samarbetande AI-utvecklingsplattform för att bygga, testa och övervaka AI-funktioner.
FoundryAI
Bygg, utvärdera och förbättra AI-agenter för företagsautomation
Log10
Skala expertutvärdering av LLM med automatisk felidentifiering i realtid
Langfuse
En öppen källkodsplattform för LLM-utveckling som erbjuder överskådlighet, mått, utvärderingar och prompt-hantering för att felsöka och förbättra stora språkmodellers tillämpningar...
Latitude
Skapa produktionsklara AI-agenter från en enda prompt med inbyggda utvärderingar och övervakning.
Quotient AI
Plattform för real-tidsövervakning och utvärdering för att fånga AI-fel i sökningar, RAG och agenter.
Vijil
Plattform för att bygga, värdera och överblicka pålitliga AI-agenter med tillförlitlighet och säkerhetsbryggor.
LangSmith
Plattform för övervakning, utvärdering och felsökning av LLM-applikationer från LangChain-teamet
Keywords AI
Plattform för observabilitet och felsökning för att leverera tillförlitliga LLM-anslutna applikationer snabbare.
Coval
Simulerings- och utvärderingsplattform för testning av AI-röst- och chatt-agenter i stor skala
Phonic Voice AI
Egendomlig plattform för röststyreduktion för att skapa, övervaka och utvärdera tillförlitliga konversationella röstagentarer.
KeywordsAI
Enhetlig utvecklarplattform för att bygga, övervaka och skala LLM-applikationer.
Phoenix
Öppen källkodsbaserad plattform för avancerad insikter och utvärdering av AI tillämpningar för spårning och förbättring.
QualiaInterviews
Plattform för artificiell inledning av forsknings- och utvärderingsintervjuer i flera språk och konversation på skal
Mosaic AI Agent Framework
En svit av verktyg från Databricks för att bygga, distribuera och utvärdera högkvalitativa AI-agenter och RAG-applikationer.
Humanloop
Plattform för företagsstyrning och bedömning av LLM för leverans av tillförlitliga AI-funktioner.
LangWatch
LLM-optimeringsstudio för övervakning, utvärdering och förbättring av AI-applikationer i produktion















