#Evaluation
17 tools tagged “Evaluation”
Athina AI
Platforma współpracy w rozwoju AI do budowania, testowania i monitorowania funkcji AI.
FoundryAI
Twórz, oceniaj i udoskonalaj agenty AI w automatyzacji procesów biznesowych
Log10
Skaluj ekspercką ocenę LLM z automatycznym wykrywaniem błędów w czasie rzeczywistym.
Langfuse
Otwarte źródło platformy inżynierskiej LLM oferującej obserwowalność, metryki, oceny i zarządzanie zachętami do debugowania i ulepszania dużych aplikacji językowych
Latitude
Tworz produkcyjne agenty AI z jednego podpowiedzi z wbudowanymi evalacjami i obserwowalnością.
Quotient AI
Platforma monitorowania i oceny w czasie rzeczywistym, która wychwytuje błędy AI w wyszukiwaniu, RAG oraz agentach.
Vijil
Platforma do budowania, oceny i prowadzenia wiarygodnych agentów AI z zabezpieczeniami niezawodności i bezpieczeństwa.
LangSmith
Platforma obserwowalności, ewaluacji i debugowania aplikacji LLM od zespołu LangChain
Keywords AI
Platforma obserwowalności i debugowania do szybszego dostarczania niezawodnych aplikacji zasilanych LLM
Coval
Platforma symulacji i oceny do testowania agentów głosowych i czatowych w skali
Phonic Voice AI
Platforma AI głosowa typu end-to-end do budowania, monitorowania i oceny niezawodnych głosowych agentów konwersacyjnych.
KeywordsAI
Zunifikowana platforma deweloperska do budowania, monitorowania i skalowania aplikacji LLM.
Phoenix
Platforma obserwowalności i oceny o otwartym kodzie źródłowym do śledzenia i ulepszania aplikacji AI.
QualiaInterviews
Platforma oparta na AI do wielojęzycznych, konwersacyjnych badań i oceny wywiadów w skali masowej.
Mosaic AI Agent Framework
Zestaw narzędzi od Databricks do tworzenia, wdrażania i oceny wysokiej jakości agentów AI oraz aplikacji RAG.
Humanloop
Przedsiębiorcza platforma do oceny LLM i zarządzania promptami, umożliwiająca dostarczanie niezawodnych funkcji AI.
LangWatch
Studio optymalizacji LLM do monitorowania, oceny i poprawy aplikacji AI w produkcji.















