#Evaluation
17 tools tagged “Evaluation”
Athina AI
Samenwerkend AI-ontwikkelingsplatform voor het bouwen, testen en monitoren van AI-functies.
FoundryAI
Ontwikkel, evalueer en verbeter AI‑agenten voor bedrijfsautomatisering
Log10
Schaal deskundige LLM-evaluatie met automatische realtime foutdetectie.
Langfuse
Een open-source LLM-engineeringsplatform dat observability, metrics, evaluaties en promptbeheer biedt om grote taalmodeltoepassingen te debuggen en te verbeteren
Latitude
Bouw productie-ready AI-agents vanuit één prompt met ingebouwde evaluaties en observabiliteit.
Quotient AI
Realtime bewakings- en evaluatieplatform voor het detecteren van AI-fouten in zoekopdrachten, RAG en agenten.
Vijil
Platform om betrouwbare AI-agenten te bouwen, evalueren en exploiteren met betrouwbaarheids- en veiligheidscontroles.
LangSmith
Observability-, evaluatie- en debugplatform voor LLM-toepassingen van het LangChain-team
Keywords AI
Observatie- en debugplatform voor het snel leveren van betrouwbare LLM-aangedreven toepassingen.
Coval
Simulatie‑ en evaluatieplatform voor het testen van AI voice‑ en chatagents op schaal
Phonic Voice AI
End-to-end spraak-AI-platform om betrouwbare, conversatiegerichte spraakagenten te bouwen, monitoren en evalueren.
KeywordsAI
Geïntegreerd platform voor ontwikkelaars om LLM-toepassingen te bouwen, monitoren en schalen.
Phoenix
Open-source observability- en evaluatieplatform voor het traceren en verbeteren van AI-toepassingen.
QualiaInterviews
Platform beïnvloed door AI voor multinationaal conversatieonderzoek en evaluatie-interviews op grote schaal.
Mosaic AI Agent Framework
Een reeks tools van Databricks voor het bouwen, implementeren en evalueren van hoogwaardige AI-agenten en RAG-toepassingen.
Humanloop
Enterprise LLM-evaluatie- en promptbeheerplatform voor het leveren van betrouwbare AI-functies.
LangWatch
LLM-optimalisatiestudio voor monitoring, evaluatie en verbetering van AI-toepassingen in productie.















