#Evaluation
17 tools tagged “Evaluation”
Athina AI
Plateforme collaborative de développement IA pour la création, les tests et la surveillance de fonctionnalités IA.
FoundryAI
Créez, évaluez et améliorez des agents d'intelligence artificielle pour l'autonomisation des entreprises
Log10
Évaluation experte des LLM à grande échelle grâce à une détection d'erreurs automatisée en temps réel.
Langfuse
Une plateforme d'ingénierie LLM open-source offrant de l'observabilité, des métriques, des évaluations et une gestion de prompt pour déboguer et améliorer les applications de grand modèle de langage...
Latitude
Créez des agents IA de production à partir d'une seule invite avec des évaluations et une observabilité intégrées.
Quotient AI
Plateforme de surveillance et d'évaluation temps réel pour détecter les échecs d'IA dans la recherche, les RAG et les agents.
Vijil
Plateforme pour la création, l'évaluation et l'opérationnalisation de confidents agents AI avec contraintes de sécurité et fiabilité
LangSmith
Plate-forme d'observabilité, d'évaluation et de débogage pour les applications LLM de l'équipe LangChain
Keywords AI
Plateforme d'Observabilité et de débogage pour livrer des applications alimentées par LLM de manière fiable plus rapidement.
Coval
Plateforme de simulation et d'évaluation pour tester les agents de voix et de chat AI à grande échelle
Phonic Voice AI
Plateforme de l'intelligence artificielle vocale complète pour la création, la surveillance et l'évaluation de agents vocaux conversants fiables.
KeywordsAI
Plateforme de développement unifiée pour la création, la supervision et la mise à l'échelle d'applications LLM.
Phoenix
Plateforme d'observabilité et d'évaluation open-source pour le suivi et l'amélioration des applications d'intelligence artificielle.
QualiaInterviews
Plateforme guidée par l'IA pour des entrevues de recherche et d'évaluation conversationnelles multilingues à grande échelle.
Mosaic AI Agent Framework
Un ensemble d'outils de Databricks pour construire, déployer et évaluer des agents IA et des applications RAG de haute qualité.
Humanloop
Plateforme d'évaluation et de gestion de prompts de LLM pour la livraison de fonctionnalités d'IA fiables au sein de l'entreprise.
LangWatch
Studio d'optimisation LLM pour la surveillance, l'évaluation et l'amélioration des applications d'IA en production.















