#Evaluation
17 tools tagged “Evaluation”
Athina AI
コラボレーション用のAI開発プラットフォームとして、AI機能の構築、テスト、監視をサポートします。
FoundryAI
ビジネスオートメーション用のAIエージェントを作成・評価・改善
Log10
LGMのプロフェッショナル評価を自動化し、リアルタイムのエラー検出でスケールする
Langfuse
オープンソースのLLMエンジニアリングプラットフォームは、観測性、メトリクス、評価、プッシュマネジメントを提供して、巨大言語モデルアプリケーションをデバッグして強化する
Latitude
1 つのプロンプトから生産性の高い AI エージェントを構築するために、内部の評価と観察性を組み込む。
Quotient AI
リアルタイムモニタリングおよび評価プラットフォームで、検索、RAG、エージェントのAI失敗をキャッチします。
Vijil
信頼できるAIエージェントを作成、評価、運用するプラットフォームで、安全性と信頼性のガードレールを備えています。
LangSmith
LLMアプリケーションの動作観察性、評価、デバッグプラットフォームです。
Keywords AI
信頼性の高いLLMパワーを搭載したアプリケーションの早期リリースを目指すための可観測性とデバッグプラットフォーム
Coval
大規模でAIチャットボットとボイスエージェントのテストと評価プラットフォーム
Phonic Voice AI
端末から端末までのボイス アージェントを構築、観察、評価し堅実な会話ボイス エージェントを実現するプラットフォーム。
KeywordsAI
統一された開発者プラットフォームでLLMアプリケーションの構築、モニタリング、スケーリングを可能にする。
Phoenix
オープンソースのオブザーバビリティと評価プラットフォーム、AIアプリケーションのトレースや改善に。
QualiaInterviews
AIを利用した多言語対応・会話型の調査・評価インタビューを行うことができるスケールのプラットフォームです。
Mosaic AI Agent Framework
Databricksによる、ハイ品質なAIエージェントやRAGアプリケーションの構築、展開、評価のためのツールのスイート
Humanloop
ビジネス向け LLM 評価とプッシュの管理プラットフォーム
LangWatch
LLM最適化スタジオ















