AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

コラボレーション用のAI開発プラットフォームとして、AI機能の構築、テスト、監視をサポートします。

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

ビジネスオートメーション用のAIエージェントを作成・評価・改善

4.8 (4)
Free
Log10 logo
#3

Log10

LGMのプロフェッショナル評価を自動化し、リアルタイムのエラー検出でスケールする

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

オープンソースのLLMエンジニアリングプラットフォームは、観測性、メトリクス、評価、プッシュマネジメントを提供して、巨大言語モデルアプリケーションをデバッグして強化する

4.2 (6)
Freemium
Latitude logo
#5

Latitude

1 つのプロンプトから生産性の高い AI エージェントを構築するために、内部の評価と観察性を組み込む。

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

リアルタイムモニタリングおよび評価プラットフォームで、検索、RAG、エージェントのAI失敗をキャッチします。

4.4 (5)
Free
V
#7

Vijil

信頼できるAIエージェントを作成、評価、運用するプラットフォームで、安全性と信頼性のガードレールを備えています。

4.8 (5)
Free
LangSmith logo
#8

LangSmith

LLMアプリケーションの動作観察性、評価、デバッグプラットフォームです。

4.8 (5)
Freemium
K
#9

Keywords AI

信頼性の高いLLMパワーを搭載したアプリケーションの早期リリースを目指すための可観測性とデバッグプラットフォーム

4.8 (4)
Paid
Coval logo
#10

Coval

大規模でAIチャットボットとボイスエージェントのテストと評価プラットフォーム

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

端末から端末までのボイス アージェントを構築、観察、評価し堅実な会話ボイス エージェントを実現するプラットフォーム。

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

統一された開発者プラットフォームでLLMアプリケーションの構築、モニタリング、スケーリングを可能にする。

5.0 (6)
Free
P
#13

Phoenix

オープンソースのオブザーバビリティと評価プラットフォーム、AIアプリケーションのトレースや改善に。

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

AIを利用した多言語対応・会話型の調査・評価インタビューを行うことができるスケールのプラットフォームです。

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

Databricksによる、ハイ品質なAIエージェントやRAGアプリケーションの構築、展開、評価のためのツールのスイート

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

ビジネス向け LLM 評価とプッシュの管理プラットフォーム

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

LLM最適化スタジオ

4.6 (5)
Freemium