AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

Kollaborative AI-Entwicklungsplattform zum Erstellen, Testen und Überwachen von AI-Features.

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

Baue, bewerte und verbessere AI-Agenten für Geschäftsautomatisierung

4.8 (4)
Free
Log10 logo
#3

Log10

Skalieren Sie die Expertenbewertung von LLMs mit automatisierter Echtzeit-Fehlererkennung.

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

Eine Open-Source-Plattform für LLM-Engineering, die Observability, Metriken, Evaluierungen und Prompt‑Management bietet, um große Sprachmodell-Apps zu debuggen und zu verbessern.

4.2 (6)
Freemium
Latitude logo
#5

Latitude

Erstellen Sie produktionsreife KI-Agenten aus einer einzigen Prompt mit integrierten Evaluierungen und Beobachtbarkeit.

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

Echtzeit-Überwachungs- und Bewertungsplattform zum Erkennen von KI-Ausfällen in Search, RAG und Agenten.

4.4 (5)
Free
V
#7

Vijil

Plattform zur Erstellung, Bewertung und Durchführung zuverlässiger AI-Agenten mit Randsicherungen für Zuverlässigkeit und Sicherheit

4.8 (5)
Free
LangSmith logo
#8

LangSmith

Plattform für Beobachtbarkeit, Bewertung und Fehlerbehebung für Anwendungen mit LLM aus der LangChain-Team

4.8 (5)
Freemium
K
#9

Keywords AI

Observability‑ und Debugging‑Plattform für die schnellere Bereitstellung zuverlässiger, LLM‑gestützter Anwendungen.

4.8 (4)
Paid
Coval logo
#10

Coval

Plattform für die Simulation und Bewertung von AI-Stimmen- und Chatagenten auf massenspezifische Weise

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

End-to-End Voice AI-Plattform zum Erstellen, Beobachten und Bewerten zuverlässiger konversationeller Sprachagenten.

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

Einheitliche Entwicklerplattform zum Erstellen, Überwachen und Skalieren von LLM-Anwendungen.

5.0 (6)
Free
P
#13

Phoenix

Open-Source-Observability- und Evaluierungsplattform für das Tracing und die Verbesserung von KI-Anwendungen.

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

Mit-AI-leitete Plattform für multinationale, konversationsbasierte Forschungs- und Evaluierungsinterviews in Skalenebene.

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

Eine Suite von Tools von Databricks zum Erstellen, Bereitstellen und Bewerten hochwertiger AI-Agenten und RAG-Anwendungen.

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

Enterprise LLM Evaluation und Prompt‑Management‑Plattform für die Bereitstellung zuverlässiger KI‑Funktionen.

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

LLM-Optimierungsstudio für die Überwachung, Bewertung und Verbesserung von KI-Anwendungen in der Produktion.

4.6 (5)
Freemium