AgentPantheon

#Evaluation

17 tools tagged “Evaluation


A
#1

Athina AI

Geliştirilmek için, test edilmek için ve izlenmek için AI özelliklerini inşa etmek için birlikte çalışma AI geliştirme platformu.

4.5 (4)
28Freemium
FoundryAI logo
#2

FoundryAI

İşlem otomasyonu için AI ajansı inşa, değerlendir ve iyileştir

4.8 (4)
Free
Log10 logo
#3

Log10

Uzman LLM değerlendirmelerini otomasyonla gerçek zamanlı hata algılamasıyla ölçeklendirin.

4.6 (5)
Freemium
Langfuse logo
#4

Langfuse

Açık kaynaklı LLM mühendisliği platformu olarak, gözlemlenilebilirlik, metrikler,评価 ve komut yönetimi sunmaktadır. Model doğrulama ve büyük dil modeli uygulamalarının güncellenme ve hata ayıklama için performans izlenmesi, model kalitesini ve doğruluğunu değerlendirmek için test ve değerlendirmeler, model çıktı için optimizasyon ve kenar değerleri için komut yönetimi sunuyor.

4.2 (6)
Freemium
Latitude logo
#5

Latitude

Üretim için AI agentlerinden bir tek ipucu ile varsayılan değerlendirmeler ve gözlemleme ile oluşturun.

4.8 (5)
Free
Quotient AI logo
#6

Quotient AI

Hızlı zaman diliminde izleme ve değerlendirme platformu, arama, RAG ve agentler için AI hatalarını yakalamak için

4.4 (5)
Free
V
#7

Vijil

Güvenilir ve güvenli kilitli AI ajansının yapılandırılması, değerlendirilmesi ve işletilmesi platformu.

4.8 (5)
Free
LangSmith logo
#8

LangSmith

LLM uygulamaları için observasyon, değerlendirmeye ve hata ayıklama platformu LangChain ekibi tarafından

4.8 (5)
Freemium
K
#9

Keywords AI

Güvenilir LLM tabanlı uygulamaları daha hızlı dağıtmak içinobservasyon ve hata ayıklamadan oluşan bir platförm.

4.8 (4)
Paid
Coval logo
#10

Coval

Büyük ölçekli AI ses ve sohbet agALARININ test edilmeyeceği simulation ve değerlendirme platformu

4.5 (6)
Freemium
Phonic Voice AI logo
#11

Phonic Voice AI

End-to-end ses AI platformu, güvenilir sohbetçi ses agentleri oluşturmak, gözden geçirmek ve değerlendirmek için.

4.7 (6)
Freemium
KeywordsAI logo
#12

KeywordsAI

Geliştirici platformu için bir araya gelen LLM uygulamalarını inşa etmek, izlemek ve ölçeklendirmek.

5.0 (6)
Free
P
#13

Phoenix

Açık kaynaklı izleme ve değerlendirme platformu, LLM uygulamalarını izleme ve geliştirmek için.

4.5 (4)
Free
QualiaInterviews logo
#14

QualiaInterviews

Çeviri diliyle, ölçeklenebilir araştırmalar ve değerlendirmeler için konuşma interviewleri yürüten AI-led platform.

4.3 (4)
Freemium
Mosaic AI Agent Framework logo
#15

Mosaic AI Agent Framework

Databricks'ın yüksek kaliteli AI ajansları ve RAG uygulamaları yapmak için oluşturma, dağıtma ve değerlendirmek için bir set araçlar.

4.0 (4)
Contact
Humanloop logo
#16

Humanloop

Sanal zekânın güvenilir özelliklerini teslim etmek için kurumsal LLM değerlendirmesi ve emir yönetimi platformu.

4.5 (4)
Freemium
LangWatch logo
#17

LangWatch

LLM'nin optimize edilebilirliğinin, üretim ortamlarındaki AI uygulamalarının takibini, değerlendirmesini ve iyileştirilmesini sağlayan bir stüdyo.

4.6 (5)
Freemium