#Evaluation
17 tools tagged “Evaluation”
Athina AI
منصة تطوير الذكاء الاصطناعي التعاونية لبناء واختبار ومراقبة ميزات الذكاء الاصطناعي.
FoundryAI
قم تطوير وتقييم وتحسين عملاء الذكاء الاصطناعي للأعمال التلقائية
Log10
تمكنت إدارة نماذج اللغة الكبيرة الخاصة بك مع الكشف الذكي عن الأخطاء في الزمن الحقيقي.
Langfuse
مصادر الأعطال المتكاملة للُمحرّكات اللغوية الكبيرة الحجم
Latitude
إنشئ وكلاء الذكاء الاصطناعي المدعومين بـ LLM بسرعة من محفز واحد وأجر التجربة والتطور بفاعلية في مساحة عمل مشتركة، مما يختصر الطريق من الفكرة إلى نشر الوكيل.
Quotient AI
منصة مراقبة وتقييم الذكاء الاصطناعي في الوقت الحقيقي لتجنب فشل الذكاء الاصطناعي في البحث و RAG والوكلاء
Vijil
منصة لبناء، تقييم وتقييم موثوقية وأمان عملاء الذكاء الاصطناعي الموثوق بهم مع ضمان ضوابط السلامة والأمان.
LangSmith
منصة لمراقبة و تقييم و تصحيح تطبيقات نماذج اللغة الكبيرة من فريق لانج تشين
Keywords AI
منصة مراقبة وتصحيح الأخطاء لتسريع إطلاق تطبيقات موثوقة تعتمد على LLM
Coval
منصة لاختبار وتقييم الوكلاء الذكاء الاصطناعي المتكلمين والكتابية لضمان الجودة والموثوقية قبل النشر.
Phonic Voice AI
منصة الذكاء الاصطناعي للصوت AI من النهاية إلى النهاية لبناء ومراقبة وتقييم عملاء الصوت الموثوقة
KeywordsAI
منصة موحدة لمطوري AI لبناء، مراقبة، وتوسيع نطاق تطبيقات LLM
Phoenix
الفينيق: منصة مفتوحة المصدر لمراقبة وتقييم تطبيقات الذكاء الاصطناعي والتعلم القليل من الأمثلة
QualiaInterviews
منصة ذكاء صناعي لمقابلات البحث والتقييم باللغة الطبيعية متعددة اللغات والمقاييس
Mosaic AI Agent Framework
مجموعة من الأدوات من قبل Databricks لبناء، ونشر، وتقييم عوامل الذكاء الاصطناعي عالية الجودة وتطبيقات RAG.
Humanloop
Humanloop: منصة مركزية لإدارة نسخ ومحاكاة الإصدارات وملاحظات المستخدمين لتطبيقات الذكاء الاصطناعي الموثوقة.
LangWatch
استوديو تحسين نماذج اللغات الكبيرة (LLMs) لمراقبة وتقييم وتحسين تطبيقات الذكاء الاصطناعي المدارة في الإنتاج.















