#Evaluation
17 tools tagged “Evaluation”
Athina AI
Платформа спільної розробки AI для створення, випробування та моніторингу можливостей AI.
FoundryAI
Будувати, оцінювати та покращувати агентів AI для бізнес-автоматизації
Log10
Шалений розвиток експертної оцінки LLM з автоматичною реал-тайм виявістю помилок.
Langfuse
Платформа інженерії LLM відкритого джерелла, що забезпечує спостережуваність, показники, оцінки та керування викликами для дебагування та підвищення великомасштабних моделі мови...
Latitude
Створюйте професійні AI-агентів з однієї запиту з вбудованими оцінками та спостереженнями
Quotient AI
Платформа реального часу для моніторингу та оцінювання, що виявляє невдачі AI у пошуку, RAG та агентах.
Vijil
Платформа для створення, оцінки та експлуатації надійних AI‑агентів із заходами безпеки та надійності.
LangSmith
Платформа спостережності, оцінки та відладки для застосунків LLM від команди LangChain
Keywords AI
Платформа спостереження та відладки для вивантаження надійних додатків з використанням великих мовних моделей швидше.
Coval
Платформа симуляції та оцінки для тестування штучного інтелектуових голосових та чатагентів у масштабі
Phonic Voice AI
Платформа AI для голосу від початку до кінця: створюйте, спостерігайте і оцініть надійних голосових агентів для розмов.
KeywordsAI
Єдина платформа розробників для побудови, спостереження та масштабування додатків LLM.
Phoenix
Платформа відкритого коду для спостережності та оцінки AI-додатків, яка слідкує і покращує їх
QualiaInterviews
AI-керована платформа для багатомовних, розмовних досліджень і оцінювальних інтерв'ю у великому масштабі.
Mosaic AI Agent Framework
Набір інструментів від Databricks для створення, розгортання та оцінки високоякісних агентів ШІ та додатків RAG.
Humanloop
Платформа оцінки та управління запрошеннями в середовищі великомасштабних мовних моделей для реалізації міцних технологій AI.
LangWatch
Студія оптимізації LLM для моніторингу, оцінювання та вдосконалення штучних інтелектових застосунків в умовах виробництва.















