#Evaluation
17 tools tagged “Evaluation”
Athina AI
Darba telpa, kurā tiek uzlabotas AI rīki, lai izstrādātos un pārbaudītos AI piesaistījumi.
FoundryAI
Izveidojiet, novērtējiet un uzlabojiet AI agentus uzņēmējdarbības automatizācijai
Log10
Palieliniet ekspertu LLM novērtējuma mērogu ar automatizētu reāla laika kļūdu noteikšanu.
Langfuse
Atvērtā koda LLM inženierijas platforma, kas nodrošina observēšanu, metrikas, vērtēšanu un promptu pārvaldību, lai atkļūtu un uzlabotu lielo valodu modeļu lietojumus
Latitude
Izveidojiet ražošanas AI agentus no vienas prompta ar iebūvētiem evals un novērojamību.
Quotient AI
Reālā laika monitoringa un novērtēšanas platforma, lai noķertu AI kļūdas meklēšanā, RAG un aģentos.
Vijil
Platforma, lai izveidotu, novērtētu un pārvaldītu uzticamus AI agentus ar uzticamības un drošības aizsardzības līnijām.
LangSmith
Observability, eval. un debugging platform LLM lietojumprogrammām no LangChain komandas
Keywords AI
Observability un atkļūdošanas platforma, lai ātrāk piegādātu uzticamas LLM balstītas lietojumprogrammas.
Coval
Simulācijas un novērtēšanas platforma, lai testētu AI balss un tērzēšanas asistentus mērogā
Phonic Voice AI
Gala līdz galam balss AI platforma uzticamu sarunvalodu aģentu veidošanai, novērošanai un novērtēšanai.
KeywordsAI
Vienots izstrādātāju platforma LLM lietojumprogrammu izveidei, uzraudzībai un mērogošanai.
Phoenix
Atvērtā pirmkoda novērojamības un novērtēšanas platforma AI lietojumprogrammu izsekot un uzlabot.
QualiaInterviews
AI vadīts platforma daudzvalodu, konversāciju pētījumiem un novērtējuma intervijām masu mērogā.
Mosaic AI Agent Framework
Databricks rīku komplekts, kas paredzēts kvalitatīvu AI aģentu un RAG lietojumprogrammu izveidei, izvietojumam un novērtēšanai.
Humanloop
Uzņēmumu līmeņa LLM vērtēšanas un iedarbības pārvaldības platforma, lai piegādātu uzticamas AI funkcijas.
LangWatch
LLM optimizēšanas studija – uzraudzībai, vērtēšanai un AI lietojumprogrammu uzlabošanai produkcijā.















