Relari (YC W24)Piattaforma per il testing, l'evaluation e la generazione di dati sintetici per gli agenti di intelligenza artificiale.
Panoramica
Funzionalità chiave
- Generazione del set di dati sintetico
- Flussi di valutazione auto-matizzati degli agenti
- Simulazione dello scenario e della conversazione
- Metriche di valutazione personalizzabili
- Test di regressione per gli applicativi LLM
- Benchmarking e relazione delle prestazioni
Prezzi
- Modello
- Free
- Categoria
- Observability
- Valutazione
- 4.3 / 5 (6)
Casi d’uso
Testing degli aggenti di intelligenza artificiale
Valutazione sicura e gestibile degli agenti di intelligenza artificiale.
Pro & contro
Pro
- Progettato per evausi multi-passaggio degli agenti di intelligenza artificiale
- Genera dei dati di test sintetici ad scala
- Supporta metriche e valutatori personalizzabili
- Sostenuo da parte dell'azienda Y Combinator con sviluppo attivo
Contro
- Principalmente destinato a team tecnici, non a non sviluppatori
- Piattaforma più nuova con un insieme di caratteristiche in evoluzione
- Potrebbe richiedere lavoro di integrazione per adattare la pila esistente
Recensioni
Media su 6 valutazioni.
Accedi per lasciare una recensione.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Domande e risposte
Ancora nessuna domanda — sii il primo a chiedere.
Fai una domanda
Alternative a Observability
KeywordsAI
Observability
Piattaforma unificata per sviluppatori per creare, monitorare e scalare applicazioni LLM
Guardian
Observability
Piattaforma di sicurezza e governance per agenti di AI autonomi e sistemi intelligenti.
Maxim AI
Observability
Piattaforma completa per l'evaluazione, monitoraggio e miglioramento degli agenti di intelligenza artificiale
Weave
Observability
Uno strumento per l'integrazione di workflow AI senza codice che consente alle aziende di automatizzare operazioni integrando più modelli di linguaggio grande e collegando i prompt... insieme.
llm scout
Observability
Monitora come il tuo marchio appare in ChatGPT, Claude, Perplexità e Google AI Overviews.
FoundryAI
Observability
Costruisci, valuta e migliorati gli agenti di IA per l'automazione aziendale
Helicone AI
Observability
Piattaforma di osservabilità tutti-in-uno per monitorare, debuggare e migliorare applicazioni LLM in produzione.
Fiddler AI
Observability
Piattaforma di osservabilità e sicurezza AI per la monitoristica, l'elaborazione e il governo delle applicazioni ML e LLM.
Trending now
Reducto AI
AI Agent Development Platforms
API di intelligenza dei documenti che elabora, suddivide, riconosce testi da immagine e estrae dati strutturati da PDFs complessi, diapositive e fogli elettronici
AdCrier
Marketing & Advertising
Risposte sponsorizzate, pagate per clic
Pin AI
Workflow automation
Recruiter AI Agent che automatizza la sorgenza, lo screening e la outreach per velocizzare il processo di assunzione.
Sandy AI
Sales
Co-pilota delle vendite con l'intelligenza artificiale all'interno di Salesmate: trasforma le conversazioni con i clienti in una pipeline e in ricavi.











