Galileo AI Evaluations
Analytics IAGalileo AI Evaluations est un outil analytics ia conçu pour aider les équipes professionnelles à accélérer leurs workflows IA avec un cadre exploitable, mesurable et ori…
Affinez les résultats et accédez rapidement aux outils les plus pertinents.
Classés par pertinence, popularité récente, signaux de confiance et fraîcheur.
Galileo AI Evaluations est un outil analytics ia conçu pour aider les équipes professionnelles à accélérer leurs workflows IA avec un cadre exploitable, mesurable et ori…
Autoblocks aide les équipes à évaluer, tester et améliorer les applications LLM avec des workflows d’évaluation adaptés aux critères métier, avec un positionnement clair…
Plateforme d’évaluation, observabilité et expérimentation pour tester les applications LLM avant et après la production.
TruLens aide les équipes à instrumenter, tracer et évaluer les applications RAG, agents IA et workflows LLM avec des métriques fiables, avec une approche claire, structu…
Framework open source pour évaluer les applications LLM, RAG et agents avec métriques, datasets et boucles d’amélioration.
Cognii est un outil education ia conçu pour évaluation automatique et tutorat conversationnel pour éducation dans des workflows professionnels.
TruEra est un outil observabilité ia conçu pour évaluation et monitoring de modèles ML et LLM dans des workflows professionnels.
Agenta est un outil développement ia pour équipes professionnelles, avec des workflows IA orientés LLM evaluation.
LearnUpon AI est la suite d’intelligence artificielle intégrée au LMS LearnUpon pour créer des cours, générer des évaluations, automatiser l’administration et personnali…
Protect AI est une plateforme de sécurité IA couvrant la chaîne d’approvisionnement, l’évaluation de modèles, le red teaming, la sécurité runtime et la protection des ap…
Laminar est une plateforme open source d’observabilité, tracing, évaluation, playground et labellisation pour applications LLM et agents, avec instrumentation OpenTeleme…
Scale Donovan est une plateforme d’agents IA sécurisés destinée au secteur public et aux missions critiques, avec recherche, synthèse, planification, analyse multimodale…
Labelbox est une plateforme de données pour l’IA qui permet d’annoter, organiser, contrôler et évaluer des données multimodales destinées à l’entraînement, au post-entra…
Kili Technology est une plateforme d’annotation et de préparation de données qui aide les équipes IA à créer, contrôler et améliorer des jeux de données pour l’entraînem…
Cleanlab aide les équipes à détecter et corriger les erreurs dans les datasets, labels et données utilisées pour l’entraînement ou l’évaluation IA, avec un positionnemen…
Lunary aide les équipes à centraliser logs, prompts, évaluations et monitoring pour applications LLM en développement comme en production, avec une approche claire, stru…
Literal AI aide les équipes à tracer, analyser et améliorer les applications conversationnelles IA avec données, évaluations et retours utilisateurs, avec une approche c…
Plateforme LLMOps pour gérer prompts, évaluations, datasets et observabilité des applications IA en équipe.
Plateforme open-source d’observabilité, d’analytique et d’évaluation pour applications et agents basés sur des LLM.
Plateforme open-source de tests, d’évaluation et de sécurisation des modèles IA et applications LLM.
Plateforme de monitoring, d’évaluation et d’amélioration continue de la qualité des applications basées sur des LLM.
Confident AI est un outil llmops conçu pour tester et évaluer des applications LLM avec DeepEval dans des workflows professionnels.
MathGPTPro est un outil education ia pour équipes professionnelles, avec des workflows IA orientés math tutoring.
Querium est un outil education ia pour équipes professionnelles, avec des workflows IA orientés AI tutoring.