Autoblocks
Évaluation IAAutoblocks aide les équipes à évaluer, tester et améliorer les applications LLM avec des workflows d’évaluation adaptés aux critères métier, avec un positionnement clair…
Affinez les résultats et accédez rapidement aux outils les plus pertinents.
Classés par pertinence, popularité récente, signaux de confiance et fraîcheur.
Autoblocks aide les équipes à évaluer, tester et améliorer les applications LLM avec des workflows d’évaluation adaptés aux critères métier, avec un positionnement clair…
TruLens aide les équipes à instrumenter, tracer et évaluer les applications RAG, agents IA et workflows LLM avec des métriques fiables, avec une approche claire, structu…
Framework open source pour évaluer les applications LLM, RAG et agents avec métriques, datasets et boucles d’amélioration.
Plateforme d’évaluation, observabilité et expérimentation pour tester les applications LLM avant et après la production.
Cleanlab aide les équipes à détecter et corriger les erreurs dans les datasets, labels et données utilisées pour l’entraînement ou l’évaluation IA, avec un positionnemen…
Labelbox est une plateforme de données pour l’IA qui permet d’annoter, organiser, contrôler et évaluer des données multimodales destinées à l’entraînement, au post-entra…
Kili Technology est une plateforme d’annotation et de préparation de données qui aide les équipes IA à créer, contrôler et améliorer des jeux de données pour l’entraînem…
OpenLIT aide les équipes à surveiller les coûts, performances, traces et comportements des applications LLM avec une approche open source, avec une approche claire, stru…