DeepEval
Framework open-source pour évaluer, tester et fiabiliser des applications LLM, agents et pipelines RAG.
Framework open-source permettant de tester, comparer et évaluer prompts, modèles et pipelines LLM.
Promptfoo est un outil très pragmatique qui apporte des pratiques de test logiciel classiques au monde des LLM. Sa force est la reproductibilité et la simplicité d’intégration. Il est particulièrement adapté aux équipes techniques cherchant à éviter des régressions coûteuses. En revanche, il nécessite un investissement initial pour définir de bons cas de test et des critères de qualité pertinents.
Framework open-source pour évaluer, tester et fiabiliser des applications LLM, agents et pipelines RAG.
Créateur de pipelines IA & LLM via interface drag-and-drop.
Ancienne fiche de modèle Runway, désormais rattachée à la plateforme principale.
NeuraForge AI est une plateforme d’automatisation intelligente conçue pour créer des workflows IA avancés, coordonner des agents autonome…
Plateforme de monitoring, d’évaluation et d’amélioration continue de la qualité des applications basées sur des LLM.
Plateforme open-source de tests, d’évaluation et de sécurisation des modèles IA et applications LLM.
Un seul hub pour comprendre où se place Promptfoo : outils proches, comparaisons, catégorie, intentions de recherche et relations sémantiques.