GitHub Copilot
Assistant IA pour compléter, générer, expliquer, corriger, tester et réviser du code dans l’éditeur, GitHub et le ter…
Framework open-source pour évaluer, tester et fiabiliser des applications LLM, agents et pipelines RAG.
DeepEval apporte une approche structurée et mesurable à l’évaluation des systèmes LLM. Sa force est la standardisation des métriques et la facilité d’intégration dans des workflows existants. Il est particulièrement utile pour éviter des régressions silencieuses. En contrepartie, la pertinence des résultats dépend de la qualité des scénarios de test et du choix des métriques.
Une sélection d’outils proches de DeepEval, classés par popularité récente, signaux premium et activité.
Assistant IA pour compléter, générer, expliquer, corriger, tester et réviser du code dans l’éditeur, GitHub et le ter…
Fonctionnalités de recherche vectorielle et sémantique intégrées à Elasticsearch pour des architectures RAG enterprise.
Trigger.dev est un outil développement ia conçu pour jobs background et workflows pour applications modernes dans des…
Environnement de développement et agent de code alimenté par l’IA pour comprendre un projet, modifier plusieurs fichi…
Reka Core est un modèle IA multimodal avancé spécialisé dans la compréhension, le raisonnement et le traitement de te…
Fonctionnalités de recherche vectorielle intégrées à OpenSearch pour des architectures RAG open-source et enterprise.
Ancienne fiche consacrée au modèle Claude Sonnet 3.7 d’Anthropic.
Plateforme open-source d’observabilité, d’analytique et d’évaluation pour applications et agents basés sur des LLM.
Plateforme open-source d’observabilité, d’analytique et d’évaluation pour applications et agents basés sur des LLM.
Framework open-source pour programmer, optimiser et évaluer des systèmes LLM sans dépendre du prompt engineering manuel.
Outil IA orienté fine-tuning accéléré de LLM, visant à réduire le temps d’entraînement et l’usage mémoire pour des modèles open-source.
Framework open-source permettant de tester, comparer et évaluer prompts, modèles et pipelines LLM.
Éditeur visuel pour concevoir, tester et maintenir des workflows LLM complexes sans perdre le contrôle technique.
Framework open-source pour connecter des données privées aux modèles de langage via des pipelines RAG.
Un seul hub pour comprendre où se place DeepEval : outils proches, comparaisons, catégorie, intentions de recherche et relations sémantiques.