Cerebras Inference
API IAAPI d’inférence IA ultra-rapide alimentée par les systèmes Cerebras, avec modèles open source, compatibilité OpenAI, streaming, outils, JSON structuré et endpoints dédié…
Affinez les résultats et accédez rapidement aux outils les plus pertinents.
Classés par pertinence, popularité récente, signaux de confiance et fraîcheur.
API d’inférence IA ultra-rapide alimentée par les systèmes Cerebras, avec modèles open source, compatibilité OpenAI, streaming, outils, JSON structuré et endpoints dédié…
Service managé permettant de déployer des modèles Hugging Face (LLM, vision, audio) en endpoints d’inférence scalables.
BentoML aide les équipes à déployer et scaler des modèles IA ou ML sous forme de services d’inférence robustes et contrôlables, avec une approche claire, professionnelle…
Plateforme d’inférence IA pour développeurs, optimisée pour exécuter rapidement des modèles de texte, audio et vision via une API compatible OpenAI.
Service cloud d’IA proposant des supercalculateurs DGX pour l’entraînement et l’inférence de modèles IA et LLM à l’échelle entreprise.
Fournisseur de cloud GPU et de matériel dédié pour l’entraînement et l’inférence de modèles IA et LLM.
Plateforme cloud permettant l’inférence et le fine-tuning de modèles de langage open-source à grande échelle.
Plateforme d’inférence et de déploiement de modèles de langage optimisés pour la performance et l’échelle.
Ray Serve est une solution infrastructure ia pour équipes professionnelles qui veulent accélérer leurs workflows IA sans complexifier leur stack.
SambaNova est un outil infrastructure ia pour équipes professionnelles, orienté enterprise AI platform et workflows IA.
SaladCloud est une solution infrastructure ia pour automatiser, analyser ou accélérer des workflows professionnels avec l'IA.
Roboflow aide les équipes à préparer des datasets, entraîner et déployer des modèles de computer vision pour des cas d’usage industriels ou produit, avec un positionneme…
Plateforme cloud serverless pour exécuter des modèles d’IA, agents, files de tâches et sandboxes sur CPU ou GPU, avec autoscaling et facturation à l’usage.
Llama Stack aide les équipes à standardiser le développement d’applications agentiques et RAG autour des modèles Llama et de composants d’infrastructure, avec une approc…