API et infrastructures IA
Bedrock, Foundry et Vertex AI prennent surtout leur sens quand l’organisation utilise déjà leur cloud et leur système d’identités.
01 Les outils couverts
llama.cpp
llama.cpp est un moteur en C et C++ pour exécuter des modèles sur de nombreux matériels, sans imposer d’interface graphique.
LightOnLightOn
LightOn propose une plateforme de recherche, RAG et agents destinée aux organisations qui veulent choisir où résident leurs données et le calcul.
DINUMAlbert API
Albert API est une plateforme de la DINUM réservée aux agents de l’État français pour expérimenter puis déployer des services d’IA.
Amazon Web ServicesAmazon Bedrock
Amazon Bedrock donne accès à plusieurs familles de modèles et à des services d’agents, de connaissances et de sécurité dans l’écosystème AWS.
MicrosoftMicrosoft Foundry
Microsoft Foundry rassemble modèles, agents, outils, évaluations et gouvernance pour construire des applications IA dans Azure.
Google CloudVertex AI
Vertex AI regroupe les modèles Gemini, un catalogue de modèles partenaires et les services nécessaires pour entraîner, déployer, évaluer et gouverner des applications IA.
02 Comment choisir
- Partir du travail à accomplir et des données nécessaires.
- Vérifier le territoire, l’éligibilité et le mode d’hébergement.
- Distinguer abonnement, consommation, infrastructure et services externes.
- Tester le résultat sur un cas réel avant un engagement annuel.
Toutes Les 6 fiches de cet univers
Chaque fiche détaille les capacités, les limites, l’accès et les sources officielles.
Hugging Face
Comprenez Hugging Face : catalogue de modèles et datasets, Spaces, téléchargement local, inférence, abonnements, coûts de calcul et limites.
LightOn
Comprenez LightOn Paradigm : RAG, agents, API, MCP, déploiement sur site, hybride ou cloud européen, quotas publiés, prix et limites.
Albert API
Comprenez Albert API de la DINUM : éligibilité, API compatible OpenAI, modèles, RAG, OCR, hébergement SecNumCloud, gratuité et limites d’usage.
Amazon Bedrock
Comprenez Amazon Bedrock : catalogue de modèles, API, agents, RAG, garde-fous, inférence à la demande ou provisionnée, tarification et limites AWS.
Microsoft Foundry
Comprenez Microsoft Foundry : catalogue de modèles, agents, outils, évaluations, déploiements Azure, gouvernance, facturation par service et limites.
Vertex AI
Comprenez Vertex AI : Gemini, Model Garden, modèles partenaires, RAG, agents, évaluation, réglage fin, facturation à l’usage et limites Google Cloud.