API et infrastructures IA
Bedrock, Foundry et Gemini Enterprise Agent Platform, ex-Vertex AI, prennent surtout leur sens quand l’organisation utilise déjà leur cloud et leur système d’identités.
01 Les outils couverts
llama.cpp
llama.cpp est un moteur en C et C++ pour exécuter des modèles sur de nombreux matériels, sans imposer d’interface graphique.
LightOnLightOn
LightOn propose une plateforme de recherche, RAG et agents destinée aux organisations qui veulent choisir où résident leurs données et le calcul.
DINUMAlbert API
Albert API est une plateforme de la DINUM réservée aux agents de l’État français pour expérimenter puis déployer des services d’IA.
Amazon Web ServicesAmazon Bedrock
Amazon Bedrock donne accès à plusieurs familles de modèles et à des services d’agents, de connaissances et de sécurité dans l’écosystème AWS.
MicrosoftMicrosoft Foundry
Microsoft Foundry rassemble modèles, agents, outils, évaluations et gouvernance pour construire des applications IA dans Azure.
Google CloudGemini Enterprise (ex-Vertex AI)
Vertex AI est désormais intégré à Gemini Enterprise Agent Platform, qui réunit modèles Gemini et partenaires, agents, entraînement, déploiement, évaluation et gouvernance dans Google Cloud.
02 Comment choisir
- Partir du travail à accomplir et des données nécessaires.
- Vérifier le territoire, l’éligibilité et le mode d’hébergement.
- Distinguer abonnement, consommation, infrastructure et services externes.
- Tester le résultat sur un cas réel avant un engagement annuel.
Nouvelles fiches vérifiées
Mistral OCR 4
Mistral OCR 4 extrait le texte, la structure et la position des blocs dans des documents pour alimenter une recherche ou une application.
Nouvelle ficheOpenRouter
OpenRouter fournit une API commune pour appeler des modèles servis par plusieurs fournisseurs sans intégrer chaque API séparément.
Toutes Les 10 fiches de cet univers
Chaque fiche détaille les capacités, les limites, l’accès et les sources officielles.
Hugging Face
Comprenez Hugging Face : catalogue de modèles et datasets, Spaces, téléchargement local, inférence, abonnements, coûts de calcul et limites.
LightOn
Comprenez LightOn Paradigm : RAG, agents, API, MCP, déploiement sur site, hybride ou cloud européen, quotas publiés, prix et limites.
Albert API
Comprenez Albert API de la DINUM : éligibilité, API compatible OpenAI, modèles, RAG, OCR, hébergement SecNumCloud, gratuité et limites d’usage.
Amazon Bedrock
Comprenez Amazon Bedrock : catalogue de modèles, API, agents, RAG, garde-fous, inférence à la demande ou provisionnée, tarification et limites AWS.
Microsoft Foundry
Comprenez Microsoft Foundry : catalogue de modèles, agents, outils, évaluations, déploiements Azure, gouvernance, facturation par service et limites.
Vertex AI, désormais Gemini Enterprise Agent Platform
Vertex AI est désormais intégré à Gemini Enterprise Agent Platform : modèles Gemini et partenaires, agents, entraînement, déploiement, gouvernance et coûts.
Mistral OCR 4
Découvrez Mistral OCR 4 : extraction de documents, 170 langues annoncées, formats pris en charge, prix par page, accès cloud ou privé et limites.
OpenRouter
Découvrez OpenRouter : API unifiée, plus de 400 modèles et 70 fournisseurs annoncés, routage, modèles gratuits, frais de plateforme, accès et limites.
OpenAI Frontier
Découvrez OpenAI Frontier pour construire, déployer et gérer des agents d’entreprise : contexte partagé, outils, permissions, standards ouverts et limites.
LlamaIndex
Découvrez LlamaIndex pour ingérer des documents, construire un RAG, extraire des données avec LlamaParse et déployer des workflows documentaires.