llm-integration.eu

Amazon Bedrock : quels modèles restent en UE et à quel prix

Amazon Bedrock expliqué : fonctionnement, quels fournisseurs gardent les données dans l'UE, prix par million de tokens, RGPD et premier appel boto3.

Mis à jour 13 min de lectureFaits vérifiés le 19 septembre 2026

TL;DR

Amazon Bedrock est la plateforme d’IA managée d’AWS, avec des modèles de 18 fournisseurs. Seuls Claude, Amazon Nova et quelques modèles anciens, petits ou spécialisés offrent un profil UE qui garde les données dans l’UE. Les derniers modèles d’OpenAI, xAI et Moonshot ne passent en Europe que par un routage mondial. Plusieurs modèles open-weight tournent dans une seule région UE.

Qu’est-ce qu’Amazon Bedrock et comment ça marche ?

Amazon Bedrock est un service AWS entièrement managé qui donne accès, via une seule API, aux modèles de fondation d’Anthropic, Amazon, OpenAI, Mistral, Meta et 13 autres fournisseurs, facturés sur votre compte AWS. Aucun GPU à gérer : vous appelez un modèle ou un profil d’inférence depuis une région AWS et payez au token ou à la capacité réservée.

AWS décrit Bedrock dans sa présentation du service comme un accès “secure, enterprise-grade” à des modèles de fondation et revendique “100+ foundation models”. Le catalogue de modèles recense 18 fournisseurs au 19 septembre 2026.

1. Le point de terminaison. Bedrock propose deux endpoints d’inférence, décrits sur la page des endpoints :

bedrock-runtime bedrock-mantle
API InvokeModel, Converse, Chat Completions, Responses, Messages Responses, Chat Completions, Messages
Inférence inter-régions Oui (profils géographiques et mondiaux) Non, toujours une seule région
Uniquement ici Guardrails, routage de prompts Outils côté serveur, tâches en arrière-plan, Projects, Workspaces
Action IAM bedrock:InvokeModel bedrock-mantle:CreateInference
Prix au token Identique Identique

AWS recommande bedrock-runtime. Les deux reposent sur le même moteur Mantle : on choisit en fonction des besoins.

2. Le profil d’inférence. C’est là que se joue l’hébergement des données. In-Region garde la requête dans la région appelée. Un profil géographique (préfixe eu., us., jp., au.) répartit les requêtes sur un ensemble fixe de régions d’une même zone ; AWS précise que la liste de destinations d’un profil géographique ne change jamais. Un profil mondial (préfixe global.) peut router vers toute région AWS commerciale et s’étend à mesure qu’AWS ouvre des régions.

3. Le mode de consommation. Vous payez de cinq façons :

  • Standard à la demande : au token, sans engagement.
  • Priority et Flex : via le paramètre service_tier à chaque requête. La page de tarifs indique une majoration de 75 % pour Priority et une remise de 50 % pour Flex, quand le modèle les prend en charge. Claude Sonnet 5 ne propose que Standard.
  • Batch : fichiers JSONL déposés dans S3, résultats récupérés dans S3, à moitié prix pour les modèles compatibles. Pas d’appel d’outils.
  • Reserved : capacité réservée pour 1 ou 3 mois, au moins 100 000 tokens d’entrée et 10 000 tokens de sortie par minute, via votre équipe de compte AWS. La documentation des service tiers vise 99,5 % de disponibilité.
  • Provisioned Throughput : facturation horaire par unité de modèle, sans engagement, sur 1 mois ou 6 mois. Obligatoire pour servir un modèle personnalisé.

Quels modèles d’Amazon Bedrock restent dans l’UE ?

Seules deux familles couvrent largement l’UE sur des modèles récents : Anthropic Claude et Amazon Nova, avec un profil eu. qui garde le traitement dans l’UE. La plupart des modèles open-weight tournent plutôt en in-region à Francfort, Stockholm, en Irlande ou à Milan. Les derniers modèles d’OpenAI, xAI et Moonshot n’atteignent l’Europe que par routage mondial.

Nous avons vérifié environ 40 fiches de modèles le 19 septembre 2026. Le tableau retient un modèle représentatif par fournisseur, avec le prix UE lu sur la page de tarifs d’Amazon Bedrock. “Non vérifié” signifie que nous n’avons pas pu lire de prix UE pour ce modèle précis. Prix en USD par million de tokens d’entrée / de sortie, niveau Standard.

Fournisseur Modèle Profil géographique UE In-region dans l’UE Prix UE entrée / sortie
Anthropic Claude Sonnet 5 Oui, eu.anthropic.claude-sonnet-5 Uniquement via bedrock-mantle : Irlande, Stockholm 2,20 / 11,00
Anthropic Claude Opus 5 Oui, eu.anthropic.claude-opus-5 Uniquement via bedrock-mantle : Irlande, Stockholm 5,50 / 27,50
Anthropic Claude Fable 5.1 Non, mondial uniquement Non 10,00 / 50,00 (mondial)
Amazon Nova 2 Lite Oui, eu.amazon.nova-2-lite-v1:0 Non 0,429 / 3,597 (depuis Francfort)
Amazon Nova Pro Oui, eu.amazon.nova-pro-v1:0 Londres uniquement (hors UE) 1,05 / 4,20 (depuis Francfort)
Mistral AI Pixtral Large Oui, eu.mistral.pixtral-large-2502-v1:0 Non 2,00 / 6,00
Mistral AI Devstral 2 123B Non Francfort, Stockholm, Irlande, Milan 0,48 / 2,40
Mistral AI Mistral Large 3 Non Aucune région UE non proposé dans l’UE
Meta Llama 3.2 3B Oui, eu.meta.llama3-2-3b-instruct-v1:0 Non non vérifié
Meta Llama 4 Maverick Non, profil US uniquement Non non proposé dans l’UE
OpenAI gpt-oss-120b Non Francfort, Stockholm, Irlande, Milan 0,15 / 0,60 (Stockholm), 0,20 / 0,79 (Francfort)
OpenAI GPT-5.6 Sol Non, profil US et mondial Non 4,00 / 20,00 (mondial)
OpenAI GPT-6 Astra Non, mondial uniquement en UE Non 10,00 / 50,00 (mondial)
xAI Grok 4.6 Non, mondial uniquement en UE Non 2,00 / 6,00 (mondial)
Moonshot AI Kimi K3 Non, mondial uniquement en UE Non 3,00 / 15,00 (mondial)
DeepSeek DeepSeek V3.2 Non Stockholm 0,74 / 2,22
Qwen Qwen3 235B A22B Non Francfort, Stockholm, Irlande, Milan non vérifié
Z.AI GLM 5 Non Stockholm 1,20 / 3,84
Google Gemma 4 31B Non Francfort (bedrock-mantle uniquement) 0,17 / 0,48

Trois constats comptent pour un acheteur européen :

  1. Aucun profil UE pour les modèles de pointe les plus récents hors Claude. GPT-6 Astra, GPT-5.6 Sol, Grok 4.6 et Kimi K3 routent en mondial depuis toutes les régions UE. Notre analyse de Kimi K3 et GPT-6 Astra détaille les conséquences.
  2. La région source peut changer le prix. Claude coûte le même prix depuis Francfort, l’Irlande ou Stockholm. Pas Nova ni gpt-oss : gpt-oss-120b est 25 % moins cher en entrée à Stockholm qu’à Francfort, et le profil UE de Nova 2 Lite coûte environ 13 % de moins appelé depuis l’Irlande.
  3. Le “profil UE” dépend du point d’appel. Appelé depuis Tel-Aviv, le profil UE de Nova Pro ajoute Tel-Aviv comme destination ; celui de Claude Haiku 4.5 ajoute Londres ou Zurich quand on l’appelle depuis ces régions hors UE. Appelez toujours depuis une région d’un État membre.

La configuration propre à Claude, avec les politiques IAM qui bloquent le routage mondial, est décrite dans notre guide Claude sur AWS Bedrock en Europe.

Combien coûte Amazon Bedrock ? Les prix en deux exemples

À la demande, Bedrock facture au token, avec des tarifs d’entrée et de sortie distincts par modèle, type de profil et parfois région source. Pour Claude, le profil UE et l’in-region coûtent 10 % de plus que le mondial. Le batch divise le prix par deux. Pas de frais de plateforme : seulement le modèle et les frais AWS habituels.

Les modèles Claude sont vendus via AWS Marketplace : leurs coûts apparaissent dans Cost Explorer sous le fournisseur du modèle, pas sous Amazon Bedrock. Vos alertes budgétaires doivent couvrir les deux.

Exemple 1 : assistant de support sur Claude Sonnet 5, profil UE. 20 millions de tokens d’entrée et 4 millions de sortie par mois.

Poste Calcul USD par mois
Entrée 20 × 2,20 44,00
Sortie 4 × 11,00 44,00
Total sans cache 88,00
Avec 15 millions de tokens d’entrée servis par le cache (0,22) 5 × 2,20 + 15 × 0,22 + 44,00 58,30 plus écritures en cache

Le cache pèse plus que la majoration UE de 10 %, qui ne représente ici que 8 USD par mois.

Exemple 2 : classification de 100 millions de tokens de documents par mois, 5 millions de tokens en sortie. Ici, le choix du modèle fait varier le coût d’un facteur supérieur à sept.

Modèle et lieu Calcul USD par mois
gpt-oss-120b, in-region Stockholm 100 × 0,15 + 5 × 0,60 18,00
gpt-oss-120b, in-region Francfort 100 × 0,20 + 5 × 0,79 23,95
Nova 2 Lite, profil UE depuis l’Irlande 100 × 0,374 + 5 × 3,157 53,19
Claude Haiku 4.5, profil UE 100 × 1,10 + 5 × 5,50 137,50

Notre recommandation : confiez la classification de masse à un modèle open-weight in-region et gardez Claude pour les étapes où la qualité fait la différence. Pour comparer le prix de Claude seul entre clouds, consultez notre page Claude API prix en Europe. Si vos équipes ont besoin de sièges dans les applications Claude plutôt que de tokens, notre page prix Claude et tarifs 2026 liste toutes les formules.

Comment Amazon Bedrock protège-t-il vos données ?

Sur Bedrock, AWS est votre sous-traitant au sens du RGPD, pas l’éditeur du modèle. Selon AWS, les fournisseurs de modèles n’ont accès ni aux journaux, ni aux prompts, ni aux réponses. Vous réglez la conservation par région, jusqu’à la conservation zéro pour les modèles qui l’autorisent. L’exception principale : les modèles Claude Fable, conservés jusqu’à 30 jours chez AWS.

La page sur la protection des données décrit des comptes de déploiement gérés par AWS par région et par fournisseur. TLS 1.2 est obligatoire, TLS 1.3 recommandé. La page sur la conservation des données définit les modes :

Mode Effet
none Conservation zéro : rien n’est écrit en stockage durable, rien n’est partagé avec le fournisseur
default Valeur par défaut du modèle, qui peut inclure un stockage pour la détection d’abus
aws_review Jusqu’à 30 jours de conservation chez AWS pour examen ; obligatoire pour Claude Fable 5 et 5.1

Quatre points décident si le dispositif tient face à un audit RGPD :

  • Réglez la conservation région par région. Le paramètre ne se propage pas. Imposez none à toute l’organisation avec la clé de condition bedrock:DataRetentionMode dans une SCP.
  • Le stockage suit la région de destination. Avec un profil géographique ou mondial, les données conservées restent dans la région qui a traité la requête. Avec le profil UE, c’est toujours une région de l’UE.
  • Régions opt-in. AWS prévient que les profils inter-régions peuvent router vers des régions opt-in non activées, où les prompts peuvent être stockés pour la détection d’abus. Contrôlez la liste de destinations avant la mise en production.
  • Traçabilité. CloudTrail journalise chaque requête dans la région source et note la région de traitement réelle dans additionalEventData.inferenceRegion.

Les mêmes règles s’appliquent aux agents de code. Notre guide Claude Code avec Bedrock montre comment fixer Claude Code sur le profil UE.

Quand Amazon Bedrock est-il le bon choix ?

Choisissez Amazon Bedrock si vos charges tournent déjà sur AWS, si vous voulez plusieurs familles de modèles sous un même IAM et une même facture, ou des modèles open-weight dans une seule région UE. Google Cloud, si Claude Fable 5.1 doit rester dans l’UE. L’auto-hébergement ne se justifie qu’à fort volume stable ou pour un contrôle total du modèle.

Critère Amazon Bedrock Google Cloud (Claude) Auto-hébergement
Hébergement UE de Claude Opus 5 / Sonnet 5 Profil géographique UE Endpoint multirégional UE sans objet (poids de Claude non publics)
Claude Fable 5.1 dans l’UE Non, mondial uniquement Oui, multirégion UE à 11 / 55 USD sans objet
Prix UE de Claude Sonnet 5 2,20 / 11,00 2,20 / 11,00 sans objet
Modèles open-weight dans une région UE Oui (gpt-oss, Devstral, DeepSeek, Qwen, GLM, Gemma) hors périmètre de ce guide Oui, tout modèle
Guardrails, Knowledge Bases, Agents Intégrés Équivalents propres À construire
Effort d’exploitation Faible Faible Élevé (GPU, montée en charge, correctifs)

La multirégion UE de Google couvre strictement les États membres de l’UE et exclut donc le Royaume-Uni et la Suisse. Notre guide Claude sur Vertex AI en Europe détaille la mise en place, et notre comparatif Claude et RGPD : quel hébergement en Europe ajoute Microsoft Foundry et l’API Anthropic.

Entre modèles managés et GPU en propre, Bedrock propose une voie médiane : Custom Model Import. À Francfort, une Custom Model Unit coûte 0,07144 USD par minute, facturée par tranches de 5 minutes. Un modèle Llama 3.1 70B nécessite 8 unités, soit environ 34 USD par heure active, ou près de 25 000 USD par mois s’il ne redescend jamais à zéro. C’est la référence que doit battre tout projet d’auto-hébergement, comme celui décrit dans notre guide DeepSeek V4.1 auto-hébergé. Pour des chiffres de marché, voyez notre page statistiques.

Comment faire un premier appel Amazon Bedrock depuis une région UE ?

Il vous faut un compte AWS, des droits IAM sur Bedrock dans une région UE et soit des identifiants AWS, soit une clé API Bedrock. Vous appelez ensuite l’API Converse avec un profil d’inférence UE depuis eu-central-1. Comptez environ 15 minutes si les SCP de votre organisation autorisent déjà les régions de destination UE.

  1. Choisissez une région source dans un État membre, par exemple eu-central-1 (Francfort) ou eu-west-3 (Paris).
  2. Vérifiez les SCP. Autorisez bedrock:InvokeModel* dans chaque région de destination du profil. Selon AWS, une seule destination bloquée fait échouer les requêtes.
  3. Accordez les droits IAM sur l’ARN du profil d’inférence et sur le modèle de fondation sous-jacent, et refusez aws:RequestedRegion = unspecified pour bloquer le routage mondial.
  4. Authentifiez-vous. Utilisez votre chaîne d’identifiants AWS habituelle, ou créez une clé API Bedrock longue durée dans la console et exportez-la dans AWS_BEARER_TOKEN_BEDROCK.
  5. Contrôlez les destinations puis testez avec les commandes ci-dessous.
  6. Réglez la conservation des données sur none dans chaque région UE utilisée, si le modèle le permet.

Les deux commandes tiennent sur une ligne et se copient telles quelles :

aws bedrock get-inference-profile --region eu-central-1 --inference-profile-identifier eu.anthropic.claude-sonnet-5 --query "models[].modelArn" --output table

aws bedrock-runtime converse --region eu-central-1 --model-id eu.anthropic.claude-sonnet-5 --messages '[{"role":"user","content":[{"text":"Explique Amazon Bedrock en deux phrases."}]}]' --inference-config '{"maxTokens":512}'

La première commande liste un ARN par région de destination : si une région hors UE apparaît, arrêtez-vous.

Le même appel en Python avec boto3 et l’API Converse. Converse utilise une forme de requête commune à tous les fournisseurs : passer à eu.amazon.nova-2-lite-v1:0 ne change que l’identifiant du modèle.

# pip install boto3
import boto3

client = boto3.client("bedrock-runtime", region_name="eu-central-1")

response = client.converse(
    modelId="eu.anthropic.claude-sonnet-5",
    messages=[{"role": "user", "content": [{"text": "Explique Amazon Bedrock en deux phrases."}]}],
    inferenceConfig={"maxTokens": 512},
)

for block in response["output"]["message"]["content"]:
    if "text" in block:
        print(block["text"])
print(response["usage"])

Sonnet 5 raisonne par défaut et ces tokens comptent dans maxTokens : relevez la limite si les réponses sont tronquées.

FAQ

Réponses fondées sur la documentation AWS du 19 septembre 2026 ; relisez la fiche du modèle avant de signer un accord de sous-traitance.

Qu’est-ce qu’Amazon Bedrock en une phrase ?

Amazon Bedrock est un service AWS entièrement managé qui donne accès par API aux modèles de fondation de 18 fournisseurs, dont Anthropic Claude, Amazon Nova, OpenAI et Mistral, facturés sur votre compte AWS sans infrastructure GPU à gérer.

Combien coûte Amazon Bedrock ?

Pas d’abonnement : vous payez au token. Dans l’UE, Claude Sonnet 5 coûte 2,20 USD par million de tokens d’entrée et 11 USD par million de tokens de sortie via le profil UE. Les modèles open-weight coûtent bien moins : gpt-oss-120b revient à 0,15 / 0,60 USD à Stockholm. Le batch divise le prix par deux sur les modèles compatibles.

Amazon Bedrock ou Google Cloud : lequel choisir pour Claude dans l’UE ?

Pour Opus 5 et Sonnet 5, les deux sont au même prix et gardent les données dans l’UE. Bedrock l’emporte si vous voulez d’autres familles de modèles et les Guardrails d’AWS. Google l’emporte si vous avez besoin de Claude Fable 5.1 hébergé dans l’UE, que Bedrock ne propose qu’en routage mondial.

Amazon Bedrock est-il conforme au RGPD ?

Il peut l’être si vous le configurez correctement. Utilisez un profil eu. ou un modèle in-region appelé depuis une région d’un État membre, et bloquez les profils mondiaux par IAM. Les modèles sans profil UE, comme GPT-6 Astra ou Kimi K3, peuvent traiter les données partout dans le monde.

OpenAI ou Anthropic voient-ils mes prompts sur Bedrock ?

Non. AWS indique que les fournisseurs de modèles n’ont accès ni aux comptes de déploiement Bedrock, ni aux journaux, ni aux prompts, ni aux réponses. AWS peut conserver des données pour la détection d’abus ou, pour les modèles Claude Fable, jusqu’à 30 jours pour examen, sans les transmettre au fournisseur.

AWS Bedrock et Amazon Bedrock, est-ce la même chose ?

Oui. “AWS Bedrock” est l’appellation courante ; le nom officiel du produit est Amazon Bedrock. Les deux désignent le même service, avec les mêmes API et les mêmes tarifs.

Sources

  1. Documentation AWS Bedrock : What is Amazon Bedrock (19 septembre 2026)
  2. Documentation AWS Bedrock : Endpoints (19 septembre 2026)
  3. Documentation AWS Bedrock : Models at a glance (19 septembre 2026)
  4. Documentation AWS Bedrock : fiche Claude Sonnet 5 (19 septembre 2026)
  5. Documentation AWS Bedrock : fiche Nova 2 Lite (19 septembre 2026)
  6. Documentation AWS Bedrock : fiche gpt-oss-120b (19 septembre 2026)
  7. Documentation AWS Bedrock : régions et modèles des profils d'inférence (19 septembre 2026)
  8. Documentation AWS Bedrock : Service tiers (19 septembre 2026)
  9. Documentation AWS Bedrock : Batch inference (19 septembre 2026)
  10. Documentation AWS Bedrock : Provisioned Throughput (19 septembre 2026)
  11. Documentation AWS Bedrock : Data retention (18 septembre 2026)
  12. Documentation AWS Bedrock : Data protection (18 septembre 2026)
  13. Tarifs Amazon Bedrock (19 septembre 2026)
  14. Tarifs IA générative Google Cloud (18 septembre 2026)

Guides associés