IA privée sur Azure OpenAI et Amazon Bedrock dans les régions canadiennes
Une IA privée exécute les modèles de langage dans votre compte Azure ou AWS, en région canadienne si le modèle le permet, avec vos contrôles réseau. Remolda la déploie en six semaines : 9 800 $ CA + TVH.
En bref
- Prix : 9 800 $ CA + TVH pour le Sprint pilote IA de six semaines : une charge de travail IA déployée dans votre locataire infonuagique.
- Azure OpenAI : les déploiements Standard dans la région Canada Est gardent les requêtes et les réponses dans la zone géographique canadienne pour les modèles indiqués (gpt-4o, gpt-4.1-mini, modèles de plongement) ; les déploiements Global peuvent traiter les données n’importe où.
- Amazon Bedrock : les modèles Claude sont appelés depuis Canada (Centre), avec les journaux et les données au repos au Canada ; l’inférence passe par des profils interrégionaux dans d’autres régions.
- La configuration comprend le réseau privé, les identités managées, le coffre de clés, la journalisation et les alertes budgétaires.
- Vous recevez un registre des flux de données qui indique, pour chaque composant, où les données sont stockées et où elles sont traitées.
Votre situation
La question d’un déploiement privé se pose quand l’IA doit fonctionner sous vos propres contrôles infonuagiques. Cas typiques :
- La sécurité demande où vont les requêtes. La réponse doit nommer les régions, les services et la durée de conservation.
- Une évaluation des facteurs relatifs à la vie privée est exigée au Québec. Elle demande une carte factuelle des flux de données à l’extérieur du Québec.
- Une application a besoin d’un point de terminaison de modèle. Les développeurs veulent une API dans le compte Azure ou AWS de l’entreprise.
- Des charges de travail sensibles. Données de santé, financières ou gouvernementales assorties de clauses contractuelles de résidence.
Ce qui est déployé
| Couche | Azure | AWS |
|---|---|---|
| Point de terminaison du modèle | Azure OpenAI dans Foundry, Canada Est ou Centre | Amazon Bedrock depuis Canada (Centre) |
| Réseau | Points de terminaison privés, intégration au réseau virtuel | Points de terminaison VPC (PrivateLink) |
| Identité | Identités managées, rôles Entra ID | Rôles IAM, moindre privilège |
| Secrets | Key Vault | Secrets Manager / KMS |
| Données de recherche | Azure AI Search dans la région | Bedrock Knowledge Bases dans la région |
| Surveillance | Azure Monitor, alertes budgétaires | CloudWatch, AWS Budgets |
La disponibilité des modèles par région est vérifiée dans les tableaux de Microsoft et d’AWS au moment de la réalisation, car elle change à quelques mois d’intervalle. La fonction qui utilise le point de terminaison est bâtie par l’intégration API de LLM ou l’intégration aux systèmes existants ; la surveillance continue peut passer à l’AIOps.
La résidence des données au Canada, en clair
- Azure OpenAI. Les données au repos restent dans la zone géographique Azure choisie. Les déploiements Standard et Regional Provisioned traitent les requêtes dans cette zone ; les déploiements Data Zone couvrent seulement les États-Unis, l’UE ou l’Asie-Pacifique ; les déploiements Global peuvent traiter les données dans n’importe quelle région.
- Amazon Bedrock avec Claude. Appelé depuis Canada (Centre), avec les données au repos au Canada ; l’inférence s’exécute dans d’autres régions par des profils interrégionaux.
- Loi 25 du Québec, art. 17. Une évaluation des facteurs relatifs à la vie privée et une entente écrite sont exigées avant que des renseignements personnels soient communiqués à l’extérieur du Québec.
Ce que comprend le Sprint pilote IA
Architecture et registre des flux de données. Régions, services et conservation pour chaque composant.
Une charge de travail déployée. Point de terminaison, réseau, identité, secrets et surveillance dans votre locataire.
Essai des modèles et des régions. Modèles candidats comparés pour la qualité, le coût et le lieu de traitement.
Infrastructure en tant que code. Terraform ou Bicep, pour que la configuration soit reproductible.
Remise. Guide d’exploitation et séance pour votre équipe infonuagique.
Combien de temps ça prend
Six semaines à partir du lancement. D’après notre expérience, la répartition habituelle est de deux semaines pour les accès, les quotas et la revue de sécurité, deux semaines de réalisation et deux semaines d’essais avec la première application. L’approbation des quotas pour certains modèles peut prendre plus de temps.
Ce que ça coûte
Le Sprint pilote IA coûte 9 800 $ CA + TVH, prix fixe, pour une charge de travail. L’utilisation de l’infonuagique et des modèles est facturée selon votre entente avec Microsoft ou AWS. Vous devez d’abord choisir un fournisseur ? Voir la sélection de fournisseurs IA. Tous les forfaits figurent sur la page des tarifs.
Pourquoi Remolda pour l’IA privée au Canada
- Des faits tirés des tableaux des fournisseurs. Les énoncés sur la résidence citent la documentation de Microsoft et d’AWS vérifiée au moment de la réalisation.
- Votre locataire. Tout s’exécute selon votre entente infonuagique et sous vos contrôles.
- Prêt pour l’évaluation de la vie privée. Le registre des flux de données appuie le travail lié à la Loi 25 et à la LPRPDE.
- Une configuration reproductible. Infrastructure en tant que code.
- Prix fixe. Une charge de travail, six semaines.
Le déroulement
Le Sprint couvre les étapes Audit, Stratégie et Mise en œuvre du cycle Remolda (Audit → Stratégie → Mise en œuvre → Autonomisation → Évolution).
- Appel de cadrage. 30 minutes : charge de travail, nuage, données.
- Architecture. Régions et services choisis, ébauche du registre des flux de données.
- Réalisation. Infrastructure en tant que code, contrôles de sécurité.
- Première application. Reliée et testée.
- Revue. Coût, latence et résidence confirmés, puis poursuivre, ajuster ou arrêter.
Questions fréquentes
Pouvons-nous exécuter Azure OpenAI au Canada ?
Oui, avec des limites qui changent souvent. En septembre 2026, Microsoft indique des déploiements Standard (régionaux) dans la région Canada Est pour gpt-4o, gpt-4.1-mini et les modèles de plongement, qui traitent les requêtes dans la zone géographique canadienne. Les modèles plus récents comme gpt-5.x sont offerts au Canada par des déploiements Regional Provisioned (capacité réservée, traitement dans la zone géographique) ou des déploiements Global, qui peuvent traiter les données à l’extérieur du Canada.
Amazon Bedrock traite-t-il les requêtes Claude au Canada ?
AWS indique que l’inférence dans la région Canada (Centre) n’est pas prise en charge pour les modèles Claude actuels. Les requêtes provenant de ca-central-1 utilisent l’inférence interrégionale ; AWS précise que les données au repos, les journaux et les bases de connaissances restent dans Canada (Centre), tandis que le traitement peut avoir lieu dans une autre région.
Combien coûte un déploiement d’IA privée ?
Le Sprint pilote IA de six semaines de Remolda coûte 9 800 $ CA + TVH pour déployer une charge de travail avec le réseau, la sécurité et la surveillance. L’utilisation de l’infonuagique et des modèles est facturée par Microsoft ou AWS selon votre entente.
La Loi 25 du Québec permet-elle le traitement à l’extérieur du Québec ?
Elle exige une évaluation des facteurs relatifs à la vie privée avant de communiquer des renseignements personnels à l’extérieur du Québec, y compris lorsqu’un fournisseur situé à l’extérieur du Québec les traite pour votre compte, ainsi qu’une entente écrite. Le registre des flux de données que nous produisons alimente cette évaluation.
Quand ChatGPT Enterprise ou Copilot suffisent-ils ?
Pour la productivité du personnel, souvent. Un déploiement privé convient quand vous bâtissez votre propre application, avez besoin de contrôler le réseau et les journaux, ou devez fixer le traitement dans une région pour certains modèles.
Pouvons-nous utiliser des modèles à poids ouverts à la place ?
Oui. Azure AI Foundry et Bedrock hébergent des modèles comme Llama et Mistral, et certaines équipes les exécutent sur leurs propres processeurs graphiques. Nous comparons la qualité, le coût et l’effort d’hébergement pour votre cas d’usage.
Combien de temps ça prend ?
Six semaines à partir du lancement. D’après notre expérience, l’accès à l’abonnement infonuagique, les demandes de quota et la revue de sécurité occupent les deux premières semaines.
Sources
- Microsoft Learn — Types de déploiement des modèles Microsoft Foundry (lieu de traitement des données)
- Microsoft Learn — Disponibilité des régions pour les modèles Foundry vendus par Azure
- AWS — Disponibilité régionale par modèle (Amazon Bedrock)
- AWS Machine Learning Blog — Inférence interrégionale d’Amazon Bedrock au Canada (24 novembre 2025)
- LégisQuébec — Loi sur la protection des renseignements personnels dans le secteur privé (P-39.1), art. 17
Faits vérifiés :
Services liés
Phases d'approche
Perspectives connexes
Intégration LLM dans votre CRM ou ERP au Canada : architecture, résidence des données et coûts
L’avantage IA de Mitacs : Ottawa engage 162 M$ pour 10 000 stages en IA
IA pour les municipalités canadiennes : où elle apporte réellement de la valeur en 2026
Parler à un consultant en transformation IA
Un appel de 30 minutes : vous décrivez la situation, nous vous disons par où commencer et ce que cela coûterait.
Réserver un appel de 30 min30 minutes. En français ou en anglais.