FAQ sur les usines AWS AI
FAQ sur les usines AWS AI
Généralités
Ouvrir toutLes usines AWS AI sont des environnements dédiés et spécialement conçus qu’AWS déploie et gère entièrement dans votre centre de données pour votre compte. Elles combinent les accélérateurs d’IA les plus récents, notamment AWS Trainium et les GPU NVIDIA, un réseau spécialisé et un stockage haute performance. Chaque usine AWS AI est mise à votre disposition exclusive ou à celle de la communauté approuvée que vous avez désignée, afin que vous puissiez respecter les exigences de résidence et de souveraineté des données tout en conservant l’accès à un large éventail de fonctionnalités d’IA AWS.
Chaque usine AWS AI comprend des services d’IA AWS comme Amazon Bedrock et Amazon SageMaker AI, ce qui permet d’accéder immédiatement aux principaux modèles de fondation sans devoir négocier des accords distincts avec chaque fournisseur de modèles.
Les usines AWS AI sont conçues pour les organisations qui déploient l’IA à l’échelle. Elles fournissent une infrastructure dédiée et spécialement conçue pour les charges de travail d’entraînement, de peaufinage et d’inférence dans des environnements sécurisés et souverains. Cela comprend les organismes publics qui font progresser la transformation numérique en contrôlant entièrement les données et l’infrastructure, ainsi que les entreprises dont les charges de travail d’IA nécessitent beaucoup de calcul et des environnements dédiés, sécurisés et dotés d’une grande capacité de mise à l’échelle.
AWS déploie les usines d’IA exclusivement dans vos centres de données, que vous soyez propriétaire du site ou louiez un espace auprès d’un fournisseur de colocalisation. AWS collabore étroitement avec vous pour mettre en œuvre et gérer ces environnements dans vos installations, tout en respectant ses normes de sécurité.
Les usines AWS AI utilisent la même infrastructure de réseau, de calcul et de stockage conçue par AWS et déployée dans les régions AWS, spécialement optimisée pour offrir une expérience cohérente et hautement performante pour les charges de travail d’IA. Cela comprend AWS Trainium et des instances EC2 équipées de GPU NVIDIA, des technologies réseau hautes performances comme AWS Elastic Fabric Adapter (AWS EFA) et NVLink, ainsi que des services de stockage et de sécurité dotés d’une capacité de mise à l’échelle, conçus pour l’entraînement et l’inférence d’IA à grande échelle.
Oui. Les usines AWS AI prennent en charge les environnements multicomptes et multilocataires.
Par exemple :
Client unique : une entreprise peut exploiter une usine AWS AI centralisée, tandis que différentes unités opérationnelles ou équipes utilisent des comptes AWS distincts avec une gouvernance et un isolement indépendants.
Communauté multilocataire approuvée : plusieurs organisations peuvent partager en toute sécurité l’infrastructure d’une usine AWS AI tout en préservant l’isolement des locataires et les contrôles d’accès.
Commencez par contacter l’équipe responsable de votre compte AWS afin de définir précisément vos besoins. AWS collabore ensuite avec vous pour évaluer la préparation du site, préparer le centre de données et configurer l’usine AWS AI.
Pour commencer, remplissez ce formulaire ou contactez l’équipe responsable de votre compte AWS.
Services
Ouvrir toutLes usines AWS AI sont fournies avec un large éventail de services AWS spécialement conçus pour les charges de travail exigeantes liées à l’inférence, à l’entraînement et au peaufinage de l’IA.
Services d’IA/ML : Amazon Bedrock et Amazon SageMaker donnent immédiatement accès aux principaux modèles de fondation et aux outils nécessaires pour créer, entraîner et déployer des modèles de machine learning sans gérer l’infrastructure sous-jacente.
Calcul : Amazon Elastic Compute Cloud (Amazon EC2), Amazon Elastic Container Service (Amazon ECS), Amazon Elastic Kubernetes Service (Amazon EKS) et AWS Batch fournissent une capacité de calcul flexible et hautement performante pour les charges de travail d’IA à n’importe quelle échelle.
Stockage : Amazon S3 Express One Zone, Amazon EBS et Amazon FSx pour Lustre fournissent le stockage à haut débit et à faible latence requis par les charges de travail d’entraînement et d’inférence d’IA.
Réseau et sécurité : Amazon Virtual Private Cloud (Amazon VPC), AWS Direct Connect, Elastic Load Balancing, et AWS Shield fournissent la connectivité sécurisée, à haut débit et à faible latence requise par l’entraînement et l’inférence d’IA à grande échelle.
Vous accédez également à la majorité des services des régions AWS, notamment Amazon CloudFormation et Amazon CloudWatch, afin de prendre en charge vos charges de travail d’IA et souveraines.
Amazon Bedrock dans les usines AWS AI est fourni par l’intermédiaire du moteur d’inférence distribué Bedrock et donne accès aux principaux modèles de fondation. AWS collabore étroitement avec des fournisseurs tiers et des fournisseurs de modèles à poids fermés pour valider et activer la disponibilité des modèles, afin que vous puissiez utiliser les modèles les mieux adaptés selon le cas d’utilisation, les performances et les exigences réglementaires.
Oui. Les usines AWS AI sont entièrement gérées et comprennent Amazon EBS, Amazon FSx pour Lustre et Amazon S3 Express One Zone pour le stockage haute performance en mode bloc, fichier et objet.
-
SSD à usage général – gp3, gp2
-
SSD à IOPS provisionnées – io1, io2
-
HDD optimisé pour le débit – st1
-
Cold HDD – sc1
Les usines AWS AI prennent en charge les types de volumes Amazon EBS suivants :
Ces types de volumes permettent aux clients d’adapter les performances et les coûts de stockage aux exigences de leurs charges de travail.
Vous pouvez créer des compartiments de répertoire S3 avec Amazon S3 Express One Zone, une classe de stockage à zone unique et hautes performances, spécialement conçue pour fournir un accès aux données constant en moins de 10 millisecondes pour les données que vous consultez le plus fréquemment et les applications sensibles à la latence. Amazon S3 Express One Zone offre un accès aux données jusqu’à 10 fois plus rapide et des coûts de requête jusqu’à 80 % inférieurs à ceux d’Amazon S3 Standard.
Les usines AWS AI fournissent un réseau non bloquant à haut débit via Elastic Fabric Adapter (EFA), ce qui permet de mettre à l’échelle les charges de travail d’entraînement et d’inférence d’IA sur des milliers d’accélérateurs sans dégradation des performances.
Les usines AWS AI se connectent à la région AWS sélectionnée via le réseau mondial AWS, à haut débit et à faible latence. Vous bénéficiez ainsi d’un accès transparent à la majorité des services AWS, comme Amazon DynamoDB et Amazon Aurora, exécutés dans cette région.
Oui. AWS établit un point de présence (POP) privé AWS Direct Connect sur le site de votre usine AWS AI. Cela vous permet de connecter directement votre réseau sur site à l’infrastructure de l’usine AWS AI gérée par AWS dans la même installation et de bénéficier d’une connectivité à faible latence et à haut débit sans passer par l’Internet public.
Oui, vous pouvez utiliser NVIDIA Run:ai dans les usines AWS AI de deux façons : au moyen d’une solution SaaS gérée par NVIDIA et disponible sur AWS Marketplace, ou d’un déploiement autogéré. Run:ai s’intègre à Amazon EKS et Amazon SageMaker HyperPod pour orchestrer les charges de travail d’IA et optimiser l’utilisation des GPU.
Oui. Outre les services gérés par AWS comme Amazon Bedrock et Amazon SageMaker, vous pouvez déployer NVIDIA AI Enterprise avec des options de licence flexibles : apportez votre propre licence ou achetez-en une sur AWS Marketplace. Vous accédez ainsi aux microservices NVIDIA NIM et NeMo.
Accélérateurs d’IA et calcul
Ouvrir toutLes usines AWS AI prennent en charge les accélérateurs d’IA d’AWS et de NVIDIA au moyen d’instances EC2 entièrement gérées et optimisées pour les charges de travail d’entraînement et d’inférence à grande échelle.
Les options d’accélération disponibles comprennent AWS Trainium (Trn2, Trn3) et les GPU NVIDIA (P6-B200, P6-B300, P6e-GB200 UltraServers, P6e-GB300 UltraServers). Vous pouvez déployer plusieurs types d’accélérateurs dans une seule usine AWS AI afin d’optimiser les performances selon les besoins des différentes charges de travail. AWS prévoit également de proposer les GPU NVIDIA Rubin et la plateforme Vera Rubin dès leur disponibilité générale, sous réserve des exigences de calendrier et de configuration.
Les usines AWS AI comprennent également des familles d’instances EC2 optimisées pour le calcul (C), optimisées pour la mémoire (R), à usage général (M) et optimisées pour le stockage (I), afin de répondre à un éventail plus large de besoins liés aux applications et à l’infrastructure d’IA.
Déploiement et gestion
Ouvrir toutEnviron trois à six mois une fois le centre de données prêt et remis à AWS, selon la complexité de la configuration et la disponibilité des composants. Les usines AWS AI utilisent la même infrastructure que les régions AWS. Elles sont fournies et gérées de bout en bout par AWS, ce qui réduit la nécessité de coordonner indépendamment plusieurs fournisseurs d’infrastructure et contribue à accélérer le délai de rentabilisation.
Votre usine AWS AI est accessible depuis la Console de gestion AWS standard et via les points de terminaison d’API de sa région parente. Votre administrateur désigne les comptes ou organisations AWS autorisés à utiliser votre usine AWS AI. Une fois l’accès accordé, l’usine AWS AI apparaît aux côtés des autres zones de disponibilité dans votre compte AWS, ce qui permet à vos équipes d’utiliser dès le premier jour des outils AWS, des API et des interfaces de console familiers.
Capacité
Ouvrir toutOui. AWS collabore avec vous pour planifier et mettre à l’échelle la capacité au fil du temps. Dans le cadre du processus de configuration, AWS collabore avec vous pour définir les besoins de mise à l’échelle à long terme, afin que votre centre de données dispose d’une puissance et d’un espace suffisants pour prendre en charge les extensions futures.
AWS vous permet d’adopter de nouvelles instances EC2 dès qu’elles deviennent disponibles. Vous pouvez déployer plusieurs types d’accélérateurs dans une seule usine AWS AI et collaborer avec AWS pour ajouter des générations plus récentes au moyen d’un avenant à un accord de tarification privé.
Oui, vous pouvez réserver de la capacité d’instance EC2 dans les usines AWS AI à l’aide des réserves de capacité Amazon EC2, afin de disposer d’une capacité de calcul réservée pour vos charges de travail.
Tarification et contrats de niveau de service
Ouvrir toutLa tarification des usines AWS AI est adaptée aux besoins de chaque client et dépend de facteurs comme le lieu du déploiement, l’échelle, les accélérateurs et services sélectionnés, ainsi que l’infrastructure existante du client. Les tarifs sont communiqués après qu’AWS et le client ont effectué une évaluation initiale conjointe de la configuration de l’usine AWS AI.
Les services AWS exécutés dans les usines AWS AI sont couverts par des SLA propres à chaque service. Pour en savoir plus sur les engagements SLA applicables, consultez la page Contrats de niveau de service (SLA) AWS. Ces SLA reposent sur des évaluations complètes des centres de données, qui répondent aux normes d’infrastructure d’AWS, ainsi que sur l’infrastructure et les services cohérents fournis dans chaque usine AWS AI.
Sécurité et souveraineté
Ouvrir toutLes usines AWS AI sont souveraines par conception : vous contrôlez l’emplacement de vos données, les personnes qui peuvent y accéder, ainsi que la manière dont les charges de travail d’IA sont sécurisées et exploitées. Elles appliquent les mêmes fonctionnalités de sécurité, de surveillance, de gestion et d’audit que celles utilisées dans les régions AWS, tout en vous permettant de respecter les exigences de résidence et de souveraineté des données dans votre propre environnement.
Au niveau du matériel, les usines AWS AI utilisent AWS Nitro System, conçu de façon à interdire tout accès aux opérateurs. Aucun mécanisme ne permet au personnel ou aux systèmes AWS de se connecter aux hôtes EC2 Nitro, d’accéder à la mémoire des instances ou aux données client stockées sur le stockage local chiffré des instances ou sur des volumes Amazon EBS chiffrés.
Au niveau des comptes, des applications et des agents, l’accès aux ressources de l’usine AWS AI est contrôlé par des stratégies de Gestion des identités et des accès AWS (AWS IAM) et des autorisations définies par le client. AWS Control Tower fournit des contrôles préventifs, de détection et proactifs pour aider les organisations à mettre en œuvre des cadres de gouvernance et à respecter les exigences de résidence des données et de conformité.
Les usines AWS AI vous permettent également de contrôler l’emplacement où les données sont stockées et traitées. Le plan de données de l’usine AWS AI, y compris les charges de travail d’entraînement des modèles et d’inférence, reste dans le périmètre de l’usine AWS AI, sauf si vous choisissez explicitement de l’intégrer à des services d’une région AWS, comme Amazon S3. Cela permet de veiller à ce que les données sensibles et les charges de travail d’IA restent dans les limites de souveraineté que vous avez définies. Les charges de travail d’inférence, y compris les points de terminaison Amazon Bedrock, peuvent être exécutées dans l’usine AWS AI afin de conserver les invites, les réponses et les interactions avec les modèles dans les limites de souveraineté.
La plupart des services AWS prennent en charge le chiffrement des données au repos et en transit ; bon nombre d’entre eux proposent des clés gérées par le client auxquelles les opérateurs AWS ne peuvent pas accéder. Pour les organisations qui exigent que les clés restent en dehors du Cloud AWS, le magasin de clés externe AWS Key Management Service permet d’utiliser des clés gérées en externe.
AWS peut également collaborer avec vous pour mettre en œuvre des exigences de souveraineté supplémentaires, comme des programmes de surveillance et d’audit de l’accès aux données, des contrôles limitant l’accès à l’infrastructure à des comptes AWS désignés et des contrôles opérationnels imposant des exigences de nationalité ou d’habilitation de sécurité au personnel local.
Oui, vous contrôlez entièrement les comptes qui peuvent accéder à votre usine AWS AI. AWS fournit des outils de gestion des identités, de gouvernance et des accès pour gérer les autorisations et centraliser le contrôle sur l’ensemble des comptes.
Non, seul le personnel AWS a l’autorisation d’exploiter l’infrastructure et les services des usines AWS AI.
Avez-vous trouvé les informations que vous recherchiez ?
Faites-nous part de vos commentaires afin que nous puissions améliorer le contenu de nos pages