Ankündigung der Regionserweiterung von G6-Instances für SageMaker AI-Inferenz

Veröffentlicht am: 23. Juli 2026

Wir freuen uns, die Verfügbarkeit von Amazon EC2 G6-Instances in der Region AWS GovCloud (USA Ost) für Amazon SageMaker AI-Inferenz bekannt zu geben. G6-Instances werden von bis zu 8 NVIDIA L4 Tensor Core-GPUs mit jeweils 24 GB Arbeitsspeicher und AMD EPYC-Prozessoren der dritten Generation angetrieben, die im Vergleich zu G4dn-Instances eine bis zu doppelt so hohe Deep-Learning-Inferenzleistung bieten.

Mit dieser Regionserweiterung können Regierungsbehörden und Organisationen, die in GovCloud arbeiten, Inferenz-Endpunkte auf G6-Instances bereitstellen, um generative KI-Workloads – einschließlich kleiner bis mittlerer Sprachmodelle, Bildgenerierung und Computer-Vision-Aufgaben – zu unterstützen und gleichzeitig strenge Compliance- und Datenresidenzanforderungen zu erfüllen. G6-Instances bieten ein hervorragendes Preis-Leistungs-Verhältnis für Inferenz-Workloads in der Produktion, die nicht mehr als 24 GB GPU-Speicher erfordern.

G6-Instances für SageMaker AI-Inferenz sind jetzt neben den bereits unterstützten Regionen auch in AWS GovCloud (USA-Ost) verfügbar. Preisinformationen zu diesen Instances finden Sie auf unsererPreisseite.