Aus der Nähe
Azures Ausbau mit AMD lässt KI-Infrastruktur austauschbarer erscheinen
Fakten · Einschätzung
Microsoft und AMD sagten, dass sie ihre Partnerschaft rund um Azure KI und Hochleistungsrechnen ausbauen werden, mit einem grossflächigen Einsatz von AMDs KI-System Helios im Rack-Massstab, Beschleunigern der nächsten Generation vom Typ Instinct MI455X, neuen virtuellen Maschinen Azure HDv2 und HXv2 sowie einer breiteren Nutzung von AMD Pensando DPUs für generative KI und agentische Workloads. AWS ergänzte zudem seine Exporte der Cost and Usage Reports um standardisierte Amazon-Bedrock-Metadaten, darunter Modellanbieter, Modellname, Preiseinheit, Inferenztyp und Serving-Modus.
Diese Kombination dürfte wichtiger sein als die einzelnen Produktnamen. Microsofts Schritt scheint Azures Hardwarebasis genau in dem Moment zu verbreitern, in dem AWS die Ausgaben für Modelle leichter vergleichbar macht, und zusammen deutet das darauf hin, dass es bei Cloud-KI weniger um einen einzelnen bevorzugten Stack und mehr um die Auswahl, das Routing und die Prüfung austauschbarer Teile geht. Für Microsoft dürfte das den Druck auf Margen und Paketierung eher verschärfen als mindern. Wenn Kunden Modellkosten sauberer vergleichen können und Azure mehr von AMDs Systemen einsetzen kann, scheint sich der Wettbewerb weg von exklusivem Silizium und hin zum guten Betrieb dieser Mischung zu verlagern.
Eine zweite Bewegung liegt ausserhalb der Cloud, weist aber in dieselbe Richtung. NVIDIA veröffentlichte Cosmos 3 Edge als offenes Weltmodell für Roboter und Bildverarbeitungsagenten auf Edge-Geräten. Das dürfte die Verschiebung der generativen KI hin zu lokaler und geräteseitiger Ausführung verstärken, wo Microsoft Softwarepositionen hat, aber den Hardwarepfad nicht so kontrolliert, wie es das innerhalb von Azure versucht.
Belege
- 2026-07-20 Microsoft and AMD announced an expanded strategic partnership to grow Azure’s AI and high-performance computing infrastructure, including large-scale deployment of AMD’s Helios rack-scale AI system, next-generation Instinct MI455X accelerators, new Azure HDv2 and HXv2 virtual machine families, and broader use of AMD Pensando DPUs for generative AI and agentic workloads. blogs.microsoft.com
- 2026-07-20 AWS added standardized Amazon Bedrock product metadata, including model provider, model name, pricing unit, inference type and serving mode, to AWS Data Exports for Cost and Usage Reports so customers can more accurately attribute and analyze generative AI spending. aws.amazon.com
- 2026-07-20 NVIDIA released Cosmos 3 Edge, a 4-billion-parameter open world model on Hugging Face designed for robots and vision AI agents on edge devices, offering memory-efficient, high-throughput inference across NVIDIA edge hardware. huggingface.co