Generative KI & Microsoft.
Aus unserer Sicht.

Aus der Nähe

AMD macht aus einer Chip-Einführung einen Vorstoss um die Position in der Cloud

AMD stellte sein KI-Rack-Scale-System Helios und GPUs der Instinct MI400 Series vor, zusammen mit CPUs der 6th Gen EPYC und Pensando-Netzwerktechnik. AMD und Anthropic kündigten dann eine strategische Partnerschaft an, in deren Rahmen Anthropic ab 2027 plant, bis zu 2 Gigawatt an GPUs der AMD Instinct MI450 Series in AMD-Helios-Rack-Scale-Lösungen einzusetzen, während die Unternehmen bei der Optimierung von Claude-Workloads für AMD-GPUs zusammenarbeiten und AMD Claude intern einführt. AMD und Cerebras kündigten zudem eine Zusammenarbeit an, um AMD-Helios-GPU-Racks mit Cerebras-Wafer-Scale-Engine-Systemen in einen einheitlichen disaggregierten KI-Inference-Workflow zu integrieren, wobei das kombinierte System in der zweiten Hälfte des Jahres 2026 zunächst über die Cerebras Cloud angeboten werden soll.

Das scheint die Bedeutung von AMDs Produkteinführung von einer Hardware-Veröffentlichung zu einem Schritt zur Positionierung in der Cloud zu verändern. Die Vereinbarung mit Anthropic dürfte nicht nur deshalb wichtig sein, weil sie künftiges GPU-Volumen benennt, sondern weil sie einen Modellanbieter, die Abstimmung von Workloads und AMDs eigene interne Nutzung an denselben Stack bindet. Die Verbindung zu Cerebras deutet zudem darauf hin, dass der unmittelbare Wettbewerb nicht mehr nur darin besteht, wessen Chip schneller ist, sondern wessen System in eine gemischte Inference-Infrastruktur eingebettet werden kann, die Kunden tatsächlich als Dienst kaufen können.

Für Microsoft dürfte das weniger als Frage des einen Anbieters gegen den anderen wichtig sein als als Veränderung dessen, was eine Cloud-Plattform absichern muss. Wenn Modellunternehmen und Inference-Spezialisten gemeinsam dabei helfen können, das Rack, den Optimierungspfad und den gehosteten Workflow zu definieren, dann scheint die Cloud-Ebene weniger zu einem neutralen Behälter und mehr zu einem ausgehandelten Systemprodukt zu werden. Das würde das Management von Abhängigkeiten rund um Chips, Modelle und Serving-Architektur zentraler erscheinen lassen als jede einzelne Modellankündigung für sich.

Belege
  • 2026-07-23 AMD launched its Helios AI rack-scale system and Instinct MI400 Series GPUs, alongside 6th Gen EPYC CPUs and Pensando networking, as a full-stack AI compute portfolio at its Advancing AI 2026 event. ir.amd.com
  • 2026-07-22 AMD and Anthropic announced a strategic partnership under which Anthropic plans to deploy up to 2 gigawatts of AMD Instinct MI450 Series GPUs in AMD Helios rack-scale solutions starting in 2027, while the companies collaborate on optimizing Claude workloads for AMD GPUs and AMD broadly adopts Claude internally. newsroom.amd.com
  • 2026-07-23 AMD and Cerebras announced a collaboration to integrate AMD Helios GPU racks with Cerebras Wafer-Scale Engine systems into a unified disaggregated AI inference workflow, with the combined system to be offered first via Cerebras Cloud in the second half of 2026. newsroom.amd.com