Hardware · 24.07.2026, 03:17

AMD und Cerebras bündeln Kräfte für Hochleistungs-KI-Inferenz mit Helios- und Wafer-Scale-Engine-Systemen

AMD und Cerebras kooperieren, um mit der Kombination aus EPYC-Prozessoren und Wafer-Scale Engine eine leistungsstarke Infrastruktur für KI-Inferenz mit niedriger Latenz zu schaffen.

AMD und Cerebras bündeln Kräfte für Hochleistungs-KI-Inferenz mit Helios- und Wafer-Scale-Engine-SystemenBild: Brett Sayles / Pexels · Pexels · Pexels Lizenz: kostenlos nutzbar, Attribution freiwillig
Passende Hardware-AngeboteAutomatisch ausgespielter Affiliate-Block für Hardware- und PC-Artikel.Deals ansehenSoftware für PC, Backup & SicherheitErgänzende digitale Produkte für Hardware-Leser: Backup, Treiber, Security, PDF und Produktivität.Tools ansehenAnzeige / Affiliate möglich. Für dich entstehen keine Mehrkosten.

Wie Tom’s Hardware berichtet (https://www.tomshardware.com/tech-industry/artificial-intelligence/amd-and-cerebras-partner-on-low-latency-high-throughput-ai-inference-epyc-processors-in-helios-rack-scale-infrastructure-paired-with-cerebras-wafer-scale-engine-wse-solutions), haben AMD und Cerebras eine Partnerschaft angekündigt, die eine neue Ära für KI-Inferenzsysteme einläuten soll. Im Zentrum steht die Kombination von AMDs EPYC-Prozessoren in der Helios Rack-Scale-Infrastruktur mit Cerebras’ Wafer-Scale Engine (WSE), einem der größten und leistungsfähigsten KI-Beschleuniger auf dem Markt.

Leistungsstarke Kombination für KI-Anwendungen

Die Helios-Plattform von AMD ist eine modulare Rack-Scale-Lösung, die auf den neuesten EPYC-Prozessoren basiert und speziell für datenintensive Workloads entwickelt wurde. Durch die Integration der Wafer-Scale Engine von Cerebras, die mit ihrer enormen Chipfläche und hoher Rechenkapazität speziell für KI-Workloads optimiert ist, entsteht eine Infrastruktur, die sowohl hohe Durchsatzraten als auch extrem niedrige Latenzzeiten bei der KI-Inferenz ermöglicht. Diese Kombination adressiert vor allem den Bedarf von Unternehmen und Forschungseinrichtungen, die große KI-Modelle in Echtzeit ausführen müssen, etwa in Bereichen wie autonomes Fahren, medizinische Bildverarbeitung oder natürliche Sprachverarbeitung. Die Wafer-Scale Engine ist dabei in der Lage, komplexe neuronale Netze mit Milliarden von Parametern effizient zu verarbeiten, während die EPYC-Prozessoren die Datenvorbereitung, Steuerung und weitere Rechenaufgaben übernehmen.

Warum das wichtig ist

Die steigende Komplexität moderner KI-Modelle erfordert immer leistungsfähigere Hardwarelösungen. Herkömmliche Systeme stoßen hier oft an ihre Grenzen, insbesondere wenn es um die Kombination aus hoher Rechenleistung und geringer Latenz geht. Die Partnerschaft zwischen AMD und Cerebras schafft eine Plattform, die diese Anforderungen adressiert und so neue Möglichkeiten für den Einsatz von KI in Echtzeit eröffnet. Darüber hinaus zeigt die Kooperation, wie sich spezialisierte KI-Beschleuniger und klassische Serverprozessoren ergänzen können, um skalierbare und effiziente Lösungen für anspruchsvolle KI-Workloads zu bieten. Dies ist ein wichtiger Schritt, um KI-Technologien breiter und effektiver in Unternehmen und Forschung einzusetzen.

Technische Details und Ausblick

Die Helios Rack-Scale-Infrastruktur nutzt AMDs EPYC-Prozessoren der neuesten Generation, die mit hoher Kernanzahl, schnellem Speicherzugriff und umfangreichen I/O-Möglichkeiten überzeugen. Die Cerebras Wafer-Scale Engine hingegen ist ein monolithischer Chip mit einer Fläche von mehreren Tausend Quadratmillimetern, der speziell für KI-Berechnungen optimiert wurde. Durch die enge Integration beider Komponenten können Daten extrem schnell zwischen CPU und KI-Beschleuniger ausgetauscht werden, was die Gesamtperformance deutlich steigert. Laut Tom’s Hardware ist diese Lösung bereits für den Einsatz in großen Rechenzentren konzipiert und soll Unternehmen helfen, ihre KI-Anwendungen effizienter und skalierbarer zu betreiben. Die Partnerschaft unterstreicht auch den Trend, dass Hardwarehersteller zunehmend auf spezialisierte KI-Beschleuniger setzen, um den steigenden Anforderungen moderner KI-Modelle gerecht zu werden. Für Anwender bedeutet dies, dass künftig noch leistungsfähigere und zugleich flexiblere Systeme zur Verfügung stehen, die den Weg für neue Innovationen in der KI-Forschung und -Anwendung ebnen.

Fazit

Mit der Kombination aus AMDs Helios Rack-Scale-Infrastruktur und Cerebras’ Wafer-Scale Engine entsteht eine leistungsstarke Plattform, die speziell auf die Herausforderungen moderner KI-Inferenz zugeschnitten ist. Die Partnerschaft zeigt, wie durch die Verbindung von Hochleistungsservern und spezialisierten KI-Chips neue Maßstäbe in Sachen Rechenleistung und Effizienz gesetzt werden können. Für Unternehmen und Forschungseinrichtungen, die auf schnelle und skalierbare KI-Lösungen angewiesen sind, bietet diese Entwicklung vielversprechende Perspektiven.

Passende Hardware-AngeboteAutomatisch ausgespielter Affiliate-Block für Hardware- und PC-Artikel.Deals ansehenSoftware für PC, Backup & SicherheitErgänzende digitale Produkte für Hardware-Leser: Backup, Treiber, Security, PDF und Produktivität.Tools ansehenAnzeige / Affiliate möglich. Für dich entstehen keine Mehrkosten.

Warum das wichtig ist

Die Kooperation von AMD und Cerebras adressiert die steigenden Anforderungen moderner KI-Anwendungen an Rechenleistung und Latenz und ermöglicht so effizientere und skalierbarere KI-Inferenzsysteme für Unternehmen und Forschung.

Quellen