Es ist ein Rennen um den Wettbewerbsvorteil verschaffenden KI-Einsatz. Aber dafür braucht es die richtige Hardware. Große KI-Modelle, die auf enormen Mengen von Trainings- und Echtdaten basieren, profitieren von einem beschleunigten Speicherzugriff. Deshalb setzen viele IT-Verantwortliche auf GPU-Server, um große, komplexe Datensätze zu bewältigen.
Im Inneren eines Quantenbeschleunigers - doch zur Steigerung der Geschwindigkeit bei der Verarbeitung von KI-Workloads braucht es heute GPUs, TPUs, IPUs oder FPGAs .....
Das Geheimnis zur Steigerung des Speicherdurchsatzes ist eine geringere Latenzzeit und eine höhere Bandbreite. Diese beiden Faktoren schlagen sich unmittelbar in einer verbesserten Produktivität und Leistungsfähigkeit nieder, vor allem durch neueste I/O- und Netzwerk-Technologien, die auf direktem und Remote Speicherzugriff basieren. Schnelleres Modelltraining und schnellere Auftragsabwicklung bedeuten, dass KI-gestützte Anwendungen schneller für den produktiven Einsatz bereitgestellt und genutzt werden können.
Direkter Speicherzugriff für GPUs
Direct Memory Access (DMA) wird seit den Anfängen der Computertechnik zur Beschleunigung der I/O eingesetzt. Bei DMA handelt es sich im Wesentlichen um Speicher-zu-Speicher-Übertragungen über einen Bus (oder eine andere Schnittstelle) von einem Gerät zum anderen.
Dabei wird ein Bereich von Speicheradressen direkt aus dem Speicher des Senders in den Speicher des Empfängers kopiert. Diese Funktion nimmt die CPU aus dem Prozess heraus und beschleunigt die Übertragung, indem sie die Anzahl der Kopiervorgänge reduziert, so dass die CPU die Daten des Absenders nicht in ihren Speicher kopieren und dann aus ihrem Speicher in den Speicher des Empfängers kopieren muss.
Tatsächlich ist die DMA-Leistung auf einem einzelnen System nur durch die Geschwindigkeit des Busses (oder einer anderen Schnittstelle) begrenzt, der die an einer Datenübertragung beteiligten Sende- und Empfangsgeräte verbindet. Bei PCIe 4.0 sind das 16 Gigatransfers pro Sekunde (GT/s), bei PCIe 5.0 sind es doppelt so viele (32 GT/s). Die Datenübertragungsraten sind aufgrund des Codierungs- und Paketierungs-Overheads langsamer, aber die Nennbandbreite für diese beiden PCIe-Versionen beträgt 64 Gbps (4.0) bzw. 128 Gbps (5.0). Das ist schnell!
„Supermicro SYS-421GE-TNRT“- GPU-Server mit 10 GPUs, die über „NVLink“ verbunden sind.
(Bild: Supermicro)
Remote-DMA (RDMA) erweitert die Fähigkeit von DMA innerhalb eines einzelnen Systems auf die Arbeit zwischen zwei Systemen über eine Netzwerkverbindung. RDMA basiert in der Regel auf einer besonderen Anwendungsprogrammierschnittstelle (API), die mit spezieller Netzwerkhardware und -software zusammenarbeitet, um so viele der Vorteile von lokalem DMA zu bieten, wie die zugrunde liegende Netzwerktechnologie erlaubt.
Es gibt drei verbreitete Arten von RDMA-Technologien
„Nvidia NVLink“ nutzt die schnellsten proprietären Schnittstellen und Switch-Technologien, um die Datenübertragung zwischen GPUs in einem Hochgeschwindigkeitsnetzwerk zu beschleunigen. Bei den standardmäßigen MLPerf Training v3.0 Benchmarks erreicht NVLink derzeit die höchste Leistung aller Technologien. Eine einzelne „Nvidia H100 Tensor Core“- GPU unterstützt bis zu 18 NVLink-Verbindungen mit einer Gesamtgeschwindigkeit von bis zu 900 Gbit/s. Das ist das Siebenfache der effektiven Geschwindigkeit von PCIe 5.0.
Infiniband ist ein Hochgeschwindigkeits-Netzwerkstandard, der von der Infiniband Trade Association (IBTA) verwaltet wird und in Hochleistungsnetzwerken weit verbreitet ist. Die höchsten spezifizierten Datenraten liegen bei bis zu 1.200 Gb/s (mit 12 Links) für die NDR-Spezifikation ab 2022.
Ethernet ist eine Standard-Netzwerktechnologie mit vielen Varianten, darunter das selten verwendete TbE (~125 GBps) und das häufigere 400 GbE (50 GBps). Es hat den Vorteil, dass es erschwinglicher ist, weit verbreitet und in vielen Rechenzentren eine vertraute Technologie ist.
RDMA-Technologien können den GPU-Datenzugriff über alle drei oben genannten Netzwerktechnologien unterstützen. Jede dieser Technologien bietet ein anderes Preis-Leistungs-Verhältnis, bei dem mehr Kosten in höhere Geschwindigkeit und geringere Latenzzeiten umgesetzt werden. Unternehmen können den zugrundeliegenden Verbindungstyp wählen, der am besten zu ihrem Budget und ihren Anforderungen passt, wobei sie wissen, dass jede Option eine spezifische Kombination aus Preis und Leistung darstellt, auf die sie sich verlassen können.
Zwischen den Speichern
Da KI -Anwendungen sowohl niedrige Latenzzeiten als auch hohe Bandbreiten benötigen, hilft RDMA, die lokalen Vorteile von DMA auf Netzwerkressourcen auszuweiten, abhängig von den zugrunde liegenden Verbindungen. Dies ermöglicht einen schnellen Zugriff auf externe Daten über Storage-zu-Storage-Übertragungen zwischen Systemen (GPU-Server auf der einen Seite, Storage-System auf der anderen). Der Remote-Adapter arbeitet mit NVLink, Infiniband oder einer Hochgeschwindigkeits-Ethernet-Variante und überträgt Daten aus dem Speicher eines entfernten Systems in den Speicher einer lokalen GPU.
Der eigentliche Vorteil des Einsatzes von GPU-Servern für KI und andere anspruchsvolle Workloads, zum Beispiel 3D- oder Finite-Elemente-Analysen und Simulationen, besteht darin, dass sie die Trennung von Infrastrukturkomponenten und Workloads ermöglichen. Dies spart 20 bis 30 Pozent der CPU-Zyklen ein, die sonst für den Zugriff auf die Infrastruktur und deren Verwaltung aufgewendet werden, setzt Ressourcen frei und beschleunigt den Zugriff, indem I/O-Funktionen in die Hardware verlagert werden.
Stand: 08.12.2025
Es ist für uns eine Selbstverständlichkeit, dass wir verantwortungsvoll mit Ihren personenbezogenen Daten umgehen. Sofern wir personenbezogene Daten von Ihnen erheben, verarbeiten wir diese unter Beachtung der geltenden Datenschutzvorschriften. Detaillierte Informationen finden Sie in unserer Datenschutzerklärung.
Einwilligung in die Verwendung von Daten zu Werbezwecken
Ich bin damit einverstanden, dass die Vogel IT-Medien GmbH, Max-Josef-Metzger-Straße 21, 86157 Augsburg, einschließlich aller mit ihr im Sinne der §§ 15 ff. AktG verbundenen Unternehmen (im weiteren: Vogel Communications Group) meine E-Mail-Adresse für die Zusendung von Newslettern und Werbung nutzt. Auflistungen der jeweils zugehörigen Unternehmen können hier abgerufen werden.
Der Newsletterinhalt erstreckt sich dabei auf Produkte und Dienstleistungen aller zuvor genannten Unternehmen, darunter beispielsweise Fachzeitschriften und Fachbücher, Veranstaltungen und Messen sowie veranstaltungsbezogene Produkte und Dienstleistungen, Print- und Digital-Mediaangebote und Services wie weitere (redaktionelle) Newsletter, Gewinnspiele, Lead-Kampagnen, Marktforschung im Online- und Offline-Bereich, fachspezifische Webportale und E-Learning-Angebote. Wenn auch meine persönliche Telefonnummer erhoben wurde, darf diese für die Unterbreitung von Angeboten der vorgenannten Produkte und Dienstleistungen der vorgenannten Unternehmen und Marktforschung genutzt werden.
Meine Einwilligung umfasst zudem die Verarbeitung meiner E-Mail-Adresse und Telefonnummer für den Datenabgleich zu Marketingzwecken mit ausgewählten Werbepartnern wie z.B. LinkedIN, Google und Meta. Hierfür darf die Vogel Communications Group die genannten Daten gehasht an Werbepartner übermitteln, die diese Daten dann nutzen, um feststellen zu können, ob ich ebenfalls Mitglied auf den besagten Werbepartnerportalen bin. Die Vogel Communications Group nutzt diese Funktion zu Zwecken des Retargeting (Upselling, Crossselling und Kundenbindung), der Generierung von sog. Lookalike Audiences zur Neukundengewinnung und als Ausschlussgrundlage für laufende Werbekampagnen. Weitere Informationen kann ich dem Abschnitt „Datenabgleich zu Marketingzwecken“ in der Datenschutzerklärung entnehmen.
Falls ich im Internet auf Portalen der Vogel Communications Group einschließlich deren mit ihr im Sinne der §§ 15 ff. AktG verbundenen Unternehmen geschützte Inhalte abrufe, muss ich mich mit weiteren Daten für den Zugang zu diesen Inhalten registrieren. Im Gegenzug für diesen gebührenlosen Zugang zu redaktionellen Inhalten dürfen meine Daten im Sinne dieser Einwilligung für die hier genannten Zwecke verwendet werden. Dies gilt nicht für den Datenabgleich zu Marketingzwecken.
Recht auf Widerruf
Mir ist bewusst, dass ich diese Einwilligung jederzeit für die Zukunft widerrufen kann. Durch meinen Widerruf wird die Rechtmäßigkeit der aufgrund meiner Einwilligung bis zum Widerruf erfolgten Verarbeitung nicht berührt. Um meinen Widerruf zu erklären, kann ich als eine Möglichkeit das unter https://contact.vogel.de abrufbare Kontaktformular nutzen. Sofern ich einzelne von mir abonnierte Newsletter nicht mehr erhalten möchte, kann ich darüber hinaus auch den am Ende eines Newsletters eingebundenen Abmeldelink anklicken. Weitere Informationen zu meinem Widerrufsrecht und dessen Ausübung sowie zu den Folgen meines Widerrufs finde ich in der Datenschutzerklärung.
*Der Autor Michael McNerney ist Vice President Marketing & Network Security bei Supermicro.