Mobile-Menu

Storage für KI: Training, Inferenz und Betrieb – Teil 2
Leistungskriterien für Speichersysteme in KI-Umgebungen

Von Michael Matzer 4 min Lesedauer

Anbieter zum Thema

Im ersten Teil dieser Artikelreihe war häufig die Rede von niedriger Latenz, also der zeitlichen Leistungsfähigkeit von Storage-Infrastruktur. Je niedriger die Latenz, desto schneller werden die GPUs mit Daten versorgt, auf denen das jeweilige Sprachmodell (LLM) wie etwa ChatGPT ausgeführt wird.

Um den Ansprüchen von KI-Modellen zu genügen, muss die Storage-Infrastruktur entsprechende Leistungskriterien erfüllen.(Bild:  KI-generiert)
Um den Ansprüchen von KI-Modellen zu genügen, muss die Storage-Infrastruktur entsprechende Leistungskriterien erfüllen.
(Bild: KI-generiert)

Die Auslastung des GPU-Clusters sollte nach Ansicht von Experten bis zu 90 Prozent erreichen. Das erfordert eine sehr leistungsfähige Storage-Infrastruktur. Aber diese Leistung erhöht letzten Endes die Zufriedenheit des Kunden, der die KI im LLM abfragt, und die Effizienz in der Nutzung von Infrastruktur.

Bildergalerie

Datendurchsatz oder IOPS?

In vielen Datenblättern zu Storage-Geräten stößt der Interessent auf zwei Leistungsparameter, nämlich Datendurchsatz und IOPS. Sie sind nicht austauschbar und bedürfen daher der Erklärung.