Serving Models at Scale with Red Hat AI Enterprise
AI510
KI-Modelle für den produktiven Einsatz bereitstellen, skalieren und überwachen
KI-Modelle für den produktiven Einsatz bereitstellen, skalieren und überwachen
Ein KI-Modell zu entwickeln ist nur der erste Schritt. Für den Einsatz in Unternehmen müssen Modelle zuverlässig bereitgestellt werden, auch bei steigender Nachfrage. Dabei spielen die passende Infrastruktur, die Inferenzleistung und eine zuverlässige Überwachung eine wichtige Rolle.
Der Kurs Serving Models at Scale with Red Hat AI Enterprise (AI510) vermittelt, wie sich KI-Modelle mit Red Hat OpenShift AI für den produktiven Einsatz bereitstellen und verwalten lassen. Dabei geht es sowohl um generative als auch um prädiktive KI-Modelle.
Sie lernen verschiedene Ansätze für die Modellbereitstellung kennen und setzen diese praktisch mit vLLM, KServe und NVIDIA NIM um. Weitere Themen sind die verteilte Inferenz mit llm-d und die Planung von KI-Workloads mit Kueue.
Ein weiterer Schwerpunkt liegt auf dem Betrieb der Modelle. Sie lernen, wie sich bereitgestellte Modelle überwachen und ihre Leistung im laufenden Betrieb beurteilen lässt.
KURSINHALT
ZIELGRUPPE UND VORAUSSETZUNGEN
WEITERFÜHRENDE KURSE UND EXAMEN
