Zu aufwändig oder nicht unternehmenstauglich lautet das Urteil vieler CEOs und CTOs über den Stand der KI-Nutzung. Doch neue Lösungen sind in Sicht.

Der Aufbau und der Betrieb eines eigenen KI-Systems erfordert umfangreiche Infrastruktur, umfangreiches Modelltraining, intensive Schulungen sowie die Zusammenarbeit zwischen Ingenieuren, Datenwissenschaftlern und Anwendungsentwicklern. Doch es geht auch anders, in dem man die Erfahrungen und Technologien von einem der neuen aufstrebenden KI-Dienstleister in Anspruch nimmt. Inflection AI ist ein solcher Provider, der eines der weltweit führenden Open-Source LLMs betreibt. Der Service besteht darin, dieses Modell kundenspezifisch so zu trainieren, dass einerseits alle relevanten Kundendaten einfließen und andererseits keine Security- oder Datenschutzverletzungen entstehen – sozusagen „KI-as-a-Service“. Das Unternehmen wirbt mit der Aussage: „Wir trainieren und optimieren unser Modell mit Ihren Daten gemäß Ihren Anforderungen. Das bedeutet: Die Daten sind sicher und die Kosten gering.“ Der neue Service heißt „Inflection for Enterprise“ und basiert auf deren KI-System 3.0. Damit lassen sich umfassende KI-Lösung einrichten, die den Mitarbeitern einen virtuellen KI-Coworker zur Seite stellen, der speziell auf die Unternehmensdaten, -Richtlinien und -Kultur geschult ist und mehr leistet als die bekannten Copilots. „Die CEOs und CTOs sind über die vorhandenen KI-Tools frustriert, da diese nicht unternehmenstauglich sind“, sagt Ted Shelton, COO von Inflection AI. „Die meisten Firmen haben nicht das Fachwissen, um ein Modell selbst zu optimieren und die Nutzung zu implementieren, Inflection for Enterprise ermöglicht es ihnen, das gesamte Firmen-Knowhow in ein feinabgestimmtes Modell einzubringen, ohne dass es Kompromisse bei der Datennutzug gibt.“, so Shelton weiter.

shutterstock_2265302181
Das Management sieht einen zunehmenden Klärungsbedarf beim Hype-Thema KI.

Inflection: Power-KI zum günstigen Preis

Die Technologie hinter dem Inflection-Service basiert auf den neuen Intel® Gaudi® 3 KI-Beschleunigern und der Intel® Tiber™ AI Cloud. Zum Einsatz kommen hier 128 GB Speicherkapazität mit einer hohen Bandbreite von 3,7 TB/s. „Im Vergleich zu allen aktuellen Angeboten erzielen wir mit Intel ein fast doppelt so gutes Preis-Leistungs-Verhältnis“, sagt Ted Shelton über seine Wahl zugunsten von Intel. Ein weiterer Vorteil ergibt sich durch die Nutzung der Tiber AI Cloud. Sie rationalisiert die Erstellung, Prüfung und Bereitstellung von KI-Anwendungen in einer einheitlichen Umgebung und beschleunigt so die Time-to-Market. „Die Unterstützung von Open-Source-Modellen und -Tools sowie eine günstige Leistung pro Watt bei Gaudi 3 machen die Bereitstellung von generativer KI (GenKI) erschwinglich und effizient“, sagt Justin Hotard, Executive Vice President und General Manager der Data Center and AI Group bei Intel.

Gaudi 3: Schneller als Nvidia H100

Der Intel Gaudi 3 KI-Beschleuniger ist derzeit das modernste, was es auf diesem Gebiet gibt. Er kann KI-Systeme mit bis zu Zehntausenden von Beschleunigern antreiben, die über einen gemeinsamen Ethernet-Standard verbunden sind. Er bietet viermal mehr KI-Leistung für Bfloat16 und eine 1,5-fache Steigerung der Speicherbandbreite im Vergleich zu seinem Vorgänger. Auch im Vergleich zu Nvidia H100 bietet Gaudi 3 eine im Durchschnitt 50 Prozent schnellere Trainingszeit für Llama 2 mit 7B- und 13B-Parametern und für GPT-3 mit 175B-Parametern. „Unsere neuesten Gaudi-, Xeon- und Core Ultra-Plattformen bieten ein zusammenhängendes Set an flexiblen Lösungen, die auf die unterschiedlichen Bedürfnisse unserer Kunden und Partner zugeschnitten sind“, sagt Pat Gelsinger, CEO von Intel, über die neuen Möglichkeiten.

Gaudi 3: Hohe Akzeptanz bei Herstellern und Anwendern

Viele OEMs haben sich bereits für die neuen Prozessoren entschieden, darunter Dell Technologies, Hewlett Packard Enterprise, Lenovo und Supermicro. Aber auch viele Anwender und Service-Provider setzen darauf. Beispielsweise will Bosch damit weitere Möglichkeiten für die intelligente Fertigung erkunden, einschließlich grundlegender Modelle, um synthetische Datensätze von Fertigungsanomalien zu generieren. IBM plant den Einsatz von Intel® Xeon® Prozessoren der 5. Generation für seinen watsonx.data™-Datenspeicher sowie eine enge Zusammenarbeit zur Validierung der watsonx™-Plattform für die Gaudi Beschleuniger. Außerdem hat Intel soeben mit AMD eine x86-Ökosystem-Beratungsgruppe gegründet, um diese Computerarchitektur weiterzuentwickeln. „Wir stehen an der Schwelle zu einem der bedeutendsten Umbrüche in der x86-Architektur und im x86-Ökosystem – mit neuen Ebenen der Anpassung, Kompatibilität und Skalierbarkeit, die erforderlich sind, um die aktuellen und zukünftigen Kundenbedürfnisse zu erfüllen“, sagt Pat Gelsinger über die neue Kooperation.

Fazit

Der Aufbau und der Betrieb von großen kundenindividuellen GenKI-Lösungen ist ressourcen-intensiv und riskant. Neue KI-Dienstleister und neue Technologien erleichtern den Einstieg und ermöglichen einen schnellen ROI. Intel bietet hier mit seinen Gaudi 3 KI-Beschleunigern sowie weiteren Tools und Plattformen Lösungen an, die nicht nur hoch performant, sondern auch besonders günstig sind.

Teilen
Teilen