Entgegen den Befürchtungen von Anlegern, strengere Sicherheitsanforderungen könnten die Hardware-Nachfrage bremsen, machten führende Entwickler von Frontier-Modellen auf dem AI Infra Summit deutlich: KI-Sicherheit und Alignment sind äußerst rechenintensive Prozesse und dürften die Infrastrukturausgaben weiter antreiben. Das geht aus einem Research-Bericht von Citi hervor.
Diese Einschätzung ergab sich am ersten Tag der Konferenz in Santa Clara. Analysten stellten dort fest, dass die Sicherung enormer Rechen-, Strom- und Gebäudekapazitäten inzwischen zum wichtigsten Engpass der Branche geworden ist - und nicht allein Innovationen bei der Modellarchitektur.
Rechenzentren der nächsten Generation werden so ausgelegt, dass sie 30 bis 40 Prozent mehr GPUs aufnehmen können. Gleichzeitig sollen Software-Orchestrierungsplattformen wie Astra und Hardware-Upgrades wie Nvidias Vera-Rubin-Plattform den Durchsatz des gesamten Systems optimieren.
Ian Buck, Vice President für Hyperscale und HPC bei Nvidia Corp., erläuterte auf dem Gipfel, wie der Wechsel von dialogbasierten Chatbots zu autonomer „agentischer KI“ den Hardwarebedarf vervielfacht.
Buck erklärte, dass agentische Arbeitslasten rund 100-mal anspruchsvoller seien als Chat-Anwendungen aus dem Jahr 2023. Er verwies dabei auf exponentiell längere Eingabesequenzen, größere KV-Caches, mehrstufige Interaktionen und die Erzeugung von Sub-Agenten.
Intel-Chef Lip-Bu Tan nutzte den Gipfel, um die strategische Neuausrichtung des Chipherstellers von einem klassischen CPU-Anbieter hin zu einem Komplettanbieter für KI-Infrastruktur zu erläutern.
Tan betonte, dass CPUs weiter eine zentrale Rolle spielen werden, da sich der Wettbewerb von reiner GPU-Leistung hin zu Optimierung auf Systemebene verlagert. Wichtig seien sie vor allem für Reinforcement Learning, Orchestrierungsebenen und agentische Arbeitsabläufe. Um Entscheidungen zu beschleunigen, verschlankte Tan die Managementstruktur von Intel und reduzierte die Hierarchie von 10 bis 12 Ebenen auf 4 bis 5.
Zur Fertigung bestätigte Tan, dass Intels 18A-Prozessknoten in der Volumenproduktion ist. Der fortschrittlichere 14A-Knoten nähert sich dem Start, unterstützt durch eine für Oktober erwartete PDK-Version 0.9 und eine PDK-Version 1.0 im kommenden Quartal.
Parallel dazu schilderte Santosh Janardhan, Infrastrukturchef von Meta Platforms Inc., die Erfahrungen des Unternehmens beim Ausbau massiver Trainingsinfrastruktur.
Während Meta in den kommenden Jahren von seinem mehr als 1 Gigawatt großen „Prometheus“-Cluster in Richtung einer 5-Gigawatt-„Hyperion“-Infrastruktur wächst, bezeichnete Janardhan verlustfreie Vernetzung über mehrere Regionen hinweg als die größte operative Herausforderung.
Um das Ziel zu erreichen, Unterbrechungen in GPU-Clustern auf nur zwei pro 8.000 GPUs pro Tag zu begrenzen, setzte Meta eine proprietäre Netzwerkarchitektur namens Back-End Aggregation (BAG) ein.