Während die KI von der Modellentwicklung zur Inferenz in der Produktion übergeht, beschleunigt sich der Rechenbedarf und verlagert sich hin zu kontinuierlich arbeitenden KI-Fabriken, die Token in großem Maßstab generieren. Diese Verlagerung erfordert Zugriff auf umfangreiches, mandantenfähiges, beschleunigtes Computing, das schnell online gehen kann, hoch ausgelastet bleibt und die Wirtschaftlichkeit von KI-Diensten im Token-Maßstab unterstützt.
Aufstrebende KI-Unternehmen hatten in der Vergangenheit nur begrenzten Zugang zu einer kapitalintensiven Infrastruktur, wobei selbst langfristige Verpflichtungen nicht ausreichten, um eine Finanzierung für die Rechenleistung bereitzustellen.
Um diesem Problem zu begegnen, führt NVIDIA ein neues Geschäftsmodell ein, das dem schnell wachsenden KI-Ökosystem von Start-ups, Modellentwicklern, Unternehmen, Forschungseinrichtungen und regionalen KI-Akteuren einen Zugang zu Rechenleistung ermöglicht.
Dieses neue Modell ermöglicht es KI-Clouds, durch einen wirtschaftlichen Abgleich mit einem Umsatzteilungs- und Kreditunterstützungsmodell NVIDIA-Infrastruktur für KI-native Kunden, Unternehmen und ISVs bereitzustellen. Durch die Partnerschaft werden AI Clouds NVIDIA-gestützte Cloud-Dienste verkaufen, wobei NVIDIA sowohl den Umsatz mit Standardprodukten als auch einen Anteil des Cloud-Umsatzes für die unterstützte Kapazität erzielt. Diese Struktur beschleunigt die Einführung von NVIDIA-Plattformen im wachstumsstarken KI-nativen Sektor mit hoher Investitionsüberzeugung und bietet NVIDIA einen wiederkehrenden, nutzungsgebundenen Gewinnstrom.
Für Modellersteller, Inferenzanbieter, Agentenplattformen und Unternehmen, die KI skalieren, kann dies einen schnelleren Zugang zu Full-Stack-beschleunigtem Computing bedeuten, ohne auf Standortauswahl, Energiebeschaffung, Bau und Hardware-Inbetriebnahme warten zu müssen.
Nachfrageorientierte Kapazität der NVIDIA AI Factory
Die Initiative nimmt bereits Gestalt an: KI-Cloud-Unternehmen bauen DSX-KI-Fabriken auf, die darauf ausgelegt sind, Kunden und Workloads in verschiedenen Regionen zu bedienen.
Sharon AI und Firmus gehören zu den ersten Unternehmen, die mit NVIDIA an diesem neuen Geschäftsmodell arbeiten.
Sharon AI setzt bis zu 40.000 NVIDIA Grace Blackwell GB300-GPUs ein.
„Diese strategische Zusammenarbeit mit NVIDIA markiert einen entscheidenden Moment in der Mission von Sharon AI, eine souveräne, groß angelegte KI-Recheninfrastruktur bereitzustellen“, erklärt James Manning, Mitbegründer und CEO von Sharon AI.
Firmus baut einen Campus für die DSX-KI-Fabrik in Batam, Indonesien. Es wird erwartet, dass der Campus auf 360 Megawatt und bis zu 170.000 NVIDIA-GPUs skaliert wird.
„KI-native Unternehmen benötigen Zugang zu einer skalierbaren, energie- und kosteneffizienten Recheninfrastruktur, um global wettbewerbsfähig zu sein“, erklärte Tim Rosenfield, Co-CEO von Firmus Technologies. „Firmus AI cloud entwickelt eine NVIDIA DSX-konforme KI-Fabrik, die es unserer Cloud ermöglicht, mehr Kunden dabei zu helfen, auf die Rechenleistung zuzugreifen, die sie benötigen, um KI zu entwickeln und zu skalieren.“
KI-Native wie Baseten, Fireworks AI und Together AI zeigen, wohin der Rechenbedarf geht: Sie benötigen sofortigen Zugriff auf die Kapazität der KI-Cloud, um das Modelltraining, das Nachtrainieren, die Feinabstimmung und agentische Inferenz in hohem Volumen für Entwickler, Digital Natives und Unternehmen auszuführen, die mit KI arbeiten.
Die Kunden benötigen einen zuverlässigen Zugang zu NVIDIA-beschleunigtem Computing in großem Maßstab, wenn die Nutzung wächst, aber sie benötigen auch kommerzielle Flexibilität, da Produkte vom Pilotprojekt in die Produktion übergehen.
Um Rechenkapazität zu sichern sowie KI-Modelle zu entwickeln und bereitzustellen, kontaktieren Sie Sharon AI und Firmus.
Erfahren Sie mehr über NVIDIA Cloud-Partner und KI-Fabriken.
