LONDON (IT BOLTWISE) – Die Mietpreise für KI-GPUs ziehen weiter an: Laut Branchenangaben haben sie sich binnen eines halben Jahres verdoppelt. Fluence startet ab dem 4. August GPU-Cluster-Auktionen, um Preistransparenz für reservierte Kapazitäten zu schaffen. Besonders betroffen sind Unternehmen, die H100- und Blackwell-Instanzen für Inferenz und Training nutzen. Gleichzeitig bleibt die Auslastung der Chips branchenweit laut den vorliegenden Zahlen niedrig, was das Preissignal zusätzlich verschärft.

KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August
KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Der KI-Boom zeigt sich gerade weniger in neuen Modellen als in den Zeilen auf der Preistabelle: Innerhalb von nur einem halben Jahr sollen sich die Mietkosten für KI-Grafikprozessoren verdoppelt haben. Unternehmen zahlen den Angaben zufolge inzwischen rund vier US-Dollar pro Stunde für leistungsfähige GPU-Cluster. Für deutsche Anbieter und Anwendungsbetreiber ist das nicht nur eine operative Frage der Budgets, sondern auch eine Planungsfrage: Wenn Preis und Verfügbarkeit kurzfristig auseinanderlaufen, verschiebt sich der Aufwand von der Modellwahl hin zur Kapazitätsstrategie.

Im Zentrum steht dabei die Preisrallye entlang ganzer Chip-Generationen. NVIDIA H100-Modelle sollen im Januar noch unter zwei US-Dollar pro Stunde gekostet haben, im August seien es bereits rund drei US-Dollar gewesen. Bei den neuen Blackwell-Chips geht der Trend offenbar weiter: Für B200-Raten werden von „unter fünf“ US-Dollar im Vergleich zu bis zu 5,80 US-Dollar pro Stunde gesprochen. Diese Dynamik erfasst nicht nur ältere Bestände, sondern trifft auch auf die jüngsten, aktuell stark nachgefragten Plattformen.

Dass die Preisspirale kein reines Marktplatz-Phänomen ist, machen auch die großen Cloud-Anbieter sichtbar. So heißt es, Amazon Web Services habe die Preise für H200-Instanzen um 15 Prozent angehoben und mit einer p5e.48xlarge-Instanz einen konkreten Richtwert geliefert: 39,80 statt 34,61 US-Dollar pro Stunde. Auffällig ist jedoch die wirtschaftliche Spannung im System: Obwohl KI-Inferenz inzwischen 55 bis 80 Prozent der GPU-Ausgaben ausmache, liege die durchschnittliche Chip-Auslastung branchenweit nur bei etwa fünf Prozent. Genau diese Lücke zwischen Ausgaben und Nutzungsgrad verschärft die Kosten pro tatsächlich verarbeitetem Workload-Zyklus.

Neue Marktmechanismen entstehen genau deshalb: Fluence startet am 4. August GPU-Cluster-Auktionen, um Preistransparenz für reservierte Kapazitäten zu schaffen. Mehr als 6.000 GPUs in 13 Ländern sollen in diesen Auktionen verfügbar sein; genannt werden unter anderem Cluster in den USA, Kanada und Südkorea. Der Hintergrund ist laut den vorliegenden Informationen das Preisparadoxon zwischen Spot-Märkten und Vertragspreisen: Wenn Spot-Preise inzwischen häufig beim Doppelten der Vertragsraten liegen, wird planbare Nachfrage für Unternehmen wertvoller – und zugleich schwieriger, weil Reservierungen in der Knappheit ihren Preis finden. Für die KI-Betriebsplanung bedeutet das: Self-Serving reines „Kapazität sichern“ reicht oft nicht, wenn der Markt in Echtzeit umspringt.

Auch die Start-up-Szene reagiert auf diese Knappheit mit groß dimensionierten Deals. Genannt wird etwa ein Zehn-Milliarden-Dollar-Vertrag über sechs Jahre zwischen Anthropic und einem jungen Cloud-Unternehmen namens Volta, das zum Zeitpunkt des Vertragsabschlusses erst eine Woche alt gewesen sein soll. Volta soll 300 Millionen US-Dollar bei einer Bewertung von 2,4 Milliarden US-Dollar eingesammelt haben, unterstützt durch NVIDIA und Michael Dell; zusätzlich werden fünf Milliarden US-Dollar von Azora in den Kapazitätsausbau erwähnt. Solche Konstellationen zeigen, dass die Wertschöpfung zunehmend in der Kombination aus Zugang zu Hardware, Betriebsfähigkeit der Plattform und dem Aufbau skalierbarer Lieferketten liegt – nicht allein in der Modellinnovation.

Parallel wächst der Wettbewerbsdruck durch Alternativen zu den dominierenden NVIDIA-Plattformen. In Benchmark-Angaben zu Moonshot AIs Kimi-K3 wird beschrieben, dass AMDs MI355X Tokens günstiger produziere als NVIDIAs B300: Das Modell mit 2,8 Billionen Parametern habe demnach auf AMD-Hardware für weniger als 2,50 US-Dollar pro GPU und Stunde laufen sollen, während der B300 bei rund sechs US-Dollar gelegen haben soll. Beim MiniMax-M3-Modell werden sogar 24 Prozent Kostenvorteil pro Token genannt. Für Unternehmen, die KI-Budgets steuern müssen, wird damit klar: Wirtschaftlichkeit entsteht nicht nur aus dem Modelltyp, sondern aus dem Zusammenspiel von Architektur, Speicherbedarf, Batch-Strategien und den konkreten Instanzkosten.

Der Hardware-Fokus wirkt inzwischen sogar in Branchen außerhalb des klassischen Cloud-Marktes. SpaceX soll seine KI-bezogenen Einnahmen im zweiten Quartal 2026 auf 2,56 Milliarden US-Dollar verdreifacht haben, während die Sparte gleichzeitig noch einen operativen Verlust von 1,26 Milliarden US-Dollar ausgewiesen haben soll. Entscheidend für die operative Dimension ist aber die Kapazität: Laut den Angaben wuchs die installierte GPU-Kapazität von 0,4 auf 1,4 Gigawatt. Gleichzeitig wird berichtet, dass NVIDIA die nächste Ausbaustufe der „KI-Fabriken“ über die Vera-Rubin-Plattform ausliefere, beginnend seit dem 21. Juli, unter anderem an Google Cloud, Microsoft Azure, Meta und CoreWeave. Für die Inferenzseite wird ein zentrales Versprechen genannt: Das Rubin-NVL72-System soll pro GPU 288 GB HBM4-Speicher bereitstellen und damit eine höhere Inferenz-Leistung pro Watt als die Blackwell-Generation ermöglichen. In der Summe wirkt das wie eine Bestätigung, dass sich die Diskussion von „Welche GPUs?“ zunehmend zu „Welche Speicher- und Effizienzarchitektur trägt die Last bei?“ verschiebt.

Die Marktdynamik bleibt indes fragil, und das hat auch eine regulatorische Nebenwirkung. Wenn KI-Systeme skaliert werden, steigt die Notwendigkeit, Ausgaben, Trainingsdaten, Modell- und Betriebslogik nachvollziehbar zu dokumentieren und Risikoprüfungen sauber zu strukturieren; die Quelle verweist dabei auf den EU AI Act und entsprechende Umsetzungsleitfäden. Dazu kommt ein weiterer Kostentreiber aus dem Betrieb: Ein Leak, bei dem die veröffentlichten Gewichte von Alibabas 2,4-Billionen-Parameter-Modell Qwen3.8-Max genannt werden, soll einen Ansturm auf H200- und B200-Cluster ausgelöst haben. Für deutsche Unternehmen folgt daraus eine klare Handlungslogik: Wer KI-Kapazitäten plant, sollte langfristigere Verträge und Migrationspfade frühzeitig absichern, bevor Preisniveaus weiter anziehen. Gleichzeitig spricht die zunehmende Wettbewerbsfähigkeit alternativer GPU-Ökosysteme dafür, KI-Workloads nicht nur modell- sondern auch hardwareseitig zu diversifizieren.

Unter dem Strich entsteht ein Markt, in dem Angebot, Preis und Nutzungsgrad eng gekoppelt sind. TrendForce wird mit Prognosen zitiert: Für 2026 sollen die KI-Server-Auslieferungen um 31 Prozent wachsen, getragen von einem Kapitalaufwand-Plus von 90 Prozent bei den neun größten Cloud-Anbietern; für die Gesamtausgaben werden 886,7 Milliarden US-Dollar für 2026 und 1,3 Billionen US-Dollar für 2027 genannt. Dazu passt das beschriebene „Neocloud“-Geschäftsmodell mit Umsatzbeteiligung, bei dem spezialisierte Cloud-Anbieter Mindestumsätze garantiert bekommen. Sharon AI soll sich dabei einen 1,32-Milliarden-Dollar-Vertrag für über 62.000 GPUs bis Mitte 2027 gesichert haben, während Firmus einen 360-Megawatt-Campus in Indonesien plant, der zwischen 2027 und 2028 ans Netz gehen soll. Für Entscheider in Deutschland heißt das: Die Hardware-Auktion ist nicht nur ein neues Preisinstrument, sondern ein Signal, dass die KI-Ökonomie stärker über Kapazitätsmärkte und Effizienzkennzahlen gesteuert wird als über reine Innovationszyklen.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik intelligenter Schreibtisch Roboter | für Kinder & Erwachsene, mit Emotionen Interaktionen und Animationen, Spielzeug Unterhaltung Begleiter Haustier Persönlicher Assistent, für mehr Spaß
1.501 Bewertungen
Eilik intelligenter Schreibtisch Roboter | für Kinder & Erwachsene, mit Emotionen Interaktionen und Animationen, Spielzeug Unterhaltung Begleiter Haustier Persönlicher Assistent, für mehr Spaß
  • NIEDLICHER BEGLEITER: Eilik ist der ideale Begleiter für Kinder und Erwachsene, die Haustiere, Spiele und intelligente Roboter lieben. Mit vielen Emotionen, Bewegungen und interaktiven Funktionen.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August".
Stichwörter AI AMD Artificial Intelligence Auktionsmarkt Auslastung AWS B200 Blackwell Cloud-instance EU AI Act GPU H100 H200 Hbm Inferenz Kapazität KI Ki-fabriken Künstliche Intelligenz Nvidia Spotpreis
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »KI-Hardware-Auktion: Fluence versteigert 6.000 GPUs ab August« bei Google Deutschland suchen, bei Bing oder Google News!


    808 Leser gerade online auf IT BOLTWISE
    KI-Jobs