STANFORD / LONDON (IT BOLTWISE) – Intel hat auf der Hot-Chips 2026 in Stanford seine GPU-Architektur Crescent Island vorgestellt. Der Fokus liegt auf KI-Inferenz für agentische Workloads statt auf klassischer 3D-Grafik. Der Chip kombiniert bis zu 32 Xe3P-Kerne mit 480 GB LPDDR5X und unterstützt FP8 sowie FP4 für eine effizientere Ausführung großer Sprachmodelle. Für das zweite Halbjahr 2026 nennt Intel einen Zeitplan zur Probenproduktion und adressiert damit besonders die Kostenfrage im Rechenzentrum.

Intel setzt mit Crescent Island auf eine klare Entkopplung: Die GPU ist nicht als Ersatz für klassische Grafikbeschleuniger gedacht, sondern als gezielte Inferenzmaschine für agentische KI-Workloads. Auf der Hot-Chips 2026 in Stanford beschreibt der Chip seinen Architekturansatz explizit in diesem Spannungsfeld aus Leistung pro Watt und wirtschaftlichem Betrieb in Rechenzentren. Das ist wichtig, weil KI-Serving inzwischen häufig über große Cluster läuft und jede eingesparte Milliwattstunde direkt in der TCO-Diskussion landet. Statt Raytracing oder 3D-Funktionalität rückt Intel daher KI-Beschleunigung in den Mittelpunkt – ein Design, das vor allem beim Durchsatz pro investiertem Energie- und Hardwarebudget punkten soll.
Technisch betrachtet beginnt der Ansatz bei den Xe3P-Kernen. Crescent Island kommt mit bis zu 32 Xe3P-Kernen, wobei jeder Kern über eine 16-stufige Systolic-Architektur verfügt. Hinzu kommen ein 1 MB großer General Register File sowie 512 KB L1/SLM-Speicher pro Kern – Komponenten, die typischerweise genau dort ansetzen, wo KI-Modelle hohe Bandbreiten und wiederkehrende Rechenschritte benötigen. Intel ergänzt dieses Rechengerüst mit insgesamt 256 Vektor-Engines und 256 XMX-Engines, die auf vier Compute-Slices verteilt sind. Mit 32 MB L2-Cache und einer PCIe-Gen5-x16-Schnittstelle adressiert Intel außerdem die Anbindung an Host-Systeme, was in der Praxis oft darüber entscheidet, wie gut Inferenzpipeline, Speicherverwaltung und GPU-Serving zusammenspielen.
Für die Modell- und Serving-Ebene ist besonders interessant, dass die Xe3P-Kerne Rechengenauigkeiten über FP8 und FP4 unterstützen. Genau diese Formate werden bei der Inferenz großer Sprachmodelle attraktiv, weil sie den Speicherbedarf und die benötigte Rechenleistung im Vergleich zu höher präzisen Formaten senken können. Das wirkt sich nicht nur auf die Modellgröße aus, sondern auch auf die Auslastung der Recheneinheiten und damit auf die Latenz im Prompt- und Token-Processing. Intel positioniert Crescent Island damit nicht als reinen Maximaldurchsatz-Beschleuniger, sondern als Plattform, die Effizienzverluste durch zu teure Präzisionspfade vermeiden soll. In der Logik „mehr Inferenz pro Watt“ ist das ein direkter Angriffspunkt auf die Kostenkurve von Unternehmen, die KI-Engines produktiv ausrollen und permanent optimieren müssen.
Beim Speicher geht Intel von einer theoretischen Adressierung von bis zu 480 GB LPDDR5X aus, aber die Referenzkarte wird mit 160 GB ausgeliefert. Die Karte ist als PCIe-Steckkarte mit Luftkühlung konzipiert und auf 350 Watt Leistungsaufnahme ausgelegt. Damit zielt Intel explizit auf Setups in Standard-Servergehäusen, in denen Liquid-Cooling sonst eine zusätzliche Planungs- und Betriebsdimension erzeugt. Gleichzeitig bleibt die Aussage zu Leistung pro Watt und zu den Gesamtbetriebskosten für KI-Inferenz ein wiederkehrendes Zielbild. Wer Inferenz-Cluster betreibt, kennt das Problem: Nicht der Spitzenwert allein zählt, sondern wie stabil der Betrieb bei realer Auslastung bleibt und wie gut sich die Hardware in bestehende Deployments integrieren lässt.
Auch auf der Softwareseite versucht Intel, die Einstiegshürde niedrig zu halten. Laut Intel unterstützt Crescent Island gängige Inferenz-Frameworks wie vLLM und SGLang sowie NVIDIA Dynamo – ein Signal für eine breite Kompatibilität zu bestehenden KI-Serving-Stacks. Als konkreter Zeitpunkt nennt Intel, dass das Sampling der GPU für die zweite Jahreshälfte 2026 geplant ist. In derselben Präsentationslinie ordnet Intel Crescent Island als eine von drei Architekturen ein, die ebenfalls im Kontext von Agentic AI auf der Hot-Chips 2026 gezeigt wurden: Neben Crescent Island taucht der Diamond-Rapids-Xeon-Prozessor mit bis zu 256 Kernen auf, ergänzt durch große Cache- und Speicherbandbreite sowie PCIe-Gen6/CXL-3.0-Lanes. Das Portfolio wird außerdem durch den Wildcat-Lake-SoC ergänzt, der als Client-System unter anderem mit einer NPU mit 17 TOPS sowie Wi‑Fi 7 und Bluetooth 6.0 adressiert.
Damit erweitert Intel die Hardware-Diskussion um die Frage, wie diese Bausteine intern und über Systemgrenzen hinweg verbunden werden. Alle drei Architekturen basieren nach Intels Angaben auf der 18A-Prozesstechnologie, dem Foveros-Direct-Packaging-Verfahren und dem UCIe-Interconnect-Standard. Diese Kombination ist auch aus Sicht der Chiplet-Strategie relevant, weil sie eine einheitlichere Basis für unterschiedliche Produktsegmente schaffen soll, ohne jedes Mal das komplette Ökosystem neu zu erfinden. Parallel zur Hot-Chips-Präsentation berichten die Entwickler außerdem über einen sogenannten DRM Fabric für Linux: Dabei handelt es sich um eine herstellerneutrale, protokoll-agnostische DRM-Topologie für Scale-up-Interconnects zwischen GPUs und KI-Beschleunigern. Der Hinweis darauf, dass das auch für Crescent Island relevant sein könne, unterstreicht den Trend, dass sich KI-Inferenz künftig nicht nur durch bessere Chips, sondern ebenso durch flexiblere Vernetzung und durchgängige Softwareunterstützung entscheidet.
💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!
- ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
- IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
- 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
- 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
- V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.
- Die besten Bücher rund um KI & Robotik!

- Die besten KI-News kostenlos per eMail erhalten!
- Zur Startseite von IT BOLTWISE® für aktuelle KI-News!
- IT BOLTWISE® kostenlos auf Patreon unterstützen!
- Aktuelle KI-Jobs auf StepStone finden und bewerben!
- Künstliche Intelligenz: Dem Menschen überlegen – wie KI uns rettet und bedroht | Der Neurowissenschaftler, Psychiater und SPIEGEL-Bestsellerautor von »Digitale Demenz«
Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Intel Crescent Island: Neue GPU für agentische KI-Inferenz mit FP8/FP4 und LPDDR5X" für unsere Leser?


#Sophos
Es werden alle Kommentare moderiert!
Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.
Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.
Du willst nichts verpassen?
Du möchtest über ähnliche News und Beiträge wie "Intel Crescent Island: Neue GPU für agentische KI-Inferenz mit FP8/FP4 und LPDDR5X" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Intel Crescent Island: Neue GPU für agentische KI-Inferenz mit FP8/FP4 und LPDDR5X« bei Google Deutschland suchen, bei Bing oder Google News!