Intel s akcelerátory Crescent Island spoléhá na software Nvidia Dynamo
Intel mluvil o akcelerátorech Crescent Island koncem jara na letošním Computexu. Nejde o výkonné HBM akcelerátory, které současný šéf Intelu Lip-Bu Tan odsunul na druhou kolej, ale snaha zachytit se v segmentu inference (použití AI modelů, nikoli jejich trénování), kde se lze uplatnit i s méně ambiciózním hardwarem. Intel již na Computexu nastínil, že ani inference v plné šíři nebude jeho primární cíl, ale že využije možnosti rozdělení zátěže mezi různá hardwarová řešení. Šlo o skutečnost, že inference se skládá ze dvou fází, z nichž každá má významně odlišné hardwarové nároky. Fáze prefill je náročná na výpočetní výkon a fáze decode je náročná na paměť a datové přesuny.
Architektura Xe3P (dříve též Celestial) si odbude premiéru v segmentu AI akcelerace (Intel)
To je v tomto kontextu velmi důležitý fakt, neboť Nvidia původně plánovala těchto vlastností využít a nabídnout zákazníkům možnost rozdělení inference tak, aby fázi prefill zpracovávaly levnější akcelerátory vybavené GDDR7 pamětmi (tzv. CPX), zatímco pouze fáze decode by probíhala na nejdražších akcelerátorech s HBM4. Aby toto mohlo fungovat bez potřeby zásahů uživatele, připravila Nvidia softwarovou vrstvu nazvanou Dynamo. Ta může rozdělovat prefill a decode na různé akcelerátory, směrovat požadavky podle toho, kde je relevantní KV cache (Key-Value cache, data uložená např. v paměti akcelerátoru), koordinovat inferenci přes více uzlů, přesouvat KV data mezi různými úrovněmi paměti, automaticky škálovat inferenci podle zatížení ap.
Pro Dynamo je, jakožto software Nvidie, trochu neobvyklé, že není určen jen pro hardware Nvidie a zároveň je otevřený. Mohou z něj tedy profitovat i akcelerátory (a obecně hardware používaný pro AI) nezávisle na výrobci. Trochu paradoxní je, že zmíněné akcelerátory Nvidia Rubin CPX, které vypadaly na vlajkovou loď a první zásadní produkt, který bude z platformy Dynamo profitovat, zmizely na jaře z roadmapy Nvidie a co je podstatnější - neobjevily se ani v aktuálních prezentacích na Hot Chips. Již na jaře některé zdroje naznačovaly, že Nvidia tyto plány zrušila nebo odložila na neurčito v souvislosti s akvizicí technologií od společnosti Groq (prosinec 2025), zejména plánu výroby jazykového akcelerátoru LPU - Language Processing Unit (systém s 256 LPU Nvidia označuje jako LPX). Ten chce dostat na trh ještě v letošním roce a evidentně kvůli této prioritě musel Rubin CPX ustoupit. Některé zdroje čtou absenci jediné zmínky o CPX na Hot Chips jako definitivní zrušení, byť se Nvidia k této záležitosti oficiálně nijak nepostavila.
Intel na Hot Chops potvrdil plány s využitím Nvidia dynamo na (Intel)
Aktuální situace je však jasná: Rubin CPX na trhu nebude (buďto vůbec nebo v dohledné době), zatímco Dynamo je plně k dispozici. Tím se dostáváme i k důvodům, proč v kontextu Intelu řešíme hardware a software Nvidie. Intel se totiž rozhodl vzniklé situace využít. Zatímco ještě v pololetí Intel ani nenaznačoval, že by akcelerátory Crescent Island měly být využity jako řešení pro fázi prefill (The Register si ještě 4. června stěžoval, že informace Intelu jsou natolik vágní, že vůbec není jasné, na kterou fázi vlastně Intel cílí), nyní již Intel hovoří jednoznačně o prefillu a využití Nvidia Dynamo. Evidentně chce využít absence CPX a zákazníky, které o tomto řešení uvažovali, stáhnout k sobě.
Oproti prezentaci na Computexu hovoří Intel nyní již jasně o zaměření na prefill fázi inference (Intel)
Problém může být v tom, že fáze prefill sice není příliš závislá na konfiguraci pamětí, takže jí nemusí až tak vadit řádově nižší datová propustnost LPDDR5X oproti HBM4 (ale i násobně nižší než oproti GDDR7, které pro toto nasazení plánovala využít Nvidia). Jenže Crescent Island nebude zrovna drtič ani po výpočetní stránce a lze očekávat zlomek výpočetního výkonu Rubin. Stále však lze předpokládat, že výpočetní výkon Intel Crescent Island oproti Nvidia Rubin bude „jen“ násobně nižší, oproti datové propustnosti, která bude nižší řádově. Celkově tedy lze říct, že z obou fází je pro řešení Intelu vhodnější prefill - na druhou stranu nelze akcelerátor Intelu vnímat jako plnohodnotnou náhradu zrušeného CPX od Nvidie, které podle dostupných informací mělo nabízet výkon násobně vyšší.
Specifikace Crescent Island (Intel)
Prostor pro Intel tedy vznikl, jen je otázkou, jak velký. Nvidia, byť měla připraveno násobně výkonnější řešení pro tento segment, jeho vydání zastavila - zjevně proto, že dostupné výrobní kapacity je schopna využít pro lukrativnější hardware (The Elec již v květnu informoval, že očekávané objednávky PCB a GDDR7 na Nvidia CPX vůbec nebyly realizované, takže Nvidii na skladech ležet nezůstanou; linky na křemík zřejmě budou rozdělené mezi standardní Rubin a LPU, které mají prioritu). Intel má plán, jak z těchto změn profitovat - jak efektivní a úspěšný bude, ale ukáže až čas.
| typ paměti | kapacita | propustnost | L2 cache | |
|---|---|---|---|---|
| AMD Instinct MI455X (CDNA 5) | HBM4 | 432 GB | 23,3 TB/s | 192 MB |
| Nvidia Rubin | HBM4 | 288 GB | 22 TB/s | 128 MB |
| Intel Crescent Island | LPDDR5x | 160 GB 480 GB* | ~1,5 TB/s | 32 MB |
Hot Chips



























