Diit.cz - Novinky a informace o hardware, software a internetu

Intel s akcelerátory Crescent Island spoléhá na software Nvidia Dynamo

Zdroj: Intel

Intel představil podrobnější plány s AI akcelerátory Crescent Island, které vzešly z GPU architektury Xe3P, původně označované jako Celestial. Zajímavé je, že Nvidia Intelu vlastně vyšlapala cestu…

Intel mluvil o akcelerátorech Crescent Island koncem jara na letošním Computexu. Nejde o výkonné HBM akcelerátory, které současný šéf Intelu Lip-Bu Tan odsunul na druhou kolej, ale snaha zachytit se v segmentu inference (použití AI modelů, nikoli jejich trénování), kde se lze uplatnit i s méně ambiciózním hardwarem. Intel již na Computexu nastínil, že ani inference v plné šíři nebude jeho primární cíl, ale že využije možnosti rozdělení zátěže mezi různá hardwarová řešení. Šlo o skutečnost, že inference se skládá ze dvou fází, z nichž každá má významně odlišné hardwarové nároky. Fáze prefill je náročná na výpočetní výkon a fáze decode je náročná na paměť a datové přesuny.

Architektura Xe3P (dříve též Celestial) si odbude premiéru v segmentu AI akcelerace (Intel)

To je v tomto kontextu velmi důležitý fakt, neboť Nvidia původně plánovala těchto vlastností využít a nabídnout zákazníkům možnost rozdělení inference tak, aby fázi prefill zpracovávaly levnější akcelerátory vybavené GDDR7 pamětmi (tzv. CPX), zatímco pouze fáze decode by probíhala na nejdražších akcelerátorech s HBM4. Aby toto mohlo fungovat bez potřeby zásahů uživatele, připravila Nvidia softwarovou vrstvu nazvanou Dynamo. Ta může rozdělovat prefill a decode na různé akcelerátory, směrovat požadavky podle toho, kde je relevantní KV cache (Key-Value cache, data uložená např. v paměti akcelerátoru), koordinovat inferenci přes více uzlů, přesouvat KV data mezi různými úrovněmi paměti, automaticky škálovat inferenci podle zatížení ap.

Pro Dynamo je, jakožto software Nvidie, trochu neobvyklé, že není určen jen pro hardware Nvidie a zároveň je otevřený. Mohou z něj tedy profitovat i akcelerátory (a obecně hardware používaný pro AI) nezávisle na výrobci. Trochu paradoxní je, že zmíněné akcelerátory Nvidia Rubin CPX, které vypadaly na vlajkovou loď a první zásadní produkt, který bude z platformy Dynamo profitovat, zmizely na jaře z roadmapy Nvidie a co je podstatnější - neobjevily se ani v aktuálních prezentacích na Hot Chips. Již na jaře některé zdroje naznačovaly, že Nvidia tyto plány zrušila nebo odložila na neurčito v souvislosti s akvizicí technologií od společnosti Groq (prosinec 2025), zejména plánu výroby jazykového akcelerátoru LPU - Language Processing Unit (systém s 256 LPU Nvidia označuje jako LPX). Ten chce dostat na trh ještě v letošním roce a evidentně kvůli této prioritě musel Rubin CPX ustoupit. Některé zdroje čtou absenci jediné zmínky o CPX na Hot Chips jako definitivní zrušení, byť se Nvidia k této záležitosti oficiálně nijak nepostavila.

Intel na Hot Chops potvrdil plány s využitím Nvidia dynamo na (Intel)

Aktuální situace je však jasná: Rubin CPX na trhu nebude (buďto vůbec nebo v dohledné době), zatímco Dynamo je plně k dispozici. Tím se dostáváme i k důvodům, proč v kontextu Intelu řešíme hardware a software Nvidie. Intel se totiž rozhodl vzniklé situace využít. Zatímco ještě v pololetí Intel ani nenaznačoval, že by akcelerátory Crescent Island měly být využity jako řešení pro fázi prefill (The Register si ještě 4. června stěžoval, že informace Intelu jsou natolik vágní, že vůbec není jasné, na kterou fázi vlastně Intel cílí), nyní již Intel hovoří jednoznačně o prefillu a využití Nvidia Dynamo. Evidentně chce využít absence CPX a zákazníky, které o tomto řešení uvažovali, stáhnout k sobě.

Oproti prezentaci na Computexu hovoří Intel nyní již jasně o zaměření na prefill fázi inference (Intel)

Problém může být v tom, že fáze prefill sice není příliš závislá na konfiguraci pamětí, takže jí nemusí až tak vadit řádově nižší datová propustnost LPDDR5X oproti HBM4 (ale i násobně nižší než oproti GDDR7, které pro toto nasazení plánovala využít Nvidia). Jenže Crescent Island nebude zrovna drtič ani po výpočetní stránce a lze očekávat zlomek výpočetního výkonu Rubin. Stále však lze předpokládat, že výpočetní výkon Intel Crescent Island oproti Nvidia Rubin bude „jen“ násobně nižší, oproti datové propustnosti, která bude nižší řádově. Celkově tedy lze říct, že z obou fází je pro řešení Intelu vhodnější prefill - na druhou stranu nelze akcelerátor Intelu vnímat jako plnohodnotnou náhradu zrušeného CPX od Nvidie, které podle dostupných informací mělo nabízet výkon násobně vyšší.

Specifikace Crescent Island (Intel)

Prostor pro Intel tedy vznikl, jen je otázkou, jak velký. Nvidia, byť měla připraveno násobně výkonnější řešení pro tento segment, jeho vydání zastavila - zjevně proto, že dostupné výrobní kapacity je schopna využít pro lukrativnější hardware (The Elec již v květnu informoval, že očekávané objednávky PCB a GDDR7 na Nvidia CPX vůbec nebyly realizované, takže Nvidii na skladech ležet nezůstanou; linky na křemík zřejmě budou rozdělené mezi standardní Rubin a LPU, které mají prioritu). Intel má plán, jak z těchto změn profitovat - jak efektivní a úspěšný bude, ale ukáže až čas.

 typ pamětikapacitapropustnostL2 cache
AMD Instinct MI455X (CDNA 5)HBM4432 GB23,3 TB/s192 MB
Nvidia RubinHBM4288 GB22 TB/s128 MB
Intel Crescent IslandLPDDR5x160 GB
480 GB*
~1,5 TB/s32 MB
Zdroje: 

Hot Chips

Diskuse ke článku Intel s akcelerátory Crescent Island spoléhá na software Nvidia Dynamo

Pondělí, 31 Srpen 2026 - 09:14 | KristenM | Z pohledu ISO 9001 / 17025 se AI nebere jako...
Čtvrtek, 27 Srpen 2026 - 08:37 | hifron | ak je prebytok programátorov a hirujú sa juniori...
Čtvrtek, 27 Srpen 2026 - 05:35 | Ladis | Je to podobné, jako když senior vývojář má...
Čtvrtek, 27 Srpen 2026 - 01:04 | waleed | Člověk udělá chybu a buď jí napravý a nebo...
Středa, 26 Srpen 2026 - 17:21 | Ladis | Ano, používáme nedokonalé lidi 🥴
Středa, 26 Srpen 2026 - 17:08 | Kubrak | Doufam, ze nedelate SW, ktery neco primo ridi.
Středa, 26 Srpen 2026 - 16:25 | Ladis | Ona tím nějaká disponuje 🤔 Jinak i zaškolení lidé...
Středa, 26 Srpen 2026 - 16:24 | Lazar | Jak se na zařazování AI do procesů/výsledků...
Středa, 26 Srpen 2026 - 15:24 | Ladis | My už takhle máme jeden server s GPUčkama. Ale...
Středa, 26 Srpen 2026 - 13:36 | Michal Lazo | Tak presuvame do fazy lokalnho LLM najprv to bude...

Zobrazit diskusi