Diit.cz - Novinky a informace o hardware, software a internetu

Diskuse k Staronová GeForce RTX 3060 už je podstatně dražší než rychlejší GeForce RTX 5050

Samozřejmě 3060-12G je dnes za svou cenu zoufalost - pro hráče..
Ale je to evidentně cesta, jak pořídit 12GB VRAM, pokud je nutně potřebuji - a teď pozor,, NE na hraní ....
Je to ten samý případ, jak gamesníci hejtili zprávu, že borec na zakázku upgraduje 2080ti za 11 na 22GB VRAM.
Prostě tohle evidentně na hraní už dávno není..

Příklad, velmi dobrý AI upscaler "Video2X", dosahuje mnohem lepších výsledků na kartách s 12GB, protože tu VRAM prostě potřebuje.
A hrubý výkon karty může být klidně o něco nižší..

3060-12G už zkrátka není za své peníze na hraní si.
Je to zoufalá cesta, jak mít 12G, cena je hrozná. - o 3000 dráž seženu 4070.

Že já blbec to prodal 2 roky zpátky za 4500 :))

+1
0
-1
Je komentář přínosný?

sorry, ale to nedava smysl.. ten 12gb arc je levnejsi nez rtx3060 a ve zpracovani ai videa na urovni o generaci novejsi rtx4060.. naco starou zravou pomalou rtx3060??

https://wp-cdn.pugetsystems.com/2022/08/ARL-S_Topaz_2_fix.png

+1
+3
-1
Je komentář přínosný?

Naprosto souhlasím, ale kolik lidí si koupí ARC a kolik lidí si koupí RTX kartu aniž by vůbec přemýšleli nad tím, jestli je to jako dobře nebo ne. (Ten poměr bude cca 1 ku 100)
Schopnosti ARC v práci enkodérem nikdo nezpochybňuje..

Ale příkladem zmiňovaný "Video2X" není o práci s enkodérem.
Je to lokální AI model přímo využívající TensorCores.

Na Radeonu jede taky, ale přes klasické shadery. (API Vulkan)

+1
+1
-1
Je komentář přínosný?

'' není o práci s enkodérem. ''

ja nikde nepisu o praci s encoderem.. topaz video je ai nastroj na zpracovani videa, podstatne pokrocilejsi nez video2x.. ten je dobrej tak na anime, ale v ostatnim dost zaostava..

+1
+4
-1
Je komentář přínosný?

V pořádku.
Já dal příklad na open source zdarma věc..
Ten Topaz Starlight nemá ARC v recommended ani uvedený.

+1
+1
-1
Je komentář přínosný?

A v-v-v-vo tom to je. Koncák není programátor. Možná by stačil backend přes Vulkan. Ale ono to není ani otestované, že to tam vůbec pojede. Možná by stačilo změnit 2 řádky kódu, ale to by musel tu grafickou kartu a aplikaci/knihovnu mít programátor.

PS: Už desítky let máme věci, které potřebují více kapacitu paměti než výkon čipu. S AI se nám to dostává i do grafických karet.

+1
0
-1
Je komentář přínosný?

jesli je uvedenej nebo ne je egal, kdyz jsem ti hodil link, ze to beha a to na urovni o generaci novejsi rtx4060..

+1
0
-1
Je komentář přínosný?

3060 12gb je sweetspot pre AI rigy. Takych 8 ks uz v pohode rozbehne 2-bitovu kvantizaciu Deepseek v4 flash a 12 ks 3-bitovu. Ale na najvacsich stastlivcov ktori kupovali CMP 170 HX 8 GB po 300 eur a potom ho odblokovali na 64 GB, to nema. Napr. tento s 32 kusmi v 2 TB clustri. https://www.youtube.com/watch?v=KnJMLw7AL38

+1
+1
-1
Je komentář přínosný?

chiplety znejú ako predražovanie a monolit ako ekonomická cesta.

zatiaľ.

pretože hoci zastarávanie hw môže nastávať a cievky a kondenzátory robia mining šarapatu, vykupovanie firmy nvidia svoje výrobky z trhu aby nastali žiadúce influencer QA trhových vlastností, vie asi dodať len zaručený bankrot.

+1
-4
-1
Je komentář přínosný?

Nvidia chystá nové paměti NVHBM, vydala DLSS 4.5 RR, vylepšila GeForce Now, oznámila první hru s RTX Mega Geometry, ale Diit si ze všech aktuálních článků z VideoCardz vybral pro inspiraci zrovna tohle. Proč informovat o něčem novém, když se může potřetí napsat, jak je RTX 3060 nevýhodná. 🤣

+1
-2
-1
Je komentář přínosný?

Třeba někdo nechce tu hlavu z písku vytáhnout :)

+1
-4
-1
Je komentář přínosný?

A zajtra bude top správa, že nV v októbri ""končí s podporou driverov"" pre Win10 ((:
https://www.techpowerup.com/352020/final-nvidia-geforce-game-ready-drive...

+1
-2
-1
Je komentář přínosný?

a jeje, mluvci nVidie zas uraduje.. tak co, vydaj rok a pul slibenej reflex 2?? kdy vydaj rtx5000 super??

'' když se může potřetí napsat, jak je RTX 3060 nevýhodná ''

nemel by ses spis ptat proc nVidie vydava nevyhodnej hardware??

+1
+3
-1
Je komentář přínosný?

1. Jestli jsem mluvčím Nvidie, tak musím být i mluvčím Intelu, MS, Googlu, Applu a dalších firem, u kterých mi vadí, že se o ně na Diit píše většinou jen tehdy, když mají nějaký problém.

2. O nedodaném Reflexu i nejasnostech okolo RTX 5000 Super zde články jsou.

+1
-3
-1
Je komentář přínosný?

Ona ta NV asi nemá důvod to vydávat. Není žádná konkurence co by je někam tlačila

+1
-1
-1
Je komentář přínosný?

Cenotvorba grafik je už dávno totálně odtržená od reality a zdaleka to není jenom ram/vram krizí.

+1
0
-1
Je komentář přínosný?

...co ma tato karta spolecneho z hrama?:-0 ...proc se zminuje z ARCem - ten je konkurentem jen v B60 a vyse A TO JEN V INFERENCI (na uceni jsou ARCy i AMD k nicemu)?:-0 ...proc tomu roste cena (ASI ZE SE NEPRODAVAJI ZE???)

...to je jak Milanfon ...vytahnete si uz hlavu z pr...isku ...je rok 2026 ...hry uz cilovou skupinu co to kupuje FAKT NEZAJIMAJI??? ...tohle je v danem segmenutu UZASNA KARTA A CENA ...pak az 5060 TI z 16GB (ale kde je jejich cena, kupoval jsem je loni pod 10 000)

+1
-4
-1
Je komentář přínosný?

Keď už pod obrázkom je text: "Zdroj: ChatGPT"

Čo tak sa ChatGPT opýtať, aký je rozdiel medzi 8 a 12 GB video ram pri použití lokálnej AI?

ChatGPT said:

Pri lokálnej AI je rozdiel medzi 8 GB a 12 GB VRAM pomerne zásadný. Nie je to len o rýchlosti — hlavne určuje, aké veľké modely môžeš pohodlne spustiť.
Prakticky
VRAM Čo zvládneš
8 GB 7B–8B modely veľmi dobre v 4-bit kvantizácii, menšie modely, základné image AI
12 GB 7B–14B modely podľa kvantizácie, väčšie context window, náročnejšie image/video AI
16 GB+ 14B modely komfortnejšie, niektoré 20B+ v silnej kvantizácii
24 GB 30B–34B modely v 4-bit kvantizácii, oveľa väčší priestor na experimentovanie

Napríklad pri LLM:

8 GB: Llama/Qwen/Mistral okolo 7–8B v 4-bit → úplne použiteľné.
12 GB: môžeš ísť aj do 12–14B modelov, prípadne použiť väčší context.
Pri rovnakom modeli 12 GB karta nebude automaticky 50 % rýchlejšia. Výhoda je predovšetkým v tom, že sa model a jeho KV cache zmestia do VRAM bez odkladania do RAM.

Pri Stable Diffusion / Flux

Tu je 12 GB ešte zaujímavejších. 8 GB môže byť použiteľných, ale pri väčších modeloch a vyššom rozlíšení začneš narážať na nedostatok VRAM. 12 GB poskytuje citeľne väčšiu rezervu a menej kompromisov.
Dôležitá vec

Ak vyberáš grafiku špeciálne na lokálnu AI, ja by som dnes medzi inak podobnými kartami preferoval 12 GB pred 8 GB. Pri lokálnych modeloch je VRAM často limitujúcejšia než samotný výkon GPU.

Ak mi napíšeš konkrétne dve grafické karty, ktoré porovnávaš (napr. RTX 4060 8 GB vs RTX 3060 12 GB), môžem ti povedať, ktorá je lepšia priamo na LLM, Stable Diffusion/Flux a ďalšiu lokálnu AI.

Na lokálne AI je lepšia RTX 3060 12GB alebo RTX 5050 8GB?

Ak je hlavná priorita lokálna AI, z týchto dvoch by som vo väčšine prípadov zobral RTX 3060 12 GB.
RTX 3060 12 GB vs RTX 5050 8 GB
RTX 3060 12 GB RTX 5050 8 GB
VRAM 12 GB 8 GB
AI modely lepšie obmedzenejšie
Väčšie LLM výrazne lepšie horšie
Context/KV cache viac priestoru menej
Stable Diffusion lepšia rezerva OK
Novšia architektúra ❌ ✅
Spotreba vyššia nižšia
Lokálna AI celkovo ⭐⭐⭐⭐⭐ ⭐⭐⭐
Prečo by som vzal 3060

Pri lokálnych LLM je 12 GB VRAM veľmi cenných. RTX 3060 12 GB dokáže napríklad pohodlnejšie držať 7–8B model v GPU a má priestor aj na väčší context. Pri 8 GB karte sa oveľa skôr dostaneš do situácie, keď musíš časť modelu alebo cache presunúť do systémovej RAM, čo môže dramaticky znížiť výkon.

RTX 5050 má síce novšiu architektúru a novšie AI funkcie, ale 8 GB je pri lokálnej AI pomerne tvrdý limit.

Moja voľba: RTX 3060 12 GB, ak:

chceš hlavne Ollama / LM Studio / llama.cpp,
chceš experimentovať s rôznymi LLM,
chceš Stable Diffusion/Flux,
a nevadí ti vyššia spotreba.

RTX 5050 8 GB by som volil skôr vtedy, ak ti ide zároveň o novšiu kartu, nižšiu spotrebu a klasické GPU použitie/hry, pričom lokálna AI je len doplnok.

Ak chceš, môžem ti ešte porovnať koľko FPS/tokenov približne dostaneš pri konkrétnych modeloch (7B, 14B, Qwen, Llama, DeepSeek) na 3060 12 GB vs 5050 8 GB.
You said:

porovnaj
ChatGPT said:

Jasné. Ak porovnávame RTX 3060 12 GB vs RTX 5050 8 GB vyslovene na lokálne LLM, vyzerá to približne takto:
Model RTX 3060 12 GB RTX 5050 8 GB Verdikt
Qwen 7B/8B Q4 🟢 veľmi dobre 🟢 veľmi dobre približne remíza
Llama 8B Q4 🟢 veľmi dobre 🟢 veľmi dobre 5050 môže byť rýchlejšia
Qwen 14B Q4 🟢 áno 🔴 príliš veľké 3060
Llama 14B Q4 🟢 áno 🔴 problém 3060
DeepSeek 14B Q4 🟢 áno 🔴 problém 3060
32B Q4 🟡 s kompromismi 🔴 3060
Veľký context 🟢 viac priestoru 🔴 limit 8 GB 3060
Čo to znamená v praxi

Pri 7–8B modeloch nemusí byť 3060 lepšia. RTX 5050 je novšia karta a v niektorých AI operáciách môže byť rýchlejšia.

Ale keď prejdeš na 14B modely, situácia sa dramaticky zmení:

3060 12 GB → model sa môže celý zmestiť do VRAM.

5050 8 GB → musíš robiť offload do systémovej RAM, prípadne použiť agresívnejšiu kvantizáciu. Výsledkom môže byť podstatne nižšia rýchlosť.

A práve preto by som pri kúpe na lokálnu AI uprednostnil 3060 12 GB.
Približná predstava výkonu

Čísla závisia od konkrétneho runtime, kvantizácie, contextu a CPU, takže ber ich ako orientačné:

7–8B Q4: obe približne v kategórii „rýchle a pohodlné“
14B Q4: 3060 môže byť prakticky použiteľná, 5050 už naráža na VRAM
32B Q4: 3060 je skôr experimentálna možnosť, 5050 už nie je vhodná

Najdôležitejšie je, že 12 GB ti neznamená iba +50 % VRAM. Znamená to, že máš prístup k celej ďalšej kategórii modelov.
A ak ide o Stable Diffusion / Flux

Tam je rozdiel podobný:

3060 12 GB → viac priestoru na väčšie modely, vyššie rozlíšenia a väčší batch.

5050 8 GB → novšia a efektívnejšia, ale 8 GB VRAM ťa bude limitovať.

Za mňa teda:

🧠 Lokálne AI/LLM → RTX 3060 12 GB
🎮 Hry + nižšia spotreba + občasná AI → RTX 5050 8 GB

Ak mi dáš cenu, za ktorú máš každú z nich, môžem ti povedať aj ktorá má lepší pomer €/výkon pre lokálnu AI.

+1
-2
-1
Je komentář přínosný?

Klasickej AI blábol zadarmo, kterej není podloženej vůbec ničim a pokud se začnou rozebírt jednotlivá tvrzení, atk se může zjistit že je to právě naopak. Za mě je tahle tapeta naprosto zbytečná s 0 informační hodnotou.

+1
-1
-1
Je komentář přínosný?

Ty ses regulerne zblaznil? Ano, vygenerovala mu to AI. Ale ty informace jsou tam naprosto spravne??? Ta karta je to nejlepsi co si dnes pro lokalni modely muzes poridit. Pokud nemiris na 16GB a vyse. Neni podlozene nicim? Jen potvrzujes ze se vyjadrujes k necemu, cemu nerozumis? Proc to delas?

+1
-1
-1
Je komentář přínosný?

"""Ta karta je to nejlepsi co si dnes pro lokalni modely muzes poridit."""

No hlavně že si to přečetli ti, co nechápou na co se ta karta zase prodává...
Třeba i za takovou vysmívanou 4060ti-16G by možná dnes někteří dali i slušný balík.

+1
+1
-1
Je komentář přínosný?

...presne tak, staci se podivat po bazarech ...dnes je dulezita JEN VRAM, nic jineho ...napr. 4090 nejsou uz ani v cloudech jsou plne rezervovane, musis jit na 3090, nebo pak uz na 5tkove rady nebo profi rady ...ale nadoma? ...ta karta je skvela i za tu cenu! ...ale jak jsem psal, pokud nemiris uz na modely na 16GB a vyse (sam budu prechazet z 16GB na 24GB a to je taky pain)

+1
0
-1
Je komentář přínosný?

na reddite odporucali tento eshop pre GPU s velkou VRAM. maju tam napr:
2080ti 22GB za 427$ (od 2 kusov) + posta 50$ za 2 kusy + DPH. https://aliiphone.m.en.alibaba.com/collection_product/2080ti/1.html
3080 20GB za 555$ https://aliiphone.m.en.alibaba.com/search/product?SearchText=3080
V100 32GB za 648$ https://www.alibaba.com/product-detail/Customized-V100-SXM2-to-Pcie-Grap...
V100 16GB za 219$ https://www.alibaba.com/product-detail/Good-Price-V100-Graphics-Card-HBM...
Mi50 16GB je za 133$, ma bios z Radeon VII ale vykon ma ako RX6800 takze nic moc. https://www.alibaba.com/product-detail/Fan-Cooling-Radeon-Instinct-MI50-...

+1
0
-1
Je komentář přínosný?

...dekuji kouknu!
p.s ...V100 nebrat ...chlazeni se da poresit, jsou za hubicku, supr VRAM, ale Volta architectura, nove veci uz nejedou

+1
0
-1
Je komentář přínosný?

Za koľko sa dnes dá kúpiť RTX 3060 12 GB?

+1
-1
-1
Je komentář přínosný?

Tak to si z nas uz ozaj robia zadnicu......

+1
-1
-1
Je komentář přínosný?

Asi úplně ne, jen neznáš všechny souvislosti.

+1
+2
-1
Je komentář přínosný?

OT: Nvidii uniklo DLSS5, moddeři už to naroubovali na první hry. Tady velká ukázka v Controlu. Výkon do na RTX 5070 Ti ve 4K shodilo na polovinu. Je tam několik presetů ovlivňujících podobu Jesse. Přijde mi to dost uncanny valley. Najednou může být obličej jako na videu, ale pak tomu neodpovédají ty strnulé animace.
https://www.youtube.com/watch?v=hFIpT2he2DE

Ještě výraznější je to ve Skyrimu, který prostě ten věk nezapře.
https://www.youtube.com/watch?v=hzeWfqP6N5Q

+1
+1
-1
Je komentář přínosný?

Nyní i RTX 4000 Lovelace kartách..
Pecka..
O tomhle by měl být další článek :)

https://www.techpowerup.com/352086/dlss-5-patched-to-work-on-rtx-4000-ad...

+1
-1
-1
Je komentář přínosný?

Pro psaní komentářů se, prosím, přihlaste nebo registrujte.