AI vo vašom PC nie je len softvér – je to tepelná bomba. Ako ju skrotiť?

AI vo vašom PC nie je len softvér – je to tepelná bomba. Ako ju skrotiť?
Ilustračné foto: vytvorené umelou inteligenciou (AZOIA)

Vaša grafická karta sa práve prehrieva a ventilátory znejú ako vzlietajúci Boeing 747.

Nie, nehráte najnovší AAA titul — len ste spustili lokálny model umelej inteligencie. Toto je realita, ktorú pozná každý, kto skúsil „rozbehať“ moderný jazykový model na vlastnom hardvéri. A práve táto scéna je dôvodom, prečo je téma chladenia a spotreby pri AI záťaži kritická.

Prečo je AI záťaž špecifická?

AI modely netlačia na grafickú kartu ako hry. Pri hraní sa záťaž rozkladá na krátke, intenzívne špičky. Pri AI inferencii (výpočte odpovede) je záťaž konštantná a extrémna — GPU beží na 100 % výkonu desiatky minút až hodiny. To znamená, že sa nestíha ochladzovať ani počas „oddychu“ medzi snímkami.

Kľúčový rozdiel: pri hrách je priemerná spotreba okolo 60 – 70 % maxima, pri AI trénovaní či generovaní dlhých odpovedí sa drží na 95 – 100 % počas celej doby výpočtu. Teploty tak rastú o 10 – 15 °C oproti hernej záťaži a chladič, ktorý zvládal hry bez problémov, sa dostáva na hranicu tepelného škrtiaceho prahu (thermal throttling).

Reálne čísla: čo môžete očakávať?

Merania na súčasných kartách ukazujú jasný obraz:

  • NVIDIA RTX 4090 pri lokálnom behu modelu Llama 3 70B: spotreba 450 W (limit karty), teplota jadra 84 °C, teplota pamäte GDDR6X až 104 °C (hraničná hodnota!)
  • RTX 4080 Super pri modeli Mistral 7B: spotreba 320 W, teplota 78 °C, ale ventilátory na 85 % otáčok — hlučnosť 45 dB
  • AMD RX 7900 XTX pri Stable Diffusion XL: spotreba 355 W, teplota hotspotu 96 °C — pozor, AMD udáva limit 110 °C, ale dlhodobý beh pri 95+ °C výrazne skracuje životnosť

Pasca číslo jedna: výrobcovia udávajú „typickú hernú spotrebu“. Pri AI záťaži počítajte s +20 % navrch oproti hernému TDP. Napríklad RTX 4070 má herný limit 200 W, ale pri AI inferencii drží svojich 200 W nepretržite (limit je softvérovo posunutý).

Softvérové riešenia: kde hľadať úspory

Než siahnete po vodnom chladení, skúste optimalizáciu. Moderné frameworky (rámce) ponúkajú nástroje, ktoré výrazne znížia záťaž:

  • Kvantizácia modelu (zníženie presnosti váh z FP16 na INT8 alebo INT4) zníži spotrebu o 30 – 40 % pri minimálnej strate kvality výstupu. Model Llama 3 8B v kvantizácii INT4 žerie 65 W namiesto 110 W.
  • Batch processing (dávkové spracovanie) — namiesto jednej požiadavky posielajte viac naraz. GPU sa efektívnejšie využije a priemerná spotreba na jednu odpoveď klesne o 50 %.
  • Ovládačové limity — v MSI Afterburner alebo AMD Software nastavte power limit na 80 %. Výkon klesne len o 5 – 8 %, ale spotreba a teplota klesnú dramaticky (napr. RTX 4090: z 450 W na 360 W, teplota z 84 °C na 72 °C).

Hardvérové riešenia: čo naozaj funguje

Ak máte grafickú kartu s referenčným chladičom (blower), pri AI záťaži sa pripravte na teploty 88 – 92 °C a hlučnosť nad 50 dB. Odporúčané riešenia:

  • Vodné chladenie AIO (all-in-one) s 240 mm radiátorom zníži teploty o 20 – 25 °C oproti referenčnému chladiču. Cena: 150 – 250 €.
  • Kvalitné vzduchové chladenie (napr. modely s tromi ventilátormi) — teploty o 10 – 15 °C nižšie, hlučnosť do 40 dB. Cena: príplatok oproti referenčnej verzii karty — samostatne sa taký chladič nepredáva.
  • Pretlaková skriňa — dôležitejšia, než si myslíte. AI záťaž ohrieva celý priestor, preto zabezpečte prívod studeného vzduchu k zadnej časti karty. Nedostatok prívodu = +10 °C na GPU.

Pasca číslo dva: teplota pamätí. Grafické karty s GDDR6X pamäťami (RTX 4080/4090) majú pri AI záťaži pamäte teplejšie ako jadro. Ak teplota pamäte presiahne 105 °C (TJmax pamätí GDDR6X), karta začne znižovať takty; k okamžitému poškodeniu nedochádza, ale dlhodobý beh nad 100 °C skracuje životnosť. Riešenie: teplovodivé podložky (thermal pads) na pamäťových moduloch — upgrade za 20 €, ktorý zníži teplotu o 8 – 12 °C.

Skryté náklady: spotreba elektriny

Lokálny AI model nie je len o výkone, ale aj o účte za elektrinu. Prepočet pre RTX 4090 pri dennom používaní 4 hodiny:

  • Spotreba: 1,8 kWh/deň (450 W × 4 h)
  • Mesačne: 54 kWh
  • Pri cene 0,20 €/kWh: 10,80 €/mesiac len za grafickú kartu

Pridajte spotrebu zvyšku systému (300 – 400 W) a dostanete sa na 20 – 25 €/mesiac. Ročne to je 240 – 300 €. Pri cloudovom riešení (napr. API za 0,005 €/1 000 tokenov) zaplatíte za rovnaký objem výpočtov 15 – 20 € mesačne — cloud je pre občasné použitie výrazne lacnejší.

Čo si vybrať: praktické odporúčania

Použitie Odporúčanie Prečo
Občasné experimenty (1 – 2 h denne) Cloudové API Lacnejšie, žiadny hardvér
Pravidelné generovanie (4 + h denne) GPU s výkonným chladičom Návratnosť do 6 mesiacov
Tréning vlastných modelov Vodné chladenie + power limit Dlhodobá stabilita

Verdikt: chladenie je investícia, nie rozmar

AI záťaž je pre grafické karty to, čo je maratón pre šprintéra — zvládnu to, ale za cenu extrémneho zaťaženia. Ak plánujete lokálne AI vážnejšie, počítajte s príplatkom 200 – 300 € za kvalitné chladenie. Ak nie, cloud je racionálnejšia voľba. Jedno je isté: ignorovať teploty pri AI záťaži znamená skracovať jej životnosť: pri bežných 40 – 70 °C vydrží čip 7 – 10 rokov, pri trvalých teplotách nad 85 °C klesá odhad na 3 – 5 rokov — a čeliť účtom za elektrinu, ktoré vás prekvapia. Merajte, optimalizujte a hlavne — nespoliehajte sa na herné benchmarky.