Kentino · Vlastný server s umelou inteligenciou

NVIDIA L4 24 GB GDDR6 — nízkoprofilová pasívna pamäť

Platforma podnikovej triedy, zostavená a testovaná v EÚ.

€2.657,42bez DPH · poštovné sa vypočíta pri platbe
Skladom — odosiela sa zo skladu v EÚ
ISO 9001 · overený hardvérSklad a záruka v EÚ7+ rokov skúseností v oblasti podnikovej umelej inteligenciePred odoslaním testované zapálením
Prehľad
Doprava a záruka
Ada Lovelace · 24 GB · 72 W · Nízky profil

NVIDIA L4 24 GB — inferenčná karta s výkonom 72 W

Jednoslotová, nízkoprofilová, pasívne chladená grafická karta pre dátové centrá, ktorá odoberá iba 72 W priamo zo slotu PCIe – bez napájacieho kábla, bez dodatočného prúdenia vzduchu. Najhustejší spôsob, ako pridať serveru 24 GB inferenčnej kapacity.

24 GB
Pamäť GDDR6 ECC VRAM
7,680
CUDA jadrá
72 W
Napájanie z drážky
1 štrbina
Nízky profil, pasívny
Prehľad

Hustota a účinnosť, nie maximálna priepustnosť

Karta L4 je postavená na inom princípe ako veľké akceleračné karty: výkon na watt a na slot. Pri 72 W nepotrebuje žiadny dodatočný napájací konektor a keďže je nízkoprofilová s jedným slotom, hodí sa do šasi, ktoré fyzicky nedokážu prijať kartu plnej výšky. Táto kombinácia z nej robí praktickú voľbu na zhromažďovanie mnohých nezávislých inferenčných úloh do jedného servera alebo na pridanie schopnej akcelerácie umelou inteligenciou do kompaktných a edge systémov, kde sú obmedzeniami výkon a priestor. Je to tiež silná grafická karta – hardvérové ​​kódovanie a dekódovanie vrátane AV1 – vďaka čomu je častou voľbou pre transkódovanie spolu s inferenciou.

technické údaje

Technické údaje

GPU NVIDIA AD104 — Ada Lovelace
Objednávacie číslo TCSL4PCIE-PB
Memory Masážne stoly 24 GB GDDR6 s ECC
Šírka pásma pamäte ~ 300 GB / s
CUDA jadrá 7,680
Tenzorové jadrá 240 (4. generácia) · ~2 000 TOPS INT8
RT jadrá 60 (3. generácia)
Rozhranie PCIe 4.0 ×16
Napájanie dosky 72 W – odoberané zo slotu, bez napájacieho konektora
Tvarový faktor Jednodrážkový, nízky profil, plná dĺžka
Chladenie Pasívne – vyžaduje prúdenie vzduchu z šasi
Výstupy displeja Žiadne – iba výpočet
Video enginy Hardvérové ​​kódovanie/dekódovanie vrátane AV1
Záruka 36 mesiacov
Najlepšie pre

Kam sa to hodí

  • Pre malé a stredne veľké modely – 24 GB pohodlne pojme kvantizovaný model s kapacitou 7B–13B.
  • Inferenčné servery s viacerými grafickými procesormi: pri 72 W na kartu ich môžete osadiť viacero bez nutnosti prestavby napájania alebo chladenia.
  • Nízkoprofilové a kompaktné šasi, ktoré nepojme dvojslotovú kartu plnej výšky.
  • Kanál pre prekódovanie videa vrátane AV1 spolu s inferenciou na tej istej karte.
  • Nasadenia na okraji siete a lokálne nasadenia s obmedzením celkovej spotreby energie.
L4 je karta zameraná na kapacitu a efektivitu, nie na priepustnosť. Pre náročné dolaďovanie, prácu s veľkými modelmi alebo maximálny počet tokenov za sekundu je lepšou voľbou RTX PRO 6000 alebo zostava s viacerými GPU – povedzte nám pracovnú záťaž a my vás nasmerujeme na tú správnu.
otázky

Často kladené otázky

Potrebuje napájací kábel?

Nie. Celá karta beží v rámci 75 W rozpočtu PCIe slotu, takže nie je potrebné viesť žiadny 8-pinový ani 12-pinový konektor. To je veľká časť jej príťažlivosti v hustých zostavách – úplne eliminuje potrebu káblov zdroja ako obmedzenia.

Ochladí sa to samo?

Nie. Rovnako ako iné karty pre dátové centrá je aj táto pasívna a spolieha sa na prúdenie vzduchu v šasi. V serveri so správnym prúdením vzduchu spredu dozadu je to ideálne; v tichej stolovej skrini sa prehreje. Ak si nie ste istí svojou šasi, opýtajte sa nás.

Aké veľkosti modelov sa hodia do 24 GB?

Kvantovaný model 7B–13B zapadá do kontextu. Model 70B nie – ten potrebuje zhruba 40 GB pri 4 bitoch, takže radšej zvážte kartu s 96 GB alebo konfiguráciu s viacerými grafickými procesormi.

Ako sa to porovnáva s L40?

L40 má 48 GB a oveľa viac výpočtovej pamäte, s príkonom okolo 300 W a plnohodnotným dvojslotovým formátom. L4 vymieňa túto priepustnosť za 72 W, jeden slot a nízky profil. Vyberte si L4, keď o zostave rozhoduje výkon a hustota, a L40, keď potrebujete výkon.

Môžem ich umiestniť viacero na jeden server?

Áno, a práve tu je L4 v najlepšej forme – niekoľko kariet s výkonom 72 W sa drží v rámci rozpočtov, čo by s vysokovýkonnými GPU nebolo možné. Kentino stavia viacúrovňové inferenčné servery, ak si radšej kúpite hotový stroj.

Aká je dodacia lehota?

Dodanie na objednávku, zvyčajne 10 – 21 dní. Pred plánovaním termínu nás požiadajte o potvrdenie aktuálnej dostupnosti.

Chcete to v hotovom stroji? Kentino zostavuje, testuje a uvádza do prevádzky viacúrovňové inferenčné servery – požiadajte nás o nakonfigurovanú zostavu.

Odosielame z nášho skladu v EÚ. Ťažké položky môžu vyžadovať prepravu – kontaktujte nás pre cenovú ponuku na prepravu a dodaciu lehotu. 2-ročná obmedzená záruka s rozšírenou podporou RMA; k dispozícii je predĺžená záruka.

Nie je to presne to, čo potrebujete?

Povedzte nám o vašej pracovnej záťaži a my túto platformu prispôsobíme jej špecifikáciám – grafické karty, pamäť, úložisko a chladenie zodpovedajú tomu, čo skutočne používate.