Inferencia 70B L40 Ai server
Inferencia 70B L40 Ai server
Inferencia 70B L40 Ai server
Inferencia 70B L40 Ai server
Inferencia 70B L40 Ai server
Kentino · Vlastný server s umelou inteligenciou

Inferencia 70B L40 Ai server

Platforma podnikovej triedy, zostavená a testovaná v EÚ.

€44.214,00 bez DPH · poštovné sa vypočíta pri platbe
Skladom — odosiela sa zo skladu v EÚ
ISO 9001 · overený hardvérSklad a záruka v EÚ7+ rokov skúseností v oblasti podnikovej umelej inteligenciePred odoslaním testované zapálením
Prehľad
Často kladené otázky
Doprava a záruka

Tento zoznam produktov slúži len na referenčné účely.

Tento server bol nahradený novou produktovou radou Kentino AI . Aktuálny ekvivalent alebo vylepšenú konfiguráciu nájdete v našej kolekcii serverov AI.

Odporúčaná náhrada: Kentino AI 192 Rome L40 1448TOPS (4x NVIDIA L40, rovnaká platforma, aktualizovaná zostava)

Počítač 70B L40

technické údaje

  • GPU: 6x NVIDIA L40 (celkom 288 GB VRAM)
  • Základná doska: ASRock Rack ROMED8-2T
  • CPU: AMD EPYC 7542
  • RAM: 512 GB SK Hynix 2666 MHz REG ECC DDR4 LRDIMM (8 x 64 GB)
  • Pripojenie GPU k základnej doske: Kábel RYSER PCIe 4.0 x16
  • Zdroj: 2x AX1600i 1000W
  • Vec: Montážna konzola 4U
  • Skladovanie:
    • 2TB NVMe SSD
    • 500 GB SATA disk

kľúčové vlastnosti

  1. Vysokovýkonný GPU Compute: Vybavený 6 GPU NVIDIA L40, ktoré poskytujú celkovo 288 GB VRAM pre náročné úlohy AI, strojového učenia a vizualizácie.
  2. Komponenty serverovej triedy: Obsahuje spoľahlivú základnú dosku ASRock Rack ROMED8-2T a výkonný procesor AMD EPYC 7542 pre výnimočné možnosti spracovania.
  3. Dostatok pamäte: 512 GB vysokorýchlostnej pamäte SK Hynix DDR4 RAM zaisťuje plynulý multitasking a efektívne spracovanie dát pre komplexné výpočty.
  4. Vysokorýchlostná integrácia GPU: Využíva kábel RYSER PCIe 4.0 x16 na rýchle pripojenie s plnou šírkou pásma medzi GPU a základnou doskou, čo zaisťuje optimálny výkon a rýchlosť prenosu dát.
  5. Robustný napájací zdroj: Duálne jednotky AX1600i 1000 W poskytujú stabilné a dostatočné napájanie na podporu vysokovýkonných komponentov pri veľkom zaťažení.
  6. Rozšíriteľné úložisko: Dodáva sa s rýchlym 2TB NVMe SSD pre primárne úložisko a dodatočným 500 GB SATA diskom pre extra kapacitu.
  7. Profesionálne chladenie: Umiestnené v priestrannej 24U skrinke pre montáž do racku, ktorá poskytuje optimálne prúdenie vzduchu a tepelné riadenie pre trvalú vysokovýkonnú prevádzku.
  8. Všestranná konfigurácia: Navrhnuté pre širokú škálu vysokovýkonných výpočtových úloh, od AI a strojového učenia až po profesionálnu vizualizáciu a vykresľovanie.

Ideálne prípady použitia

  • Vyvodenie veľkého jazykového modelu (napr. modely s parametrami 70B)
  • Výskum AI a strojového učenia
  • Analýza a vizualizácia údajov
  • Profesionálne 3D vykresľovanie a animácie
  • Vedecké simulácie
  • High-Performance Computing (HPC) aplikácie
  • Počítačové videnie a spracovanie obrazu
  • Finančné modelovanie a analýza rizika

Osobitné poznámky

  • Optimalizované pre 70B modely: S 288 GB celkovej GPU VRAM je tento systém špeciálne navrhnutý na spracovanie veľkých jazykových modelov s až 70 miliardami parametrov, vďaka čomu je ideálny pre špičkový výskum a aplikácie AI.
  • Výhoda NVIDIA L40: GPU L40 ponúkajú rovnováhu medzi výpočtovým výkonom a pamäťou, vhodné pre širokú škálu úloh AI, HPC a profesionálnej vizualizácie.
  • Výkon PCIe 4.0: Kábel RYSER PCIe 4.0 x16 zaisťuje, že každý GPU môže pracovať s plnou šírkou pásma, čím sa maximalizuje priepustnosť dát a minimalizuje sa oneskorenie.
  • Škálovateľný dizajn: Aj keď je tento systém optimalizovaný pre modely s parametrami 70B, možno ho jednoducho škálovať alebo zoskupiť pre ešte väčšie pracovné zaťaženie alebo prostredia s viacerými používateľmi.

Počítač 70B L40 predstavuje výkonné a všestranné riešenie pre organizácie a výskumníkov pracujúcich s veľkými modelmi AI, najmä v oblasti spracovania a generovania prirodzeného jazyka. Vďaka vyváženej konfigurácii GPU NVIDIA L40, CPU AMD EPYC a vysokorýchlostnej pamäti je vhodný pre širokú škálu vysokovýkonných výpočtových úloh nad rámec AI, vrátane vedeckých simulácií, analýzy údajov a profesionálnej vizualizácie.

Dodanie 2-6 týždňov 

Otázky, ktoré nám kupujúci kladú najčastejšie pred objednaním servera.

Ako dlho to trvá?

Stroje vyrobené z komponentov, ktoré máme pripravené, expedujeme rýchlo; čokoľvek, čo vyžaduje konkrétnu generáciu GPU, závisí od dodávok. Pred zaplatením vám oznámime dátum a ak sa dodávka zmení, oznámime vám to, namiesto toho, aby ste sa o tom dozvedeli.

Dá sa konfigurácia zmeniť pred zostavením?

Takmer vždy. Grafické karty, pamäť, úložisko a chladenie sa vyberajú pre každú objednávku a uvedená konfigurácia je skôr východiskovým bodom ako fixným balíkom. Ak potrebujete viac VRAM, rýchlejšie úložisko alebo iný prístup k chladeniu, oznámte to pred objednaním a my vám poskytneme cenovú ponuku.

Môžem si server vyzdvihnúť osobne?

Môžete. Náš sklad sa nachádza v Prahe a osobný odber je vítaný – väčšina ľudí, ktorí prídu, využije návštevu na to, aby si s naším technikom prezreli stroj a položili otázky, ktoré sú cez e-mail nepríjemné. V prípade objednávok v rámci Českej republiky sa tiež snažíme doručiť osobne a sprevádzať vás nastavením na mieste.

Môžem sa porozprávať s niekým, kto skutočne rozumie pracovnej záťaži?

Áno. Máme inžiniera, ktorý pracuje konkrétne na systémoch umelej inteligencie, nie na všeobecnom predajnom oddelení. Ak sa vaša otázka týka veľkosti dávok, kvantizácie, prepojení alebo toho, kde bude vaše úzke miesto, opýtajte sa – takýto rozhovor zvyčajne zmení konfiguráciu k lepšiemu.

Ktorý model môžem spustiť na tejto konfigurácii?

Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.

Ako otestujete server pred odoslaním?

Porovnávame ho so skutočnými záťažami umelej inteligencie, a nie so syntetickými skóre: inferenčná priepustnosť, trvalé správanie pri záťaži a teploty pri nepretržitej prevádzke. Výsledky benchmarkov získate so strojom, takže výkon, ktorý vám bol sľúbený, je výkon, ktorý si môžete overiť hneď v prvý deň.

Je server pripravený na spustenie, keď dorazí?

Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.

Odosielame z nášho skladu v EÚ. Ťažké položky môžu vyžadovať prepravu – kontaktujte nás pre cenovú ponuku na prepravu a dodaciu lehotu. 2-ročná obmedzená záruka s rozšírenou podporou RMA; k dispozícii je predĺžená záruka.

Nie je to presne to, čo potrebujete?

Povedzte nám o vašej pracovnej záťaži a my túto platformu prispôsobíme jej špecifikáciám – grafické karty, pamäť, úložisko a chladenie zodpovedajú tomu, čo skutočne používate.