Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik
Kentino · Strežnik z umetno inteligenco po meri

Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS — 6× RTX Pro 6000 Blackwell Max-Q AI Frontier strežnik

Platforma poslovnega razreda, sestavljena in preizkušena v EU.

€110.023,00 brez DDV · poštnina se obračuna ob zaključku nakupa
Na zalogi — pošiljamo iz skladišča EU
ISO 9001 · preverjena strojna opremaSkladišče in garancija v EU7+ let izkušenj na področju umetne inteligence v podjetjihPred odpremo je bil preizkušen vžig
Pregled
FAQ
Dostava in garancija

Kentino AI 576 Genoa RTXPro6000MQ 12000TOPS

576 GB ECC VRAM-a Frontier Server
6x RTX Pro 6000 Max-Q turboventilatorska | EPYC Genoa | 12 000 TOPS INT8

12 000
VRHOVI INT8
576 GB
Nabor ECC VRAM-a
Gen5
Broadcom stikalo
Mirna
hlajenje turboventilatorja

Objavljene zunanje reference. Ni bilo izmerjeno na strojni opremi Kentino.

7U platforma za sklepanje na vodilni ravni za montažo v rack s šestimi grafičnimi karticami NVIDIA RTX Pro 6000 Blackwell Max-Q turbofan, združenimi v 576 GB ECC VRAM-a, enim procesorjem AMD EPYC 9354 Genoa (32C/64T), 768 GB DDR5-4800 ECC (vseh 12 kanalov zasedenih), 4 TB zagonskim NVMe in 5x 1200 W strežniškim napajalnikom. Isti silicijev in pomnilniški bazen kot pri pasivni različici Server Edition – drugačen hladilnik. Max-Q turbofan je samostojen za vsako kartico, deluje tišje in prenaša manj strog pretok zraka v ohišju. Enako ohišje modela kot pri pasivni različici.

strojna oprema

Sestavina podrobnost
Grafične kartice 6x NVIDIA RTX Pro 6000 Blackwell Max-Q 96 GB ECC (turboventilatorski ventilator, specifikacija 600 W TDP, PCIe 5.0 x16, 2000 INT8 TOPS na kartico)
VRAM bazen Skupaj 576 GB na 6 karticah (brez NVLinka — P2P prek PCIe Gen5 s hitrostjo ~55–60 GB/s na smer)
CPU AMD EPYC 9354 Genoa (32C/64T, 280 W, 128x PCIe 5.0 pasov, 12-kanalni DDR5)
Matično ASRock Rack GENOAD8X-2T/BCM (SP5 Genoa, integrirano stikalo Broadcom PEX PCIe Gen5, 12x DDR5, 2x 10 GbE, IPMI)
Sistemski RAM 768 GB DDR5-4800 ECC RDIMM (12 x 64 GB — vsi kanali zasedeni, skupno ~460 GB/s)
Zagon / shranjevanje 4 TB NVMe M.2 (PCIe 4.0 x4) – dimenzioniran za namestitev na mejne kontrolne točke
Napajanje 5x 1200 W strežniških napajalnikov (združljivih s HP, skupno 6 kW)
podvozje 7U 8-GPU vgradni nosilec za rack, kapaciteta 10 rež PCIe, aktivni razširitveni moduli Gen5
Hlajenje Stolpni hladilnik SP5 Genoa + 8x 120 mm ventilatorjev za ohišje. Turbo ventilatorji za vsak grafični procesor so samostojni – pretok zraka v podatkovnih centrih je priporočljiv, vendar ni nujno potreben. Tišji za laboratorijska okolja.
mreža Vgrajen dvojni 10 GbE (Intel X550)

Ovojnica moči

  • Poraba grafične kartice (specifikacije): 6 x 600 W = 3 600 W
  • Skupna moč sistema pri polni obremenitvi: ~4080 W
  • Skupna moč napajalnika: 6000 W (5 x 1200 W) — 32 % prostora nad glavo
  • Kartice Max-Q običajno zdržijo 520–550 W – realna zmogljivost nad 20 %

Hlajenje (Max-Q diferenciator)

Vsaka kartica s svojim ventilatorjem vsesava zrak od spredaj nazaj. Primerna je za mešano namestitev v omare/odprte omare. Tišja je od enakovrednega aksialnega ventilatorskega sklada. Profil vdelane programske opreme Max-Q daje prednost nižji trajni moči (običajno 520–550 W). Priporočeno: omara s perforiranimi sprednjimi vrati in prosto zadnjo izpušno potjo.

Kaj lahko zaženete

Enako kot sorojenec Server Edition – isti silicijev čip, isti 576 GB prostornine. DeepSeek V3 Q4 (~404 GB) z dolgim ​​kontekstom, Kimi-K2 Q2, Mistral Large 3 Q2-Q3, GLM-5 Q2, Qwen3-Coder-480B Q4.

LLM – besedilo / sklepanje / kodiranje

Kitajska meja

  • DeepSeek V3 / R1 / V3.1 / V3.2 pri Q4_K_M (~404 GB) udobno z dolgim ​​kontekstom (~5-8 tok/s en sam vLLM TP-6, objavljena referenca); FP8 izvorno (~670 GB) z odvečnim RAM-om
  • Kimi-K2 (Osnova / Poučevanje / Razmišljanje) pri Q2_K (~375 GB) udobno (~5-8 tok/s samski, objavljena referenca)
  • GLM-5 / GLM-5.1 (~745B/44B) pri Q2_K (~260 GB); Q3 (~420 GB) z razlitjem RAM-a
  • Qwen3-Coder-480B-A35B v Q4_K_M (~270 GB) z dolgim ​​kontekstom
  • Qwen3-235B-A22B pri bf16 (~470 GB) ali fp8 (~240 GB)
  • ERNIE-4.5-424B-A47B v četrtem četrtletju (~240 GB) s 128 tisoč ctx
  • Intern-S1-Pro v Q2_K (~325 GB); Hunyuan-Velik v četrtem četrtletju (~220 GB)
  • MiniMax-Text-01 / M1 v četrtem četrtletju (~260 GB)

Zahodna meja

  • Mistral Veliki 3 v drugem-tretjem četrtletju (~243–317 GB) udobno (~20–30 tok/s posamezno, objavljena referenca)
  • Plamen 4 Maverick pri Q4_K_M (~232 GB) z dolgim ​​ctx (~45-55 tok/s posamezno, objavljena referenca)
  • Llama-3.1-Nemotron Ultra 253B pri 8. sličici programa (~253 GB)
  • Grok-1 314B v četrtem četrtletju (~182 GB); Snežinka Arktika v četrtem četrtletju (~278 GB)
  • Navodila DBRX 132B/36B pri bf16 (~264 GB) ali fp8

Vision-Jezikovni modeli

Qwen3-VL-235B-A22B; InternVL3.5-241B-A28B Q4; GLM-4.5V / 4.6V 106B bf16; Llama 3.2 90B Vision bf16; Pixtral Large 124B fp8; Molmo 72B bf16.

Ustvarjanje slik

Navodila HunyuanImage-3.0; FLUX.1 [dev] / [shnell] / Kontext večinstančni (~15–20 s na sliko 1024x1024, objavljena referenca); SD 3.5 Large; SDXL; AuraFlow; OmniGen; HunyuanImage-2.1; Kolors 2.0.

Generacija videa

Wan 2.2 T2V-A14B dvojni strokovnjak MoE bf16; HunyuanVideo 13B bf16; Open-Sora 2.0 (11B); Mochi-1 (10B); NVIDIA Cosmos Predict 2 do 14B; CogVideoX-5B; LTX-Video; Pyramid Flow.

Zvok / Govor / Pretvorba govora v govor

Polni rezidentni sistemi: Whisper v3 large, Parakeet-TDT 1.1B, Canary 1B, Moshi 7B realtime, Qwen3-Omni, Step-Audio R1, CosyVoice 3.0, Kokoro, Stable Audio Open.

Večmodelno/večnajemniško streženje

  • DeepSeek V3 Q4 + FLUX + HunyuanVideo + Whisper/Moshi v realnem času, vsi rezidenti
  • Sočasni 70B tenzorsko-vzporedni + 235B-MoE na ločenih domenah PCIe
  • 3 mejni modeli, ki so na voljo za A/B vrednotenje

Ciljne delovne obremenitve

  • Raziskovalni laboratorij Frontier z odprto težo in mešanim/neidealnim pretokom zraka v infrastrukturi
  • Kolokacija / zasebni podatkovni center, kjer je turboventilator na kartico operativno enostavnejši od polnega pasivnega pretoka zraka
  • Uvedba suverene umetne inteligence z modelnim skladom Apache 2.0 / MIT
  • Večmodelna platforma RAG + agentska platforma za podjetja
  • Laboratorijska okolja z odprtimi regali

Objavljene reference uspešnosti

Zunanje reference | Isti silicij kot pri strežniški izdaji | Ni izmerjeno na strojni opremi Kentino

merilo Rezultat
RTX Pro 6000 na kartico INT8 TOPS 2 000 VRHOV
vLLM — DeepSeek V3 Q4 na 6x RTX Pro 6000 (enojni) ~25–40 tok/s
vLLM — DeepSeek V3 Q4 na 6x RTX Pro 6000 (batch-32) Agregat 200–400 tok/s
FLUX.1 [razvoj] fp8 na eni grafični kartici RTX Pro 6000 ~15–20 s na sliko 1024 x 1024

Natančne številke so potrjene v fazi dokazila o sodelovanju (PoC). Kentino bo objavil številke iz prve roke po začetni izdelavi za stranke.

Ni idealno za

  • Kimi-K2 / DeepSeek V3 v četrtem četrtletju na voljo za produkcijo z realno hitrostjo – korak naprej s Kentino AI 768 TurinDual RTXPro6000MQ
  • Usposabljanje iz nič na modelih mejnega razreda – brez NVLink
  • Uvedba »plug-and-play« – obmejna služba ministrstva za izobraževanje potrebuje usposobljeno ekipo MLOps

Garancija in dobavni rok

2 let
garancija za dele
1 leto
garancija za delo
10-28 dni
dobavni rok

Izdelava vključuje sestavljanje, konfiguracijo BIOS-a, namestitev gonilnikov, zagon, memtest, preverjanje delovanja in nastavitev okolja LLM. Dobavni rok je odvisen od razpoložljivosti komponent, kar je potrjeno ob naročilu.

Priporočeni dodatki

  • NVIDIA ConnectX-5 MCX555A-ECAT 100 GbE omrežna kartica za večvozlično skaliranje
  • Drugih 4 TB NVMe za knjižnico nabora podatkov/modelov
  • Polna 24U omara s perforiranimi sprednjimi vrati
  • Spletni UPS 10 kVA
  • Upravljani PDU

Vprašanja, ki nam jih kupci najpogosteje zastavijo pred naročilom strežnika.

Kako dolgo traja?

Stroje, sestavljene iz komponent, ki jih imamo na voljo, hitro odpremimo; vse, kar zahteva določeno generacijo grafičnih procesorjev, je odvisno od dobave. Pred plačilom vam sporočimo datum, in če se izdelek premakne, vam to sporočimo, namesto da bi vi izvedeli.

Ali je mogoče konfiguracijo spremeniti, preden jo zgradite?

Skoraj vedno. Grafične kartice, pomnilnik, shranjevanje in hlajenje se izberejo za vsako naročilo posebej, navedena konfiguracija pa je izhodišče in ne fiksni paket. Če potrebujete več VRAM-a, hitrejše shranjevanje ali drugačen način hlajenja, to povejte pred naročilom in pripravili vam bomo ponudbo za spremembo.

Ali lahko strežnik prevzamem osebno?

Lahko. Naše skladišče je v Pragi, osebni prevzem pa je dobrodošel – večina ljudi, ki pridejo, izkoristi obisk, da si z našim inženirjem ogledajo stroj in postavijo vprašanja, ki so po e-pošti nerodna. Za naročila znotraj Češke republike poskušamo dostaviti tudi osebno in vas na kraju samem voditi skozi nastavitev.

Ali se lahko pogovorim z nekom, ki dejansko razume delovno obremenitev?

Da. Imamo inženirja, ki se ukvarja posebej s sistemi umetne inteligence, ne pa s splošno prodajno pisarno. Če se vaše vprašanje nanaša na velikosti serij, kvantizacijo, medsebojne povezave ali kje bo ozko grlo, ga postavite – ta pogovor običajno spremeni konfiguracijo na bolje.

Kateri model lahko uporabljam v tej konfiguraciji?

Da. Vsak stroj je sestavljen, preizkušen v delovanju in primerjalno preizkušen z dejanskimi delovnimi obremenitvami umetne inteligence, preden je odposlan, in nam pusti že nameščen in delujoč LLM. Priključite ga, povežete z omrežjem in začnete delati – edina odločitev, ki ostane, je, kateri projekt se bo zagnal najprej.

Kako preizkusite strežnik pred odpremo?

Preizkusimo ga v primerjavi z dejanskimi delovnimi obremenitvami umetne inteligence in ne s sintetičnimi rezultati: prepustnost sklepanja, obnašanje pri trajni obremenitvi in ​​toplota med neprekinjenim delovanjem. Z napravo dobite rezultate primerjalnih testov, zato je obljubljena zmogljivost tista, ki jo lahko preverite že prvi dan.

Je strežnik pripravljen za delovanje, ko prispe?

Da. Vsak stroj je sestavljen, preizkušen v delovanju in primerjalno preizkušen z dejanskimi delovnimi obremenitvami umetne inteligence, preden je odposlan, in nam pusti že nameščen in delujoč LLM. Priključite ga, povežete z omrežjem in začnete delati – edina odločitev, ki ostane, je, kateri projekt se bo zagnal najprej.

Pošiljamo iz našega skladišča v EU. Za težke artikle bo morda potreben dogovor o prevozu – za ponudbo za pošiljanje in dobavni rok nas kontaktirajte. 2-letna omejena garancija z napredno podporo za vračilo blaga (RMA); na voljo je podaljšana garancija.

Ni ravno tisto, kar potrebujete?

Povejte nam svojo delovno obremenitev in to platformo bomo prilagodili njeni specifikaciji – grafične procesorje, pomnilnik, shranjevanje in hlajenje bomo prilagodili temu, kar dejansko uporabljate.