Kohaliku tehisaru arvuti

AI Workstation Max

LLMLabi maksimaalne ühe GPU-ga tööjaam: 96 GB ECC videomälu, 256 GB kaheksakanalilist ECC põhimälu ja 8 TB salvestusruumi nõudlike kohalike AI-projektide jaoks.

Kas see komplekt sobib mulle?

AI-võimekuse skoor

Suurte kohalike mudelite ja nõudliku AI-töö jaoks piisav varu.

Väärtus

Kohaliku tehisaru võimekus on praeguse hinnangulise hinna kohta nõrk.

Millega see komplekt hakkama saab

Sobib hästi

  • Väiksemad mudelid suurte partiidena ja paljud 70B-klassi kvanditud inferentsitööd pärast täpset kvalifitseerimist.

Võimalik piirangutega

  • Valitud suuremad või pikema kontekstiga tööd, kui käituskeskkond, mälukulu, kiirus ja teeninduskoormus on kontrollitud.

Ei ole soovitatav

  • Eeldus, et üks GPU treenib alusmudeleid nullist või et iga mitme kasutaja tootmistöö on automaatselt kvalifitseeritud.

Vali see komplekt, kui vajad kuue süsteemi valiku suurimat GPU-mälu ja tööjaamaplatvormi varu.

Komponentide hinnaajalugu

Hinnaajalugu koguneb.

Graafik ilmub, kui hinnaajalugu on piisavalt kogutud.

Põhikonfiguratsioon

CPU

AMD Ryzen Threadripper PRO 9975WX

GPU

PNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB

VRAM

96 GB

RAM

256 GB

Salvestus

8000 GB

Soovituslik mudeliklass

70B-class quantized inference with long-context headroom after exact workload validation

Jõudlus ja võimsus

Läbilaskevõime

Runtime qualification required; no fixed throughput promise

Süsteemivõimsus

~950 W

Soovitatav toiteplokk

1600 W

Jahutus

Full-IHS sTR5 workstation air cooling with a full-tower airflow path

Komponentide hinnajaotus

Komponentide read näitavad Eesti turu- või viitehinda. Teenuse, kokkupaneku ja seadistuse tasu on allpool eraldi näidatud.

KomponentToodeHinnanguline turuhind
ProtsessorAMD Ryzen Threadripper PRO 9975WX4400 €
GraafikakaartPNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB13 900 €
MäluKingston FURY Renegade Pro 256GB (8x32GB) DDR5-5600 CL28 ECC RDIMM8109 €
SalvestusseadeWD Black SN850X 8TB1200 €
EmaplaatASUS Pro WS WRX90E-SAGE SE1359 €
Toiteplokkbe quiet! Dark Power Pro 13 1600W459 €
KorpusPhanteks Enthoo Pro 2 Tempered Glass Black178 €
ProtsessorijahutiNoctua NH-U14S TR5-SP6152 €
Komponentide hinnanguline kogusumma29 757 €
Teenuse-, kokkupaneku- ja seadistustasu (2500 € integratsioon + 3% hange, ülempiir 1000 €)3393 €
Hinnanguline komplekti kogusumma33 150 €

Kohalike mudelite näited

Sobib hästi privaatseks vestluseksSobib hästi programmeerimisabiksSobib hästi dokumentide kokkuvõtmiseks70B-klassi mudelid vajavad rangeid piiranguid

Soovitatud mudel

Qwen3.6 35B-A3B

Võimekas MoE-mudel, mis annab 32 ja 48 GB tööjaamadele sisulise suurema programmeerimissihi.

See kasutab 48 GB tööjaama võimekust hästi ilma kohe piiratud 70B mudelini hüppamata.

Sobib hästi GPU-l käitamiseks

Kasutatav

ollama run qwen3.6:35b

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
  • 96 GB kiirendimälu mudelikaalude ja vahemälu jaoks

Qwen3.6 27B

Nõudlikum programmeerimisabi, keerukas arutlus ja pikemate dokumentide analüüs

Sobib hästi GPU-l käitamiseks

Tugev tihe mudel 24–32 GB GPU-dele ja suurema mäluga Apple'i süsteemidele.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
  • 96 GB kiirendimälu mudelikaalude ja vahemälu jaoks

Qwen3.5 9B

Privaatne vestlus, programmeerimisabi, dokumentide kokkuvõtted ja pildiküsimused

Sobib hästi GPU-l käitamiseks

Tugev igapäevamudel 12 GB klassi GPU-dele ja praktiline kiire programmeerimisabiline.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
  • 96 GB kiirendimälu mudelikaalude ja vahemälu jaoks

Llama 3.3 70B Instruct

Tipptasemel kohaliku vestluse katsed 48 GB GPU-l või vähemalt 96 GB Apple'i süsteemil

Sobib hästi GPU-l käitamiseks

Selge ülempiiri näide, millega hinnata, kas arvuti saab 70B-klassi mudelit üldse proovida.

Oodatav kogemus: Kasutatav

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
  • 96 GB kiirendimälu mudelikaalude ja vahemälu jaoks

Gemma 4 12B

Privaatne assistent, dokumentide mõistmine ning piltide või heli analüüs

Sobib hästi GPU-l käitamiseks

Kaasaegne mitmikmodaalne igapäevamudel, mis kasutab 16 GB GPU võimekust hästi.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
  • 96 GB kiirendimälu mudelikaalude ja vahemälu jaoks
Kuva tehnilised üksikasjad

Eeldused

  • Eeldatav GPU-mälu: 96 GB from PNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB.
  • Süsteemimälu: 256 GB.
  • Hinnang arvestab ühe kohaliku mudeli kaale, KV-vahemälu, käituskeskkonna lisakulu ja turvavaru. See näitab sobivust, mitte tagatud kiirust.
Qwen3.6 35B-A3B tehnilised detailid

Mudelisari: Qwen3.6

Parameetrite arv: 35B

Struktuur: 35B kokku / 3B aktiivsed MoE

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 24 GB

Vaikehinnang: 31.5 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 24 GB / 2.5 GB / 2 GB / 3 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 32 GB vähemalt / 48 GB soovituslik

RAM: 64 GB vähemalt / 64 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kasutatav

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Pikk koodihoidla kontekst võib allesjäänud mäluvaru kiiresti ära kasutada, eriti 32 GB GPU-l.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K24 GB1.5 GB2 GB3 GB30.5 GB
8K24 GB2.5 GB2 GB3 GB31.5 GB
16K24 GB5 GB2 GB3.5 GB34.5 GB
32K24 GB10 GB2 GB4 GB40 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Qwen3.6 27B tehnilised detailid

Mudelisari: Qwen3.6

Parameetrite arv: 27B

Struktuur: 27B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 17 GB

Vaikehinnang: 23 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 17 GB / 2 GB / 1.5 GB / 2.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 24 GB vähemalt / 32 GB soovituslik

RAM: 48 GB vähemalt / 64 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Koodihoidla või väga pika dokumendi kontekst võib ületada 24 GB kaardi mugava mahu.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K17 GB1 GB1.5 GB2.5 GB22 GB
8K17 GB2 GB1.5 GB2.5 GB23 GB
16K17 GB4 GB1.5 GB3 GB25.5 GB
32K17 GB8 GB1.5 GB3.5 GB30 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Qwen3.5 9B tehnilised detailid

Mudelisari: Qwen3.5

Parameetrite arv: 9B

Struktuur: 9B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 6.6 GB

Vaikehinnang: 11 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 6.6 GB / 1.5 GB / 1.2 GB / 1.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 8 GB vähemalt / 12 GB soovituslik

RAM: 16 GB vähemalt / 32 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Alusta umbes 8K kontekstiga, kuigi mudel toetab märksa pikemat konteksti.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K6.6 GB1 GB1.2 GB1.5 GB10.5 GB
8K6.6 GB1.5 GB1.2 GB1.5 GB11 GB
16K6.6 GB2.5 GB1.2 GB1.5 GB12 GB
32K6.6 GB5 GB1.2 GB2 GB15 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Llama 3.3 70B Instruct tehnilised detailid

Mudelisari: Meta Llama 3.3

Parameetrite arv: 70.60B

Struktuur: 70.6B tihe

Litsents: Llama 3.3 Community License; lubatud litsentsitingimustel; piiratud juurdepääs. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 131 072 tokenit

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 42.5 GB

Vaikehinnang: 51 GB @ 4096 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 42.5 GB / 3 GB / 1.5 GB / 4 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 48 GB vähemalt / 64 GB soovituslik

RAM: 64 GB vähemalt / 96 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kasutatav

Kogu mudeli GPU-le laadimine: Sageli piiratud

Konteksti hoiatus: Q4 mudelikaalud kasutavad enne KV-vahemälu, käituskeskkonna lisakulu ja töölaua varu juba umbes 42,5 GB.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K42.5 GB3 GB1.5 GB4 GB51 GB
8K42.5 GB6 GB1.5 GB4 GB54 GB
16K42.5 GB12 GB1.5 GB4.5 GB60.5 GB
32K42.5 GB24 GB1.5 GB5.5 GB73.5 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Gemma 4 12B tehnilised detailid

Mudelisari: Google Gemma 4

Parameetrite arv: 11.95B

Struktuur: 11.95B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Kvantimine: Q4_0 QAT

Q4 mudelikaalude ligikaudne maht: 7.2 GB

Vaikehinnang: 11.5 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 7.2 GB / 1.5 GB / 1.2 GB / 1.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 12 GB vähemalt / 16 GB soovituslik

RAM: 24 GB vähemalt / 32 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Suur kontekstiaken vajab endiselt märkimisväärset KV-vahemälu varu.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K7.2 GB1 GB1.2 GB1.5 GB11 GB
8K7.2 GB1.5 GB1.2 GB1.5 GB11.5 GB
16K7.2 GB2.5 GB1.2 GB1.5 GB12.5 GB
32K7.2 GB5 GB1.2 GB2 GB15.5 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Kohaliku tehisaru jõudlus on ligikaudne. Tulemus sõltub kvantimisest, konteksti pikkusest, käitusmootorist, draiveritest ja sellest, kas mudel koos KV-vahemäluga mahub GPU-mällu või Apple'i ühismällu.

AI-terminid lihtsas keeles

VRAM

Graafikakaardi videomälu, mis on tavaliselt kohaliku AI-mudeli suuruse peamine piirang.

Süsteemimälu ja GPU-mälu

Süsteemimälu aitab rakendusi ja andmetöötlust; GPU-mälu määrab enamasti, kui suurt mudelit saab kiiresti käitada.

CUDA

NVIDIA arvutusplatvorm paljude AI-tööriistade jaoks. CUDA vajab toetatud NVIDIA GPU-d; Apple Silicon ja AMD GPU-d ei toeta seda otse.

Apple'i ühismälu

Apple Siliconi mälu, mida jagavad CPU, GPU, macOS ja rakendused. See on Macis tehisaru kasutamisel kasulik, kuid pole sama mis NVIDIA videomälu.

7B / 8B / 14B / 70B

Mudeli ligikaudne suurus miljardites parameetrites. Suurem arv vajab tavaliselt rohkem mälu ja võib olla aeglasem.

Kvanditud mudel

Väiksema arvulise täpsusega mudel, näiteks Q4, mis kasutab vähem mälu, kuid võib mõjutada kvaliteeti või kiirust.

Konteksti pikkus

Kui palju teksti saab mudel korraga sisendis arvesse võtta. Pikem kontekst kasutab rohkem mälu.

Mudeli käitamine

Valmis mudeli kasutamine vestluseks, koodi abiks, kokkuvõteteks või dokumentidega töötamiseks.

Mudeli kohandamine

Täielikus peenhäälestuses uuendatakse kõiki või enamikku mudeli parameetreid. LoRA ja QLoRA treenivad väiksemaid adaptereid ning vajavad seetõttu vähem arvutusressurssi.

Läbilaskevõime (tokenit/s)

Kui kiiresti mudel väljundit toodab. Võrdle ainult sama mudeli, kvantimise, konteksti pikkuse, käituskeskkonna ja kasutajate arvu tulemusi; sisendi töötlemine ja väljundi genereerimine on erinevad näitajad.

Küsi hinnapakkumist

Planeerimishinnang

Umbes 33 150 €

Komponentide hinnanguline kogusumma
29 757 €
Teenuse-, kokkupaneku- ja seadistustasu (2500 € integratsioon + 3% hange, ülempiir 1000 €)
3393 €
Hinnanguline komplekti kogusumma
33 150 €

Näidatud summa on planeerimishinnang. Kirjalik pakkumine sisaldab täpset kogusummat ja kinnitatud saadavust.

Hinnagraafik näitab Eesti turu hinnangulist komponentide kogusummat enne teenuse ja kokkupaneku tasu. Uued hinnakontrollid asendavad lähtehinnangud automaatselt. Hinnapäringuga makset ei võeta.

Küsi hinnapakkumist

Vorm kogub ainult kontaktandmed ja soovid. Saadame täpse kogusumma ning saadavuse e-postiga; makse- ega kaardiandmeid vorm ei küsi.