Kohaliku tehisaru arvuti

LLMLab Forge Ultra

LLMLabi maksimaalne ühe GPU-ga tööjaam: 96 GB ECC videomälu, 256 GB kaheksakanalilist ECC põhimälu ja 8 TB salvestusruumi nõudlike kohalike AI-projektide jaoks.

Kas see komplekt sobib mulle?

AI-võimekuse skoor

Suurte kohalike mudelite ja nõudliku AI-töö jaoks piisav varu.

Väärtus

Kohaliku tehisaru võimekus on praeguse hinnangulise hinna kohta nõrk.

Millega see komplekt hakkama saab

Sobib hästi

  • Väiksemad mudelid suurte partiidena ja paljud 70B-klassi kvanditud inferentsitööd pärast täpset kvalifitseerimist.

Võimalik piirangutega

  • Valitud suuremad või pikema kontekstiga tööd, kui käituskeskkond, mälukulu, kiirus ja teeninduskoormus on kontrollitud.

Ei ole soovitatav

  • Eeldus, et üks GPU treenib alusmudeleid nullist või et iga mitme kasutaja tootmistöö on automaatselt kvalifitseeritud.

Hinnangu ajalugu

Kasutab võimalusel turuhindu ja ülejäänu jaoks viitehinnanguid.

Viitehinnang

33 150 €

Süsteemi hinnang

Ajavahemik

Hinna vaatamiseks puuduta punkti. Kõigi kuupäevade jaoks libista graafikut külgsuunas.

Graafiku liugur näitab süsteemi hinnangulist kogusummat kuupäevade kaupa.

Hinnangu ajaluguJoon näitab süsteemi hinnangulist kogusummat ajas. Kuupäevapõhised väärtused on saadaval graafiku liuguris ja andmetabelis.29 821 €31 316 €32 812 €34 307 €35 802 €1. juuli15. aug29. sept

Süsteemi hinnang kuupäevade kaupa
KuupäevSüsteemi hinnangProtsessorGraafikakaartMäluSalvestusseadeEmaplaatToiteplokkKorpusProtsessorijahuti
1. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
6. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
11. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
16. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
21. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
26. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
31. juuli33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
5. aug33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
10. aug33 135 €4400 €13 900 €8109 €1200 €1359 €459 €164 €152 €
15. aug33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
20. aug33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
25. aug33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
30. aug33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
4. sept33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
9. sept33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
14. sept33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
19. sept33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
24. sept33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €
29. sept33 150 €4400 €13 900 €8109 €1200 €1359 €459 €178 €152 €

Põhikonfiguratsioon

CPU

AMD Ryzen Threadripper PRO 9975WX

GPU

PNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB

VRAM

96 GB

RAM

256 GB

Salvestus

8000 GB

Soovituslik mudeliklass

70B-class quantized inference with long-context headroom after exact workload validation

Jõudlus ja võimsus

Läbilaskevõime

Runtime qualification required; no fixed throughput promise

Süsteemivõimsus

~950 W

Soovitatav toiteplokk

1600 W

Jahutus

Full-IHS sTR5 workstation air cooling with a full-tower airflow path

Komponentide hinnajaotus

Komponentide read näitavad Eesti turu- või viitehinda. Teenuse, kokkupaneku ja seadistuse tasu on allpool eraldi näidatud.

KomponentToodeHinnanguline turuhind
ProtsessorAMD Ryzen Threadripper PRO 9975WX4620 €
GraafikakaartPNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB14 595 €
MäluKingston FURY Renegade Pro 256GB (8x32GB) DDR5-5600 CL28 ECC RDIMM8515 €
SalvestusseadeWD Black SN850X 8TB1260 €
EmaplaatASUS Pro WS WRX90E-SAGE SE1427 €
Toiteplokkbe quiet! Dark Power Pro 13 1600W482 €
KorpusPhanteks Enthoo Pro 2 Tempered Glass Black172 €
ProtsessorijahutiNoctua NH-U14S TR5-SP6160 €
Komponentide hinnanguline kogusumma31 230 €
Teenuse-, kokkupaneku- ja seadistustasu3437 €
Hinnanguline komplekti kogusumma34 667 €

Kohalike mudelite näited

Sobib hästi privaatseks vestluseksSobib hästi programmeerimisabiksSobib hästi dokumentide kokkuvõtmiseks70B-klassi mudelid vajavad rangeid piiranguid

Soovitatud mudel

Qwen3.6 35B-A3B

Võimekas MoE-mudel, mis annab 32 ja 48 GB tööjaamadele sisulise suurema programmeerimissihi.

Sobib hästi GPU-l käitamiseks

Kasutatav

ollama run qwen3.6:35b

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
  • 96 GB kiirendimälu mudelikaalude ja vahemälu jaoks

Qwen3.6 27B

Nõudlikum programmeerimisabi, keerukas arutlus ja pikemate dokumentide analüüs

Sobib hästi GPU-l käitamiseks

Tugev tihe mudel 24–32 GB GPU-dele ja suurema mäluga Apple'i süsteemidele.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval

Qwen3.5 9B

Privaatne vestlus, programmeerimisabi, dokumentide kokkuvõtted ja pildiküsimused

Sobib hästi GPU-l käitamiseks

Tugev igapäevamudel 12 GB klassi GPU-dele ja praktiline kiire programmeerimisabiline.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval

Llama 3.3 70B Instruct

Tipptasemel kohaliku vestluse katsed 48 GB GPU-l või vähemalt 96 GB Apple'i süsteemil

Sobib hästi GPU-l käitamiseks

Selge ülempiiri näide, millega hinnata, kas arvuti saab 70B-klassi mudelit üldse proovida.

Oodatav kogemus: Kasutatav

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 256 GB süsteemi- või ühismälu on saadaval
Kuva tehnilised üksikasjad

Eeldused

  • Eeldatav GPU-mälu: 96 GB from PNY NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB.
  • Süsteemimälu: 256 GB.
  • Hinnang arvestab ühe kohaliku mudeli kaale, KV-vahemälu, käituskeskkonna lisakulu ja turvavaru. See näitab sobivust, mitte tagatud kiirust.
Qwen3.6 35B-A3B tehnilised detailid

Mudelisari: Qwen3.6

Parameetrite arv: 35B

Struktuur: 35B kokku / 3B aktiivsed MoE

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 24 GB

Vaikehinnang: 31.5 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 24 GB / 2.5 GB / 2 GB / 3 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 32 GB vähemalt / 48 GB soovituslik

RAM: 64 GB vähemalt / 64 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kasutatav

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Pikk koodihoidla kontekst võib allesjäänud mäluvaru kiiresti ära kasutada, eriti 32 GB GPU-l.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K24 GB1.5 GB2 GB3 GB30.5 GB
8K24 GB2.5 GB2 GB3 GB31.5 GB
16K24 GB5 GB2 GB3.5 GB34.5 GB
32K24 GB10 GB2 GB4 GB40 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Qwen3.6 27B tehnilised detailid

Mudelisari: Qwen3.6

Parameetrite arv: 27B

Struktuur: 27B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 17 GB

Vaikehinnang: 23 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 17 GB / 2 GB / 1.5 GB / 2.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 24 GB vähemalt / 32 GB soovituslik

RAM: 48 GB vähemalt / 64 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Koodihoidla või väga pika dokumendi kontekst võib ületada 24 GB kaardi mugava mahu.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K17 GB1 GB1.5 GB2.5 GB22 GB
8K17 GB2 GB1.5 GB2.5 GB23 GB
16K17 GB4 GB1.5 GB3 GB25.5 GB
32K17 GB8 GB1.5 GB3.5 GB30 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Qwen3.5 9B tehnilised detailid

Mudelisari: Qwen3.5

Parameetrite arv: 9B

Struktuur: 9B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 6.6 GB

Vaikehinnang: 11 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 6.6 GB / 1.5 GB / 1.2 GB / 1.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 8 GB vähemalt / 12 GB soovituslik

RAM: 16 GB vähemalt / 32 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Alusta umbes 8K kontekstiga, kuigi mudel toetab märksa pikemat konteksti.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K6.6 GB1 GB1.2 GB1.5 GB10.5 GB
8K6.6 GB1.5 GB1.2 GB1.5 GB11 GB
16K6.6 GB2.5 GB1.2 GB1.5 GB12 GB
32K6.6 GB5 GB1.2 GB2 GB15 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Llama 3.3 70B Instruct tehnilised detailid

Mudelisari: Meta Llama 3.3

Parameetrite arv: 70.60B

Struktuur: 70.6B tihe

Litsents: Llama 3.3 Community License; lubatud litsentsitingimustel; piiratud juurdepääs. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 131 072 tokenit

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 42.5 GB

Vaikehinnang: 51 GB @ 4096 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 42.5 GB / 3 GB / 1.5 GB / 4 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 48 GB vähemalt / 64 GB soovituslik

RAM: 64 GB vähemalt / 96 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kasutatav

Kogu mudeli GPU-le laadimine: Sageli piiratud

Konteksti hoiatus: Q4 mudelikaalud kasutavad enne KV-vahemälu, käituskeskkonna lisakulu ja töölaua varu juba umbes 42,5 GB.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K42.5 GB3 GB1.5 GB4 GB51 GB
8K42.5 GB6 GB1.5 GB4 GB54 GB
16K42.5 GB12 GB1.5 GB4.5 GB60.5 GB
32K42.5 GB24 GB1.5 GB5.5 GB73.5 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Kohaliku tehisaru jõudlus on ligikaudne. Tulemus sõltub kvantimisest, konteksti pikkusest, käitusmootorist, draiveritest ja sellest, kas mudel koos KV-vahemäluga mahub GPU-mällu või Apple'i ühismällu.

AI-terminid lihtsas keeles

GPU-mälu ja RAM

GPU-mälu määrab enamasti mudeli suuruse; RAM toetab rakendusi, andmeid ja mudeli osalist laadimist.

CUDA

NVIDIA arvutusplatvorm paljude AI-tööriistade jaoks. CUDA vajab toetatud NVIDIA GPU-d; Apple Silicon ja AMD GPU-d ei toeta seda otse.

Apple'i ühismälu

CPU, GPU, macOS-i ja rakenduste jagatud mälu. See pole sama mis NVIDIA videomälu.

7B / 8B / 14B / 70B

Mudeli ligikaudne suurus miljardites parameetrites; suurem mudel vajab tavaliselt rohkem mälu.

Kvanditud mudel

Väiksema täpsusega mudel, näiteks Q4, mis kasutab vähem mälu võimaliku kvaliteedi- või kiirusekaoga.

Konteksti pikkus

Kui palju teksti saab mudel korraga sisendis arvesse võtta. Pikem kontekst kasutab rohkem mälu.

Mudeli käitamine

Valmis mudeli kasutamine vestluseks, koodi abiks, kokkuvõteteks või dokumentidega töötamiseks.

Mudeli kohandamine

LoRA ja QLoRA kohandavad väikseid adaptereid ning vajavad vähem ressursse kui täielik peenhäälestus.

Läbilaskevõime (tokenit/s)

Mudeli väljundkiirus. Võrdle sama mudelit, kvantimist, konteksti, käituskeskkonda ja kasutajate arvu; sisendi töötlemine on eraldi näitaja.

Küsi hinnapakkumist

34 667 €

Hinnanguline kogusumma. Lõplik hind kinnitatakse enne tellimist.

Küsi hinnapakkumist