Kohaliku tehisaru arvuti

LLMLab Forge Pro

Professionaalne tööjaam nõudlikeks kohaliku tehisaru katseteks, loovtööks, renderdamiseks ja suuremateks projektideks, mis vajavad oluliselt rohkem GPU-mälu. Täpne konfiguratsioon kinnitatakse kirjalikus hinnapakkumises.

Kas see komplekt sobib mulle?

AI-võimekuse skoor

Suurte kohalike mudelite ja nõudliku AI-töö jaoks piisav varu.

Väärtus

Kohaliku tehisaru võimekus ja praegune hinnanguline hind on tasakaalus.

Millega see komplekt hakkama saab

Sobib hästi

  • 13B/14B ja paljud 30B/34B kvanditud töövood suurema mäluvaruga kui 16 GB komplektides.

Võimalik piirangutega

  • Valitud 70B-klassi Q4 töövood pärast mudeli, konteksti, käituskeskkonna ja kiiruse kontrollimist.

Ei ole soovitatav

  • Eeldus, et iga suur mudel, pikk kontekst või mitme kasutaja teenindus toimib ilma eelneva kontrollita.

Hinnangu ajalugu

Kasutab võimalusel turuhindu ja ülejäänu jaoks viitehinnanguid.

Viitehinnang

14 888 €

Süsteemi hinnang

Ajavahemik

Hinna vaatamiseks puuduta punkti. Kõigi kuupäevade jaoks libista graafikut külgsuunas.

Graafiku liugur näitab süsteemi hinnangulist kogusummat kuupäevade kaupa.

Hinnangu ajaluguJoon näitab süsteemi hinnangulist kogusummat ajas. Kuupäevapõhised väärtused on saadaval graafiku liuguris ja andmetabelis.12 141 €13 126 €14 111 €15 095 €16 080 €1. juuli15. aug29. sept

Süsteemi hinnang kuupäevade kaupa
KuupäevSüsteemi hinnangProtsessorGraafikakaartMäluSalvestusseadeEmaplaatToiteplokkKorpusProtsessorijahuti
1. juuli13 887 €551 €9423 €1203 €303 €310 €180 €164 €86 €
6. juuli13 490 €551 €9423 €818 €303 €310 €180 €164 €86 €
11. juuli13 490 €551 €9423 €818 €303 €310 €180 €164 €86 €
16. juuli13 490 €551 €9423 €818 €303 €310 €180 €164 €86 €
21. juuli13 497 €557 €9423 €818 €303 €311 €180 €164 €86 €
26. juuli13 490 €551 €9423 €818 €303 €310 €180 €164 €86 €
31. juuli13 490 €551 €9423 €818 €303 €310 €180 €164 €86 €
5. aug13 490 €551 €9423 €818 €303 €310 €180 €164 €86 €
10. aug13 520 €534 €9479 €818 €303 €319 €162 €164 €86 €
15. aug13 534 €534 €9479 €818 €303 €319 €162 €178 €86 €
20. aug13 534 €534 €9479 €818 €303 €319 €162 €178 €86 €
25. aug13 931 €534 €9479 €1203 €303 €319 €162 €178 €86 €
30. aug14 882 €534 €10 401 €1203 €303 €319 €162 €178 €86 €
4. sept14 882 €534 €10 401 €1203 €303 €319 €162 €178 €86 €
9. sept14 882 €534 €10 401 €1203 €303 €319 €162 €178 €86 €
14. sept14 882 €534 €10 401 €1203 €303 €319 €162 €178 €86 €
19. sept14 882 €534 €10 401 €1203 €303 €319 €162 €178 €86 €
24. sept14 888 €534 €10 401 €1203 €303 €319 €162 €178 €93 €
29. sept14 888 €534 €10 401 €1203 €303 €319 €162 €178 €93 €

Põhikonfiguratsioon

CPU

AMD Ryzen 9 9950X

GPU

PNY NVIDIA RTX PRO 5000 72GB Blackwell Small Box

VRAM

72 GB

RAM

64 GB

Salvestus

2000 GB

Soovituslik mudeliklass

70B-klassi kvanditud inferents praktilise kontekstimahuga pärast töökoormuse sobivuse kontrolli

Jõudlus ja võimsus

Läbilaskevõime

~84 tokenit/s genereerimisel: 14B Q4 16K kontekstiga (sama arvutusjõudlus ja mälu läbilase kui mõõdetud 48 GB mudelil)

Süsteemivõimsus

~620 W

Soovitatav toiteplokk

1000 W

Jahutus

280mm liquid cooling with a full-tower airflow path

Komponentide hinnajaotus

Komponentide read näitavad Eesti turu- või viitehinda. Teenuse, kokkupaneku ja seadistuse tasu on allpool eraldi näidatud.

KomponentToodeHinnanguline turuhind
ProtsessorAMD Ryzen 9 9950X578 €
GraafikakaartPNY NVIDIA RTX PRO 5000 72GB Blackwell Small Box9894 €
MäluG.Skill Trident Z5 Neo 64GB (2x32GB) DDR5-6000 CL301263 €
SalvestusseadeWD Black SN850X 2TB318 €
EmaplaatMSI MAG X870 Tomahawk WiFi325 €
ToiteplokkSeaSonic Focus GX-1000 1000W189 €
KorpusPhanteks Enthoo Pro 2 Tempered Glass Black172 €
ProtsessorijahutiArctic Liquid Freezer III Pro 28098 €
Komponentide hinnanguline kogusumma12 838 €
Teenuse-, kokkupaneku- ja seadistustasu1685 €
Hinnanguline komplekti kogusumma14 523 €

Kohalike mudelite näited

Sobib hästi privaatseks vestluseksSobib hästi programmeerimisabiksSobib hästi dokumentide kokkuvõtmiseks70B-klassi mudelid vajavad rangeid piiranguid

Soovitatud mudel

Qwen3.6 35B-A3B

Võimekas MoE-mudel, mis annab 32 ja 48 GB tööjaamadele sisulise suurema programmeerimissihi.

Sobib hästi GPU-l käitamiseks

Kasutatav

ollama run qwen3.6:35b

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 64 GB süsteemi- või ühismälu on saadaval
  • 72 GB kiirendimälu mudelikaalude ja vahemälu jaoks

Qwen3.6 27B

Nõudlikum programmeerimisabi, keerukas arutlus ja pikemate dokumentide analüüs

Sobib hästi GPU-l käitamiseks

Tugev tihe mudel 24–32 GB GPU-dele ja suurema mäluga Apple'i süsteemidele.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 64 GB süsteemi- või ühismälu on saadaval

Qwen3.5 9B

Privaatne vestlus, programmeerimisabi, dokumentide kokkuvõtted ja pildiküsimused

Sobib hästi GPU-l käitamiseks

Tugev igapäevamudel 12 GB klassi GPU-dele ja praktiline kiire programmeerimisabiline.

Oodatav kogemus: Kiire

Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.

  • 64 GB süsteemi- või ühismälu on saadaval

Llama 3.3 70B Instruct

Tipptasemel kohaliku vestluse katsed 48 GB GPU-l või vähemalt 96 GB Apple'i süsteemil

Kvanditud mudel mahub GPU-mällu

Selge ülempiiri näide, millega hinnata, kas arvuti saab 70B-klassi mudelit üldse proovida.

Oodatav kogemus: Aeglane

Kvanditud mudel peaks GPU-mällu mahtuma, kuid pikem kontekst suurendab mälukoormust.

  • 64 GB süsteemi- või ühismälu on saadaval
Kuva tehnilised üksikasjad

Eeldused

  • Eeldatav GPU-mälu: 72 GB from PNY NVIDIA RTX PRO 5000 72GB Blackwell Small Box.
  • Süsteemimälu: 64 GB.
  • Hinnang arvestab ühe kohaliku mudeli kaale, KV-vahemälu, käituskeskkonna lisakulu ja turvavaru. See näitab sobivust, mitte tagatud kiirust.
Qwen3.6 35B-A3B tehnilised detailid

Mudelisari: Qwen3.6

Parameetrite arv: 35B

Struktuur: 35B kokku / 3B aktiivsed MoE

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 24 GB

Vaikehinnang: 31.5 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 24 GB / 2.5 GB / 2 GB / 3 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 32 GB vähemalt / 48 GB soovituslik

RAM: 64 GB vähemalt / 64 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kasutatav

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Pikk koodihoidla kontekst võib allesjäänud mäluvaru kiiresti ära kasutada, eriti 32 GB GPU-l.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K24 GB1.5 GB2 GB3 GB30.5 GB
8K24 GB2.5 GB2 GB3 GB31.5 GB
16K24 GB5 GB2 GB3.5 GB34.5 GB
32K24 GB10 GB2 GB4 GB40 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Qwen3.6 27B tehnilised detailid

Mudelisari: Qwen3.6

Parameetrite arv: 27B

Struktuur: 27B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 17 GB

Vaikehinnang: 23 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 17 GB / 2 GB / 1.5 GB / 2.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 24 GB vähemalt / 32 GB soovituslik

RAM: 48 GB vähemalt / 64 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Koodihoidla või väga pika dokumendi kontekst võib ületada 24 GB kaardi mugava mahu.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K17 GB1 GB1.5 GB2.5 GB22 GB
8K17 GB2 GB1.5 GB2.5 GB23 GB
16K17 GB4 GB1.5 GB3 GB25.5 GB
32K17 GB8 GB1.5 GB3.5 GB30 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Qwen3.5 9B tehnilised detailid

Mudelisari: Qwen3.5

Parameetrite arv: 9B

Struktuur: 9B tihe

Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 262 144 tokenit

Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 6.6 GB

Vaikehinnang: 11 GB @ 8192 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 6.6 GB / 1.5 GB / 1.2 GB / 1.5 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 8 GB vähemalt / 12 GB soovituslik

RAM: 16 GB vähemalt / 32 GB soovituslik

Praegune käitusviis: Sobib hästi GPU-l käitamiseks

Oodatav kogemus: Kiire

Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu

Konteksti hoiatus: Alusta umbes 8K kontekstiga, kuigi mudel toetab märksa pikemat konteksti.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K6.6 GB1 GB1.2 GB1.5 GB10.5 GB
8K6.6 GB1.5 GB1.2 GB1.5 GB11 GB
16K6.6 GB2.5 GB1.2 GB1.5 GB12 GB
32K6.6 GB5 GB1.2 GB2 GB15 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Llama 3.3 70B Instruct tehnilised detailid

Mudelisari: Meta Llama 3.3

Parameetrite arv: 70.60B

Struktuur: 70.6B tihe

Litsents: Llama 3.3 Community License; lubatud litsentsitingimustel; piiratud juurdepääs. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.

Algne kontekstiaken: 131 072 tokenit

Kvantimine: Q4_K_M

Q4 mudelikaalude ligikaudne maht: 42.5 GB

Vaikehinnang: 51 GB @ 4096 tokenit

Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 42.5 GB / 3 GB / 1.5 GB / 4 GB

CPU- ja RAM-põhine varuvariant: Ei ole soovitatav

VRAM: 48 GB vähemalt / 64 GB soovituslik

RAM: 64 GB vähemalt / 96 GB soovituslik

Praegune käitusviis: Kvanditud mudel mahub GPU-mällu

Oodatav kogemus: Aeglane

Kogu mudeli GPU-le laadimine: Sageli piiratud

Konteksti hoiatus: Q4 mudelikaalud kasutavad enne KV-vahemälu, käituskeskkonna lisakulu ja töölaua varu juba umbes 42,5 GB.

KontekstKaaludKVKäituskeskkondVaruGPU-mälu hinnang
4K42.5 GB3 GB1.5 GB4 GB51 GB
8K42.5 GB6 GB1.5 GB4 GB54 GB
16K42.5 GB12 GB1.5 GB4.5 GB60.5 GB
32K42.5 GB24 GB1.5 GB5.5 GB73.5 GB

Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.

Teabeallikad

Andmed kontrollitud: 2026-07-30

Kohaliku tehisaru jõudlus on ligikaudne. Tulemus sõltub kvantimisest, konteksti pikkusest, käitusmootorist, draiveritest ja sellest, kas mudel koos KV-vahemäluga mahub GPU-mällu või Apple'i ühismällu.

AI-terminid lihtsas keeles

GPU-mälu ja RAM

GPU-mälu määrab enamasti mudeli suuruse; RAM toetab rakendusi, andmeid ja mudeli osalist laadimist.

CUDA

NVIDIA arvutusplatvorm paljude AI-tööriistade jaoks. CUDA vajab toetatud NVIDIA GPU-d; Apple Silicon ja AMD GPU-d ei toeta seda otse.

Apple'i ühismälu

CPU, GPU, macOS-i ja rakenduste jagatud mälu. See pole sama mis NVIDIA videomälu.

7B / 8B / 14B / 70B

Mudeli ligikaudne suurus miljardites parameetrites; suurem mudel vajab tavaliselt rohkem mälu.

Kvanditud mudel

Väiksema täpsusega mudel, näiteks Q4, mis kasutab vähem mälu võimaliku kvaliteedi- või kiirusekaoga.

Konteksti pikkus

Kui palju teksti saab mudel korraga sisendis arvesse võtta. Pikem kontekst kasutab rohkem mälu.

Mudeli käitamine

Valmis mudeli kasutamine vestluseks, koodi abiks, kokkuvõteteks või dokumentidega töötamiseks.

Mudeli kohandamine

LoRA ja QLoRA kohandavad väikseid adaptereid ning vajavad vähem ressursse kui täielik peenhäälestus.

Läbilaskevõime (tokenit/s)

Mudeli väljundkiirus. Võrdle sama mudelit, kvantimist, konteksti, käituskeskkonda ja kasutajate arvu; sisendi töötlemine on eraldi näitaja.

Küsi hinnapakkumist

14 523 €

Hinnanguline kogusumma. Lõplik hind kinnitatakse enne tellimist.

Küsi hinnapakkumist