VRAM
Graafikakaardi videomälu, mis on tavaliselt kohaliku AI-mudeli suuruse peamine piirang.
Komponendi ülevaade
Graafikakaart kohaliku tehisaru ja kiirendatud töövoogude jaoks
Tootja
ASUS
Kontrollitud tootja tootekood
90YV0MN0-M0NM00
Väljalase
2025 Q1
Videomälu
32 GB GDDR6 ECC
Arhitektuur
RDNA 4
Graafikakaardi võimsus
300 W
Toitepistiku standard
1x 16-pin
Minimaalne toiteplokk
750 W
Kahe GPU tugi
Ei
Mälusiin
256-bit
Ribalaius
640 GB/s
Voogprotsessorid
4096
Tensorituumad
128
RT-tuumad
64
Baas- / kiirendustakt
2350 / 2920 MHz
TDP
300 W
PCIe-põlvkond
PCIe 5.0
Pesalaius
2-slot
Pikkus
267 mm
Toitepistikud
1x 16-pin
Soovitatud toiteplokk
750 W
FP32 jõudlus
47.8 TFLOPS
AI-skoor
94
Allikas
https://www.asus.com/us/motherboards-components/graphics-cards/turbo/turbo-ai-pro-r9700-32g/techspec/
Inferentsi märkused
Exact ASUS 90YV0MN0-M0NM00 with 32 GB VRAM. Linux, ROCm, framework, ECC behavior, and the target workload are qualified before quote; CUDA-only tools need an NVIDIA alternative.
30B-klassi Q4 ainult piirangutega
Sobivus eeldab kvanditud mudelit, mõõdukat kontekstimahtu ja käituskeskkonna kontrolli; 70B ei ole tavapärane siht ilma vähemalt 48 GB videomälu või suure ühismäluta.
VRAM
Graafikakaardi videomälu, mis on tavaliselt kohaliku AI-mudeli suuruse peamine piirang.
Süsteemimälu ja GPU-mälu
Süsteemimälu aitab rakendusi ja andmetöötlust; GPU-mälu määrab enamasti, kui suurt mudelit saab kiiresti käitada.
CUDA
NVIDIA arvutusplatvorm paljude AI-tööriistade jaoks. CUDA vajab toetatud NVIDIA GPU-d; Apple Silicon ja AMD GPU-d ei toeta seda otse.
Apple'i ühismälu
Apple Siliconi mälu, mida jagavad CPU, GPU, macOS ja rakendused. See on Macis tehisaru kasutamisel kasulik, kuid pole sama mis NVIDIA videomälu.
7B / 8B / 14B / 70B
Mudeli ligikaudne suurus miljardites parameetrites. Suurem arv vajab tavaliselt rohkem mälu ja võib olla aeglasem.
Kvanditud mudel
Väiksema arvulise täpsusega mudel, näiteks Q4, mis kasutab vähem mälu, kuid võib mõjutada kvaliteeti või kiirust.
Konteksti pikkus
Kui palju teksti saab mudel korraga sisendis arvesse võtta. Pikem kontekst kasutab rohkem mälu.
Mudeli käitamine
Valmis mudeli kasutamine vestluseks, koodi abiks, kokkuvõteteks või dokumentidega töötamiseks.
Mudeli kohandamine
Täielikus peenhäälestuses uuendatakse kõiki või enamikku mudeli parameetreid. LoRA ja QLoRA treenivad väiksemaid adaptereid ning vajavad seetõttu vähem arvutusressurssi.
Läbilaskevõime (tokenit/s)
Kui kiiresti mudel väljundit toodab. Võrdle ainult sama mudeli, kvantimise, konteksti pikkuse, käituskeskkonna ja kasutajate arvu tulemusi; sisendi töötlemine ja väljundi genereerimine on erinevad näitajad.
Eesti turu planeerimishinnang. Kirjalik pakkumine sisaldab täpset hinda ja kinnitatud saadavust.
Kõigi kuupäevade vaatamiseks libista graafikut külgsuunas.
Planeerimishinnang: 1993 €
Näidatud hind on planeerimishinnang. Täpse hinna ja saadavuse saad kirjaliku pakkumisega.
Selle toote eest ei saa veebis maksta; küsi hinnapakkumist.
Kasuta selle lehe hinnapäringuvormi. See ei kogu makse- ega kaardiandmeid; täpse hinna ja saadavuse saadame e-postiga.
Mis juhtub pärast päringut
Edasine suhtlus ja tugi jätkuvad tellimuse või pakkumise e-kirjavahetuses.
Küsi hinnapakkumist
Päringuga ei koguta makse- ega kaardiandmeid. Saadame täpse hinna, saadavuse ja võimalikud asendused kirjaliku pakkumisena.
Soovitatud mudel
Tugev tihe mudel 24–32 GB GPU-dele ja suurema mäluga Apple'i süsteemidele.
Piisava mäluga arvutis on see praktiline kvaliteedisiht suurema tiheda mudeli jaoks.
Kiire
Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.
Programmeerimisagendid, koodihoidla analüüs ja keerukad kohalikud assistenditöövood
Võimekas MoE-mudel, mis annab 32 ja 48 GB tööjaamadele sisulise suurema programmeerimissihi.
Oodatav kogemus: Kasutatav
Praktiline ainult Q4-tasemel kvantimise ja mõõduka kontekstiga; pikem kontekst võib nõuda osa mudeli laadimist süsteemimällu või väiksema mudeli kasutamist.
Privaatne assistent, dokumentide mõistmine ning piltide või heli analüüs
Kaasaegne mitmikmodaalne igapäevamudel, mis kasutab 16 GB GPU võimekust hästi.
Oodatav kogemus: Kiire
Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.
Tipptasemel kohaliku vestluse katsed 48 GB GPU-l või vähemalt 96 GB Apple'i süsteemil
Selge ülempiiri näide, millega hinnata, kas arvuti saab 70B-klassi mudelit üldse proovida.
Oodatav kogemus: Ei ole soovitatav
See mudel vajab mõõduka konteksti ja Q4_K_M kvantimise korral ligikaudu 51 GB GPU-mälu; arvutil on umbes 32 GB videomälu.
Eeldused
Mudelisari: Qwen3.6
Parameetrite arv: 27B
Struktuur: 27B tihe
Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 262 144 tokenit
Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus
Kvantimine: Q4_K_M
Q4 mudelikaalude ligikaudne maht: 17 GB
Vaikehinnang: 23 GB @ 8192 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 17 GB / 2 GB / 1.5 GB / 2.5 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 24 GB vähemalt / 32 GB soovituslik
RAM: 48 GB vähemalt / 64 GB soovituslik
Praegune käitusviis: Sobib hästi GPU-l käitamiseks
Oodatav kogemus: Kiire
Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu
Konteksti hoiatus: Koodihoidla või väga pika dokumendi kontekst võib ületada 24 GB kaardi mugava mahu.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 17 GB | 1 GB | 1.5 GB | 2.5 GB | 22 GB |
| 8K | 17 GB | 2 GB | 1.5 GB | 2.5 GB | 23 GB |
| 16K | 17 GB | 4 GB | 1.5 GB | 3 GB | 25.5 GB |
| 32K | 17 GB | 8 GB | 1.5 GB | 3.5 GB | 30 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Mudelisari: Qwen3.6
Parameetrite arv: 35B
Struktuur: 35B kokku / 3B aktiivsed MoE
Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 262 144 tokenit
Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus
Kvantimine: Q4_K_M
Q4 mudelikaalude ligikaudne maht: 24 GB
Vaikehinnang: 31.5 GB @ 8192 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 24 GB / 2.5 GB / 2 GB / 3 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 32 GB vähemalt / 48 GB soovituslik
RAM: 64 GB vähemalt / 64 GB soovituslik
Praegune käitusviis: Kvanditud mudel mahub GPU-mällu
Oodatav kogemus: Kasutatav
Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu
Konteksti hoiatus: Pikk koodihoidla kontekst võib allesjäänud mäluvaru kiiresti ära kasutada, eriti 32 GB GPU-l.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 24 GB | 1.5 GB | 2 GB | 3 GB | 30.5 GB |
| 8K | 24 GB | 2.5 GB | 2 GB | 3 GB | 31.5 GB |
| 16K | 24 GB | 5 GB | 2 GB | 3.5 GB | 34.5 GB |
| 32K | 24 GB | 10 GB | 2 GB | 4 GB | 40 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Mudelisari: Google Gemma 4
Parameetrite arv: 11.95B
Struktuur: 11.95B tihe
Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 262 144 tokenit
Kvantimine: Q4_0 QAT
Q4 mudelikaalude ligikaudne maht: 7.2 GB
Vaikehinnang: 11.5 GB @ 8192 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 7.2 GB / 1.5 GB / 1.2 GB / 1.5 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 12 GB vähemalt / 16 GB soovituslik
RAM: 24 GB vähemalt / 32 GB soovituslik
Praegune käitusviis: Sobib hästi GPU-l käitamiseks
Oodatav kogemus: Kiire
Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu
Konteksti hoiatus: Suur kontekstiaken vajab endiselt märkimisväärset KV-vahemälu varu.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 7.2 GB | 1 GB | 1.2 GB | 1.5 GB | 11 GB |
| 8K | 7.2 GB | 1.5 GB | 1.2 GB | 1.5 GB | 11.5 GB |
| 16K | 7.2 GB | 2.5 GB | 1.2 GB | 1.5 GB | 12.5 GB |
| 32K | 7.2 GB | 5 GB | 1.2 GB | 2 GB | 15.5 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Teabeallikad
Andmed kontrollitud: 2026-07-30
Mudelisari: Meta Llama 3.3
Parameetrite arv: 70.60B
Struktuur: 70.6B tihe
Litsents: Llama 3.3 Community License; lubatud litsentsitingimustel; piiratud juurdepääs. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 131 072 tokenit
Kvantimine: Q4_K_M
Q4 mudelikaalude ligikaudne maht: 42.5 GB
Vaikehinnang: 51 GB @ 4096 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 42.5 GB / 3 GB / 1.5 GB / 4 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 48 GB vähemalt / 64 GB soovituslik
RAM: 64 GB vähemalt / 96 GB soovituslik
Praegune käitusviis: Sellel arvutil ei ole praktiline
Oodatav kogemus: Ei ole soovitatav
Kogu mudeli GPU-le laadimine: Sageli piiratud
Konteksti hoiatus: Q4 mudelikaalud kasutavad enne KV-vahemälu, käituskeskkonna lisakulu ja töölaua varu juba umbes 42,5 GB.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 42.5 GB | 3 GB | 1.5 GB | 4 GB | 51 GB |
| 8K | 42.5 GB | 6 GB | 1.5 GB | 4 GB | 54 GB |
| 16K | 42.5 GB | 12 GB | 1.5 GB | 4.5 GB | 60.5 GB |
| 32K | 42.5 GB | 24 GB | 1.5 GB | 5.5 GB | 73.5 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Kohaliku tehisaru jõudlus on ligikaudne. Tulemus sõltub kvantimisest, konteksti pikkusest, käitusmootorist, draiveritest ja sellest, kas mudel koos KV-vahemäluga mahub GPU-mällu või Apple'i ühismällu.
Usaldus ja protsess
Täpne toode ja saadavus
Enne tellimuse täitmist kinnitame täpse mudeli, kehtiva hinna ja saadavuse. Hinnapäringu esitamisel makset ei võeta.
Sobivuse ulatus
Vaatame üle komponendi teadaolevad sobivusandmed ja juhime tähelepanu ilmsetele mõõtude, toite või liidese piirangutele. Lõplik sobivus sõltub ülejäänud süsteemist ja sinu antud andmetest.
Üleandmine Eestis
Üleandmise või kohaletoimetamise viis ja ajakava lepitakse kokku pärast saadavuse kinnitamist.
Tagastus, garantii ja tugi
Tagastus- ja garantiikäsitlus sõltub tellimuse olekust, komponendist, tootjast ja müüjast. Küsimustele vastame samas tellimuse või pakkumise e-kirjavahetuses.
Usaldus
Kontakt ja tugi
Vastame tellimuse või pakkumise e-kirjavahetuses. Kiireim viis on vastata saadud kinnitusele.
Garantii
Garantiikäsitlus sõltub komponendist, tootjast ja müüjast; lahendus kinnitatakse juhtumipõhiselt.
Täpne toode
Tootja, mudel, saadavus ja lõpphind kinnitatakse veebimakses või kirjalikult enne tellimuse täitmist. Asendust ei tehta vaikimisi.
Sobivuse piirid
Kataloogi andmed ja teadaolevad piirangud on valikuabi. Olemasoleva süsteemiga sobivuse kinnitamiseks on vaja kogu osade loendit ning mõõtude, toite, liideste ja tarkvaravajaduste andmeid.
Üleandmine ja tagastus
Üleandmise või kohaletoimetamise viis lepitakse kokku pärast saadavuse kinnitamist. Tagastus ja tühistamine sõltuvad tellimuse olekust ning kehtivatest tingimustest.
Hinna alus
Leht märgib, kas hind põhineb hiljutisel turuandmel, planeerimishinnangul või vajab kirjalikku pakkumist. Komponendi hind ei tähenda terve süsteemi kokkupanekut, tarkvara seadistust ega valmis süsteemi testimist.