GPU-mälu ja RAM
GPU-mälu määrab enamasti mudeli suuruse; RAM toetab rakendusi, andmeid ja mudeli osalist laadimist.
Komponendi ülevaade
Graafikakaart kohaliku tehisaru ja kiirendatud töövoogude jaoks
Tootja
ASUS
Kontrollitud tootja tootekood
90YV0LX0-M0NA00
Väljalase
2025 Q1
Videomälu
16 GB GDDR7
Arhitektuur
Blackwell
Graafikakaardi võimsus
360 W
Toitepistiku standard
12V-2x6
Minimaalne toiteplokk
850 W
Kahe GPU tugi
Ei
Mälusiin
256-bit
Ribalaius
960 GB/s
CUDA-tuumad
10752
Tensorituumad
336
RT-tuumad
84
Baas- / kiirendustakt
2295 / 2685 MHz
TDP
360 W
PCIe-põlvkond
PCIe 5.0
Pesalaius
3-slot
Pikkus
304 mm
Toitepistikud
1x 16-pin 12V-2x6
Soovitatud toiteplokk
850 W
Inferentsi märkused
Exact ASUS PRIME-RTX5080-O16G. Multiple Estonian retailer offers were verified; checkout still requires fresh exact-SKU observations.
13B/14B Q4 praktilise kontekstiga
Igapäevaseks kasutuseks sobiv kohalik keelemudel eeldab kvantimist ja mõõdukat konteksti; 30B ei ole ilma suurema videomäluta tavapärane siht.
GPU-mälu ja RAM
GPU-mälu määrab enamasti mudeli suuruse; RAM toetab rakendusi, andmeid ja mudeli osalist laadimist.
CUDA
NVIDIA arvutusplatvorm paljude AI-tööriistade jaoks. CUDA vajab toetatud NVIDIA GPU-d; Apple Silicon ja AMD GPU-d ei toeta seda otse.
Apple'i ühismälu
CPU, GPU, macOS-i ja rakenduste jagatud mälu. See pole sama mis NVIDIA videomälu.
7B / 8B / 14B / 70B
Mudeli ligikaudne suurus miljardites parameetrites; suurem mudel vajab tavaliselt rohkem mälu.
Kvanditud mudel
Väiksema täpsusega mudel, näiteks Q4, mis kasutab vähem mälu võimaliku kvaliteedi- või kiirusekaoga.
Konteksti pikkus
Kui palju teksti saab mudel korraga sisendis arvesse võtta. Pikem kontekst kasutab rohkem mälu.
Mudeli käitamine
Valmis mudeli kasutamine vestluseks, koodi abiks, kokkuvõteteks või dokumentidega töötamiseks.
Mudeli kohandamine
LoRA ja QLoRA kohandavad väikseid adaptereid ning vajavad vähem ressursse kui täielik peenhäälestus.
Läbilaskevõime (tokenit/s)
Mudeli väljundkiirus. Võrdle sama mudelit, kvantimist, konteksti, käituskeskkonda ja kasutajate arvu; sisendi töötlemine on eraldi näitaja.
Kasutab võimalusel turuhindu ja muul juhul viitehinnanguid.
Kõigi kuupäevade vaatamiseks libista graafikut külgsuunas.
1846 €
Hinnanguline kogusumma. Lõplik hind kinnitatakse enne tellimist.
Selle toote eest ei saa veebis maksta; küsi hinnapakkumist.
Kasuta selle lehe hinnapäringuvormi. See ei kogu makse- ega kaardiandmeid; täpse hinna ja saadavuse saadame e-postiga.
Küsi hinnapakkumist
Mis juhtub pärast päringut
Edasine suhtlus ja tugi jätkuvad tellimuse või pakkumise e-kirjavahetuses.
Soovitatud mudel
Kaasaegne mitmikmodaalne igapäevamudel, mis kasutab 16 GB GPU võimekust hästi.
Kiire
Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.
Privaatne vestlus, programmeerimisabi, dokumentide kokkuvõtted ja pildiküsimused
Tugev igapäevamudel 12 GB klassi GPU-dele ja praktiline kiire programmeerimisabiline.
Oodatav kogemus: Kiire
Selle kvanditud mudeli jaoks peaks tavapärase konteksti korral olema piisavalt mäluvaru.
Tipptasemel kohaliku vestluse katsed 48 GB GPU-l või vähemalt 96 GB Apple'i süsteemil
Selge ülempiiri näide, millega hinnata, kas arvuti saab 70B-klassi mudelit üldse proovida.
Oodatav kogemus: Ei ole soovitatav
Vajab vähemalt 64 GB süsteemimälu; sellel arvutil on 32 GB.
Eeldused
Mudelisari: Google Gemma 4
Parameetrite arv: 11.95B
Struktuur: 11.95B tihe
Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 262 144 tokenit
Kvantimine: Q4_0 QAT
Q4 mudelikaalude ligikaudne maht: 7.2 GB
Vaikehinnang: 11.5 GB @ 8192 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 7.2 GB / 1.5 GB / 1.2 GB / 1.5 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 12 GB vähemalt / 16 GB soovituslik
RAM: 24 GB vähemalt / 32 GB soovituslik
Praegune käitusviis: Sobib hästi GPU-l käitamiseks
Oodatav kogemus: Kiire
Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu
Konteksti hoiatus: Suur kontekstiaken vajab endiselt märkimisväärset KV-vahemälu varu.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 7.2 GB | 1 GB | 1.2 GB | 1.5 GB | 11 GB |
| 8K | 7.2 GB | 1.5 GB | 1.2 GB | 1.5 GB | 11.5 GB |
| 16K | 7.2 GB | 2.5 GB | 1.2 GB | 1.5 GB | 12.5 GB |
| 32K | 7.2 GB | 5 GB | 1.2 GB | 2 GB | 15.5 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Teabeallikad
Andmed kontrollitud: 2026-07-30
Mudelisari: Qwen3.5
Parameetrite arv: 9B
Struktuur: 9B tihe
Litsents: Apache License 2.0; lubatud. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 262 144 tokenit
Laiendatud kontekstiaken: 1 010 000 meetodiga YaRN; ei ole vaikimisi sobivuseeldus
Kvantimine: Q4_K_M
Q4 mudelikaalude ligikaudne maht: 6.6 GB
Vaikehinnang: 11 GB @ 8192 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 6.6 GB / 1.5 GB / 1.2 GB / 1.5 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 8 GB vähemalt / 12 GB soovituslik
RAM: 16 GB vähemalt / 32 GB soovituslik
Praegune käitusviis: Sobib hästi GPU-l käitamiseks
Oodatav kogemus: Kiire
Kogu mudeli GPU-le laadimine: Ainult siis, kui mudel ja kontekst mahuvad mällu
Konteksti hoiatus: Alusta umbes 8K kontekstiga, kuigi mudel toetab märksa pikemat konteksti.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 6.6 GB | 1 GB | 1.2 GB | 1.5 GB | 10.5 GB |
| 8K | 6.6 GB | 1.5 GB | 1.2 GB | 1.5 GB | 11 GB |
| 16K | 6.6 GB | 2.5 GB | 1.2 GB | 1.5 GB | 12 GB |
| 32K | 6.6 GB | 5 GB | 1.2 GB | 2 GB | 15 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Mudelisari: Meta Llama 3.3
Parameetrite arv: 70.60B
Struktuur: 70.6B tihe
Litsents: Llama 3.3 Community License; lubatud litsentsitingimustel; piiratud juurdepääs. See on üldine sobivushinnang; enne ärilist kasutust kontrolli mudeli litsentsi.
Algne kontekstiaken: 131 072 tokenit
Kvantimine: Q4_K_M
Q4 mudelikaalude ligikaudne maht: 42.5 GB
Vaikehinnang: 51 GB @ 4096 tokenit
Mudelikaalud / KV-vahemälu / käituskeskkond / varu: 42.5 GB / 3 GB / 1.5 GB / 4 GB
CPU- ja RAM-põhine varuvariant: Ei ole soovitatav
VRAM: 48 GB vähemalt / 64 GB soovituslik
RAM: 64 GB vähemalt / 96 GB soovituslik
Praegune käitusviis: Sellel arvutil ei ole praktiline
Oodatav kogemus: Ei ole soovitatav
Kogu mudeli GPU-le laadimine: Sageli piiratud
Konteksti hoiatus: Q4 mudelikaalud kasutavad enne KV-vahemälu, käituskeskkonna lisakulu ja töölaua varu juba umbes 42,5 GB.
| Kontekst | Kaalud | KV | Käituskeskkond | Varu | GPU-mälu hinnang |
|---|---|---|---|---|---|
| 4K | 42.5 GB | 3 GB | 1.5 GB | 4 GB | 51 GB |
| 8K | 42.5 GB | 6 GB | 1.5 GB | 4 GB | 54 GB |
| 16K | 42.5 GB | 12 GB | 1.5 GB | 4.5 GB | 60.5 GB |
| 32K | 42.5 GB | 24 GB | 1.5 GB | 5.5 GB | 73.5 GB |
Kõigi mäluhinnangute vaatamiseks libista tabelit külgsuunas.
Kohaliku tehisaru jõudlus on ligikaudne. Tulemus sõltub kvantimisest, konteksti pikkusest, käitusmootorist, draiveritest ja sellest, kas mudel koos KV-vahemäluga mahub GPU-mällu või Apple'i ühismällu.
Usaldus ja protsess
Täpne toode ja saadavus
Kinnitame enne tellimuse täitmist mudeli, hinna ja saadavuse. Hinnapäringuga makset ei võeta.
Sobivuse ulatus
Kontrollime teadaolevaid mõõtude, toite ja liidese piiranguid. Lõplik sobivus sõltub ülejäänud süsteemist.
Üleandmine Eestis
Üleandmise või kohaletoimetamise viis ja aeg lepitakse kokku pärast saadavuse kinnitamist.
Tagastus, garantii ja tugi
Käsitlus sõltub tellimuse olekust ning komponendi, tootja ja müüja tingimustest. Küsimustele vastame e-kirjavahetuses.
Usaldus
Kontakt ja tugi
Kiireim viis on vastata tellimuse või pakkumise kinnitusele.
Täpne toode ja sobivus
Kinnitame mudeli, saadavuse ja hinna. Sobivus olemasoleva süsteemiga sõltub kogu osade loendist.
Üleandmine ja tagastus
Üleandmine lepitakse kokku pärast saadavuse kinnitamist. Tagastus sõltub tellimuse olekust ja tingimustest.
Hinna alus
Leht eristab turuandmeid, planeerimishinnangut ja kirjalikku pakkumist. Komponendi hind ei sisalda terviksüsteemi teenust.