I augusti 2026 lade LM Studio till Qwen3.8-27B, en tät (dense) modell som tar både text och bild. Den 17 augusti beskrev AMD hur modellen körs på Ryzen AI Max+ och Radeon AI PRO R9700 – men 27 miljarder parametrar kräver fortfarande att din VRAM-budget är i ordning innan du börjar.
En stor modell kräver minnesutrymme
LM Studio beskriver Qwen3.8-27B som en modell för kod, professionellt arbete, research och agentuppgifter i många steg. 27 miljarder parametrar är ändå inget du laddar in i en vanlig ultrabook utan vidare. LM Studios modellsida listar vid kontrolltillfället en enda variant, qwen/qwen3.8-27b på 16,10 GB, och anger att den kräver minst 16 GB RAM.
Det AMD beskriver för LM Studio är körning på grafikprocessorn: mätningarna gjordes med llama.cpp och Vulkan-backend, och AMD anger att modellen behöver ungefär 24 GB grafikminne – VRAM eller tilldelat systemminne (VGM) – för att köras bekvämt. NPU nämns bara i beskrivningen av AMD:s egen Lemonade-server, inte för LM Studio. Hårdvarustödet tar inte bort behovet av minne för modellvikterna och kontextfönstret.
Tre kontrollsteg före nedladdning
Öppna posten för Qwen 3.8 i LM Studio och gå igenom följande innan du trycker på Download:
- Jämför minneskraven med ditt eget minne. LM Studio anger minst 16 GB RAM för varianten på 16,10 GB; AMD anger ungefär 24 GB grafikminne för att köra modellen bekvämt. Det är två olika mått – en lägsta nivå och en bekväm nivå – och båda gäller före kontextfönstret. Med exakt 16 GB totalt ligger du på gränsen.
- Kontrollera filstorleken. Den nedladdade filen ger dig ett golv för hur mycket minne modellen kommer att ockupera bara för att vila i minnet. Lämna utrymme även för operativsystemet och andra bakgrundsprogram.
- Beräkna kontextstorleken. Ett stort kontextfönster på 32K token eller mer bygger snabbt upp gigabyte av KV-cache i arbetsminnet. Använd LM Studios CLI-estimator (
lms load --estimate-only) om du är osäker. Den skriver ut en uppskattning av minnesåtgången utan att ladda modellen, och siffran ändras med kontextlängden du anger.
AMD-stödet i praktiken
AMD redovisar upp till 24,5 token per sekund på Ryzen AI Max+ 395 och upp till 51,8 token per sekund på Radeon AI PRO R9700, mätt i minst tre körningar med llama.cpp och Vulkan-backend under Windows och med multi-token prediction (MTP) påslagen. Siffrorna gäller AMD:s egna testuppställningar. Snabbare beräkning krymper inte minneskravet – det är fortfarande filstorleken plus kontextfönstret som avgör om modellen får plats.
Källor
- LM Studio – Qwen3.8: variant, filstorlek och minsta RAM
- AMD – Run Qwen 3.8 27B on AMD Ryzen AI Max and Radeon (17 augusti 2026): hårdvara, minnesbehov och mätvillkor
- LM Studio CLI –
lms loadoch minnesuppskattning med--estimate-only
LM Studios modellsida kontrollerades 10 september 2026. AMD:s inlägg lästes samma dag via en publicerad återgivning, eftersom AMD:s egen sida inte svarade på maskinell hämtning. Den första versionen av artikeln påstod NPU-acceleration och särskilda AMD-optimeringar i LM Studio; det har inget stöd i källorna och är borttaget. Minnesåtgång beror på exakt kvantisering och plattformens overhead.