Nyhet · LM Studio · minnesbudget

LM Studio lägger till stöd för Qwen 3.8 (27B) – gör minneskontrollen

Qwen 3.8 finns i LM Studio sedan första dagen, och AMD har beskrivit hur modellen körs på Ryzen AI Max+ och Radeon. Men innan du hämtar den 27 miljarder parametrar tunga modellen måste din hårdvara palla trycket.

Av C. Leijon · Publicerad · Senast granskad · 6 min läsning

En mörk, teknisk miljö med serverrack och maskinvara. En tung, svart datakassett med märkningen 27B skjuts in i ett fack. Bakgrunden har ett dämpat grönt ljus.
Den tunga kassetten representerar den stora 27B-modellen som ska laddas in i det lokala systemet, vilket kräver att hårdvarans minneskapacitet först är säkrad.

I augusti 2026 lade LM Studio till Qwen3.8-27B, en tät (dense) modell som tar både text och bild. Den 17 augusti beskrev AMD hur modellen körs på Ryzen AI Max+ och Radeon AI PRO R9700 – men 27 miljarder parametrar kräver fortfarande att din VRAM-budget är i ordning innan du börjar.

En stor modell kräver minnesutrymme

LM Studio beskriver Qwen3.8-27B som en modell för kod, professionellt arbete, research och agentuppgifter i många steg. 27 miljarder parametrar är ändå inget du laddar in i en vanlig ultrabook utan vidare. LM Studios modellsida listar vid kontrolltillfället en enda variant, qwen/qwen3.8-27b på 16,10 GB, och anger att den kräver minst 16 GB RAM.

Det AMD beskriver för LM Studio är körning på grafikprocessorn: mätningarna gjordes med llama.cpp och Vulkan-backend, och AMD anger att modellen behöver ungefär 24 GB grafikminne – VRAM eller tilldelat systemminne (VGM) – för att köras bekvämt. NPU nämns bara i beskrivningen av AMD:s egen Lemonade-server, inte för LM Studio. Hårdvarustödet tar inte bort behovet av minne för modellvikterna och kontextfönstret.

Tre kontrollsteg före nedladdning

Öppna posten för Qwen 3.8 i LM Studio och gå igenom följande innan du trycker på Download:

  1. Jämför minneskraven med ditt eget minne. LM Studio anger minst 16 GB RAM för varianten på 16,10 GB; AMD anger ungefär 24 GB grafikminne för att köra modellen bekvämt. Det är två olika mått – en lägsta nivå och en bekväm nivå – och båda gäller före kontextfönstret. Med exakt 16 GB totalt ligger du på gränsen.
  2. Kontrollera filstorleken. Den nedladdade filen ger dig ett golv för hur mycket minne modellen kommer att ockupera bara för att vila i minnet. Lämna utrymme även för operativsystemet och andra bakgrundsprogram.
  3. Beräkna kontextstorleken. Ett stort kontextfönster på 32K token eller mer bygger snabbt upp gigabyte av KV-cache i arbetsminnet. Använd LM Studios CLI-estimator (lms load --estimate-only) om du är osäker. Den skriver ut en uppskattning av minnesåtgången utan att ladda modellen, och siffran ändras med kontextlängden du anger.

AMD-stödet i praktiken

AMD redovisar upp till 24,5 token per sekund på Ryzen AI Max+ 395 och upp till 51,8 token per sekund på Radeon AI PRO R9700, mätt i minst tre körningar med llama.cpp och Vulkan-backend under Windows och med multi-token prediction (MTP) påslagen. Siffrorna gäller AMD:s egna testuppställningar. Snabbare beräkning krymper inte minneskravet – det är fortfarande filstorleken plus kontextfönstret som avgör om modellen får plats.

Källor

LM Studios modellsida kontrollerades 10 september 2026. AMD:s inlägg lästes samma dag via en publicerad återgivning, eftersom AMD:s egen sida inte svarade på maskinell hämtning. Den första versionen av artikeln påstod NPU-acceleration och särskilda AMD-optimeringar i LM Studio; det har inget stöd i källorna och är borttaget. Minnesåtgång beror på exakt kvantisering och plattformens overhead.

Nästa steg

Fyll i en minnesbudget med den variant du valt och verifiera att ditt AMD-system har tillräckligt med ledigt RAM eller VRAM.

Öppna minnesbudgeten