
En installation är klar först när du kan visa tre saker: att servern svarar på localhost:11434, att en modell svarar och att den ligger där du tror, på grafikkortet eller i vanligt arbetsminne. Den här guiden går igenom Ollama som vanlig Windows-app, installerad med OllamaSetup.exe i ditt eget användarkonto. Varje steg slutar med ett prov och ett facit som du läser av på din egen dator.
Den fristående zip-filen för tjänsteinstallation, Docker och WSL fungerar annorlunda och ingår inte. Har du inte bestämt vad den lokala modellen ska användas till, börja med kom igång-guiden. Står du fortfarande och väljer verktyg, läs Ollama eller LM Studio först.
1. Kontrollera Windows, minne och drivrutin
Ollamas Windows-dokumentation anger vid kontrollen 30 september 2026 tre krav: Windows 10 22H2 eller nyare (Home eller Pro), NVIDIA-drivrutin 551.61 eller nyare om du har ett NVIDIA-kort, och för AMD Radeon antingen en drivrutinsstack med stöd för ROCm v7 eller en Radeon-drivrutin med Vulkan. Kontrollera versionerna innan du installerar, så att ett senare CPU-resultat inte beror på en gammal drivrutin.
winver
nvidia-smi
Get-PSDrive C | Select-Object Used,Free
winver visar Windows-versionen. NVIDIA:s verktyg nvidia-smi gäller bara NVIDIA-kort och visar bland annat den installerade drivrutinens version och grafikkortets totala minne. Med AMD-kort läser du drivrutinsversionen i AMD:s egen programvara. Oavsett kort ser du det dedikerade grafikminnet i Aktivitetshanteraren under Prestanda och GPU. Anteckna det talet; det styr modellvalet i steg 3.
Dokumentationen påpekar att vissa RDNA2-system, till exempel kort i RX 6000-serien, kanske inte får ROCm v7 med dagens Windowsdrivrutiner. Vulkan är då påslaget som standard och den rekommenderade reserven. Har datorn både inbyggd och separat grafik kan variabeln GGML_VK_VISIBLE_DEVICES peka ut det separata kortet.
Kontrollera också disken. Själva programmet kräver minst 4 GB, och dokumentationen säger att modellerna kan ta tiotals till hundratals GB. Är systemdisken trång, bestäm redan nu var modellerna ska ligga (se steg 5), så att du slipper flytta dem senare.
2. Installera med OllamaSetup.exe
Hämta installationsprogrammet från ollama.com/download eller som filen OllamaSetup.exe under en utgåva på GitHub. Vid kontrollen var v0.35.0 från 28 september 2026 senaste ordinarie utgåva, medan v0.35.1-rc0 och v0.40.0-rc0 var märkta som förhandsutgåvor. Välj en ordinarie utgåva; en rc-version är till för den som vill prova ändringar i förväg.
Installationen kräver inte administratör och lägger programmet i din hemkatalog. Vill du ha programfilerna på en annan disk startar du installationsprogrammet från PowerShell i den mapp där filen ligger, med flaggan /DIR:
.\OllamaSetup.exe /DIR="D:\Ollama"
Flaggan flyttar bara programmet, inte modellerna. Efter installationen körs Ollama i bakgrunden med en ikon i aktivitetsfältet, och installationsprogrammet lägger programkatalogen i användarens PATH. Öppna därför ett nytt PowerShell-fönster och kör provet:
Get-Command ollama
Invoke-RestMethod http://localhost:11434/api/tags
Facit: Get-Command visar en sökväg till ollama.exe, och anropet mot /api/tags ger ett svar med fältet models. Listan är tom innan du har hämtat något, och det är rätt. Hittas inte kommandot i ett gammalt fönster men väl i ett nytt, var det bara PATH som inte hade lästs om.
Inloggningsfrågan. Sedan v0.34.2 kan en förstagångsinställning fråga om du vill logga in eller fortsätta lokalt. Enligt ändringens beskrivning visas den när du kör ollama utan underkommando, medan ollama run är oförändrat, och valet delas med skrivbordsappen. Välj att fortsätta lokalt om du bara ska köra modeller på den egna datorn. Vill du stänga av molnfunktionerna helt beskriver artikeln om inloggningsfrågan både variabeln och kontrollraden i loggen.
3. Kör en första modell som ryms i minnet
Välj inte den första modellen efter namn utan efter ditt grafikminne från steg 1. Ollamas egna Windows-exempel använder llama3.2, som därför fungerar som startmodell här. Hämta den först utan att köra den, så att du ser storleken innan den laddas:
ollama pull llama3.2
ollama list
Kolumnen SIZE i ollama list är filens storlek på disk. Minnesbehovet vid körning är större, eftersom kontexten också tar plats; Ollamas FAQ anger 4096 token som standardkontext. En enkel tumregel: är filen nära eller över ditt dedikerade grafikminne, välj en mindre variant av modellen i stället för att hoppas. Ligger den tydligt under, kör den:
ollama run llama3.2 "Svara med en mening: vilken färg har himlen en klar dag?"
Facit är ett svar i terminalen. Svarets kvalitet säger inget om installationen; det är nästa steg som visar var modellen körs. Vill du jämföra modeller på riktiga uppgifter hör det till pilotplaneringen, inte till installationen.
4. Bekräfta att grafikkortet används
Enligt FAQ:n ligger en modell kvar i minnet fem minuter efter senaste anropet. Kör därför provet direkt efter svaret i steg 3:
ollama ps
Läs kolumnen PROCESSOR. 100% GPU betyder att hela modellen ligger i grafikminnet. 100% CPU betyder att den ligger i vanligt arbetsminne. En delning som 48%/52% CPU/GPU betyder att den inte rymdes helt på kortet. Anteckna också kolumnen SIZE i ollama ps, storleken för den laddade modellen, och jämför den med grafikminnet nästa gång du väljer modell.
Visar provet CPU fast du har ett kort som stöds, kontrollera i ordning: drivrutinsversionen mot kraven i steg 1, att modellen faktiskt ryms (en delning pekar på minnet, inte på drivrutinen) och sedan serverloggen. Frigör minnet med ollama stop llama3.2 när du är klar.
5. Hitta modeller, loggar och program
Windows-dokumentationen listar fyra platser. Öppna dem med Win+R och kommandot i vänster kolumn:
| Kommando | Innehåll |
|---|---|
explorer %LOCALAPPDATA%\Ollama | Loggar och hämtade uppdateringar: app.log, server.log, upgrade.log |
explorer %LOCALAPPDATA%\Programs\Ollama | Programfilerna (om du inte valde /DIR) |
explorer %HOMEPATH%\.ollama | Modeller och konfiguration |
explorer %TEMP% | Temporära körbara filer i mappar som börjar med ollama |
server.log är den fil du öppnar när steg 4 inte ger väntat resultat. För att lägga nya modeller på en annan disk skapar du användarvariabeln OLLAMA_MODELS med den nya sökvägen via Windows inställning för miljövariabler, avslutar Ollama i aktivitetsfältet och startar appen igen från Start-menyn. Har du redan hämtat modeller visar flyttartikeln hur du tar med dem utan att ladda ner dem igen.
6. Uppdatera eller avinstallera utan att tappa modellerna
Ollama för Windows hämtar uppdateringar själv. Du installerar dem genom att klicka på ikonen i aktivitetsfältet och välja Restart to update, eller genom att hämta den senaste versionen manuellt. Kör ollama ps och steg 4 igen efter en uppdatering, eftersom en ny version kan ändra hur kortet används.
Avinstallation sker under Lägg till eller ta bort program i Windows Inställningar. Här finns en fallgrop: dokumentationen lovar bara att hämtade modeller blir kvar om du har ändrat OLLAMA_MODELS. Om modeller på standardplatsen säger den ingenting uttryckligen. Vill du behålla modellerna vid en ominstallation, ge dem en egen plats först eller kopiera katalogen innan du avinstallerar.
Ollama registreras också för att starta vid inloggning. Stäng av det i Aktivitetshanteraren under Autostartsappar; enligt FAQ:n står inställningen kvar genom uppgraderingar men inte genom en avinstallation.
Så vet du att du är klar
Invoke-RestMethod http://localhost:11434/api/tagssvarar och listar din modell.ollama psvisade100% GPUdirekt efter ett svar, eller så vet du varför den inte gjorde det.- Du har antecknat Ollama-version, drivrutinsversion, modellens storlek i
ollama psoch var modellerna ligger, gärna i driftkortet.
Vill du ha ett chattfönster i webbläsaren ovanpå installationen fortsätter du med guiden om Open WebUI.
Källor
- Ollama, Windows: systemkrav, drivrutinsversioner, installation utan administratör, /DIR, OLLAMA_MODELS, filplatser och avinstallation.
- Ollama, FAQ: uppdatering, ollama ps och PROCESSOR-kolumnen, fem minuter i minnet, standardkontext och autostart.
- Ollama, List models: anslutningsprovet mot /api/tags.
- Ollama på GitHub, utgåvor: v0.35.0 som ordinarie utgåva och förhandsutgåvorna vid kontrollen; v0.34.2 med förstagångsinställningen.
- Ollama på GitHub, PR #18495: när förstagångsinställningen visas.
- NVIDIA, nvidia-smi: avläsning av drivrutinsversion och grafikminne.
Källorna kontrollerades 30 september 2026. Kommandon, prov och facit är en föreslagen rutin. Ingen egen installation, modellkörning eller mätning har utförts, och guiden anger inga modellstorlekar eller hastigheter.