Lokal inferens · privata data · kontrollerad drift

Kör AI lokalt — med kontroll över data och drift

Praktiska svenska guider för dig som vill köra språkmodeller på en egen dator eller server — från arbetslast och minnesbudget till integritet och stabil drift.

Var ska jag börja?
En matt svart låda står på en mörk bänkskiva i ett mörkt rum med gröna ljusinslag; på lådans framsida lyser en liten skärm med rader av grön och vit text, och en svart kabel går från ett uttag nedtill på lådan över bänken. Till vänster lutar en svart arbetslampa över ett tangentbord, och i bakgrunden hänger inramade bilder på väggen.Guide · 26 sep 2026

Open WebUI med Ollama: installera ett lokalt chattfönster

Docker eller Python 3.11/3.12, rätt adress till Ollama, en WEBUI_SECRET_KEY som ligger kvar och ett adminkonto med stängd registrering. Avsluta med tre prov och facit: modellen syns, ingen andra person kan registrera sig och chattsvaret kommer utan nät.

10 min läsningFaktakontrollerad 26 sep 2026
Installera och pröva →
En mörk, fyrkantig metallenhet med rundade hörn sitter i en svart panelvägg; i dess inre ligger flera nedsänkta fyrkantiga ramar i lager kring ett litet block, och under enheten lyser en smal grön springa med ett svagt grönt sken nedåt.Nyhet · 25 sep 2026

Ollama 0.34.4 ger JSON-schema från tänkande modeller i ett pass – mät formen med tänkandet på

Releasen lovar snabbare och mer tillförlitlig strukturerad utdata från tänkande modeller: tänkandet går fritt och bara svaret efter det tvingas in i schemat, i en enda generering. Kör tio anrop med tänkandet på och av och räkna giltig JSON, svarstid och läckage.

6 min läsningFaktakontrollerad 25 sep 2026
Kör tioanropsprovet →
Tre mörka metallådor på en bänk i ett mörkt rum: en stor låda med en sköld på framsidan står bakom två mindre, där den vänstra är öppen i sidan och visar hyllor med komponenter och den högra har en sköld och en front med små lådfack; till vänster skymtar en varmt upplyst hylla i oskärpa.Nyhet · 24 sep 2026

Open WebUI 0.11.4 täpper säkerhetsluckor – pröva vad slim-imagen tappar innan du byter

Releasen ber dig uppdatera produktion snarast för säkerhets- och behörighetsfixar. Slim-imagen på cirka 175 MB vägrar starta på MySQL eller S3 och tappar PDF-läsning, tal och DDGS-webbsök utan externa tjänster — gå igenom förprovslistan innan du byter.

10 min läsningFaktakontrollerad 24 sep 2026
Gå igenom förprovet →
Fyra mörka block i stigande höjd står som ett stapeldiagram på en bänkskiva i ett mörkgrönt rum, omslutna av en smal metallram; en mätklocka på stativ lutar mot det högsta blocket och längre bak står ett skjutmått, en matt metallåda och två uppställda protokollblad.Nyhet · 23 sep 2026

Splash kör Qwen lokalt på Apple Silicon — kontrollera M3, macOS 26.4 och 36 GB före installationen

LM Studios experimentella backend Splash kräver M3 eller nyare, macOS 26.4 och minst 36 GB unified memory, och stöder två Qwen-modeller. Bocka av kraven på två minuter och mät sedan själv — inläggets tal om 74 och 170 token per sekund är Incos, mätta på en 48 GB M5 Pro.

8 min läsningFaktakontrollerad 23 sep 2026
Kontrollera kraven →
En matt svart apparatlåda med bygelhandtag står på en grågrön bänkskiva framför mörkgröna väggskivor; på lådans främre panel sitter en rad med fem tomma runda hål, och en flätad kabel löper ut ur lådans vänstra sida och ner över bänkkanten. Till höger står en fristående plåt lutad bakåt i en låg fot, med fyra runda vred i två rader och en blank grå lapp fäst i plåtens övre högra hörn.Nyhet · 22 sep 2026

llama-server läser nu temperatur och top-p ur miljövariabler – sätt förvalen i tjänstefilen i stället för kommandoraden

Bygge b11078 ger --temp, --top-p, --min-p och de tre straffparametrarna egna LLAMA_ARG-variabler. Flytta förvalen till en EnvironmentFile, se vad serverns README säger om företrädet och läs av vad servern faktiskt kör med i generation_settings.

7 min läsningFaktakontrollerad 22 sep 2026
Flytta förvalen →
EnArtikel · 21 sep 2026

Samma fråga tio gånger: mät hur mycket den lokala modellen varierar innan du sätter temperatur och seed

Kör samma prompt tio gånger vid tre inställningar, räkna unika svar och svar som skiljer sig i sak och sätt sedan temperature och seed med mätt skäl. Med förvalen i Ollama, llama.cpp-servern och LM Studio som de står i dokumentationen 21 september 2026.

13 min läsningFaktakontrollerad 21 sep 2026
Mät variationen →
En mörk cylinder med ett lysande fönster med tre staplar står på en metallhylla; framför den ligger ett stoppur och till höger syns en öppen mörk dörr.Nyhet · 19 sep 2026

Ollama 0.34.3-rc1 visar modellens tänknivåer i /api/show – mät innan du låser nivån

Förhandsversionen visar vilka think-nivåer modellen tar och dess förval. Kör samma prompt med av, low, high och max och fyll en tabell med första svarstoken, total tid och tänkspårets längd.

4 min läsningFaktakontrollerad 19 sep 2026
Mät tänknivåerna →
En mörk datorlåda står på ett ljust, slitet bord mot en grön vägg; på sidan lyser en liten vit ringformad lampa. Framför lådan står en vägvisare i trä med två pilar åt var sitt håll, ett litet trähus i klossform och en liten mässingsnyckel, och till höger ligger en hoprullad svart sladd med USB-kontakt.Nyhet · 18 sep 2026

Ollama 0.34.2 frågar om inloggning första gången du kör den – så fortsätter du lokalt och stänger av molnet

Förstagångsdialogen ger två val: logga in i webbläsaren eller fortsätt lokalt. Inloggningen gäller molnmodeller och webbsökning. Se vilka kommandon som visar dialogen, var valet sparas per operativsystem och hur OLLAMA_NO_CLOUD eller server.json stänger molnet med en loggrad som kvitto.

9 min läsningFaktakontrollerad 18 sep 2026
Stäng av molnet →
Ett platt, matt svart serverchassi står på en svart bänk framför en mörkgrön vägg; i chassits främre öppning lyser en liten vit statuslampa och en tunn modul med gallerfront sticker ut ur fronten, medan en likadan modul ligger på en mörk, markerad yta på bänken bredvid; en grön ljuslist löper längs bänkens underkant ovanför ett trägolv.Artikel · 17 sep 2026

Uppdateringen bröt något? Backa Ollama och llama.cpp till förra versionen – och lås den tills du provat

Läs av versionen som kör, hämta den senast fungerande utgåvan av Ollama eller ett pinnat llama.cpp-bygge, kör samma prov före och efter och fyll i ett versionskort. Med gränsen för autouppdatering på macOS och Windows.

10 min läsningFaktakontrollerad 17 sep 2026
Backa versionen →
En tjock svart kabel går från ett vägguttag i en mörkgrön vägg, i en vid slinga över ett ljust trägolv och upp i en svart mätdosa med vit urtavla och nål, monterad på framsidan av ett mörkgrått maskinskåp; till höger skymtar en mörkgrön panel med runda vred och små vita indikatorer.Artikel · 16 sep 2026

Vad drar den lokala modellen i el? Mät watt per svar och räkna om till kronor

Mät grundtomgång, laddad tomgång och generering var för sig med en uttagsmätare och nvidia-smi. Räkna om watt till wattimmar per svar och sätt en månadskostnad på ditt eget elpris.

9 min läsningFaktakontrollerad 16 sep 2026
Mät energiposten →
En svart datorlåda med sidofönster står på en mörk bänk; innanför fönstret lyser en fläkt och ett grafikkort i grönt, en grön ljuslist löper längs lådans underkant och på fronten sitter ett grönt ormliknande märke. Framför lådan står en liten mikrofon på ett trebensstativ med sladden hängande ner, och på bänkkanten ligger en pappersremsa med ett tryckt vågformsmönster.Nyhet · 15 sep 2026

LM Studio Bionic 1.1.3 ger röstinmatning på Linux – lokal Voxtral, NVIDIA-GPU enligt changeloggen: prova svenska och mät minnet

Bionic 1.1.3 ger lokal rösttranskription på Linux med Voxtral. Changeloggen anger NVIDIA-GPU, dokumentationen saknar minnesbehov och språklista. Kontrollera GPU:n, mät minnet före och efter röstmodellen och kör ett dikteringsprov på svenska.

8 min läsningFaktakontrollerad 15 sep 2026
Mät röstmodellen →
En svart, platt apparatlåda står på en mörk bänkskiva framför suddiga gardiner och en soffa; på frontplattan sitter ett runt metallvred med grön ljusring bredvid fyra små skåror, och till vänster ligger en lös svart plåt med tre små vippbrytare.Nyhet · 14 sep 2026

llama.cpp 0.4.1 tar bort --mmap, --mlock och --direct-io – byt till --load-mode innan servern vägrar starta

Tre utfasade laddningsflaggor är borta ur argumenttolken och startskript som bär dem stoppar med invalid argument. Översätt till --load-mode enligt PR-diffen och mät laddtid och minne före och efter.

8 min läsningFaktakontrollerad 14 sep 2026
Byt till --load-mode →
Nyhet · 10 sep 2026

LM Studio 0.4.24 håller bild och text i samma meddelande – kontrollera det multimodala API:t

Skicka en syntetisk bild och instruktion i samma input-lista och spara version, modell, begäran och svar som ett reproducerbart prov.

8 min läsningFaktakontrollerad 10 sep 2026
Kontrollera API-anropet →
En liten grå datorlåda med öppen sidopanel står på en hylla mot en mörkgrön vägg, med ett grönlysande kretskort synligt inuti; en smal grön ljuslinje delar bilden och till höger står en större mörk låda i skugga på ett trägolv.Nyhet · 9 sep 2026

LM Studio Bionic finns nu för Linux på x64 och ARM64 – gör hårdvarukontrollen före installationen

Changelogposten ger appen två arkitekturer. Ta reda på om burken är x64 eller ARM64, läs vad kravsidan faktiskt säger om Linux och räkna minnesbudgeten före nedladdningen.

8 min läsningFaktakontrollerad 9 sep 2026
Gör hårdvarukontrollen →
Tunna gröna trådar löper från en hylla med grå dokumentmappar in i en svart låda med spjälad front, där en ljus vit linje lyser bland de gröna.Artikel · 8 sep 2026

Sök i dina egna dokument lokalt: bygg ett facit med tio frågor innan du litar på svaret

Bygg sökningen på Ollamas /api/embed, lägg tio frågor med känt facit bredvid och räkna om träff@1 efter varje ändring av stycken, prefix eller dimension.

8 min läsningFaktakontrollerad 8 sep 2026
Bygg facitet →
Två svarta kablar lämnar samma port på en låg svart metallåda; den ena slutar i ett litet slutet hölje intill, den andra löper ut ur bilden och en grön lampa lyser mellan dem.Nyhet · 7 sep 2026

Ollama 0.34.0-rc1 kopplar ChatGPT Desktop till din lokala modell – mät gränsen innan du litar på den

Utgåvan är en release candidate och dokumentationen säger ingenting om vad som skickas vart. Fyll ett mätprotokoll per fråga i stället för att anta.

7 min läsningFaktakontrollerad 7 sep 2026
Fyll mätprotokollet →
Artikel · 5 sep 2026

Två frågor samtidigt i Ollama: skilj kötid från långsam generering

Kör ett kontrollerat Ollama-prov med en och två samtidiga frågor. Jämför klienttid, generering och minne och välj parallellitet, kögräns och återförsök.

8 min läsningFaktakontrollerad 5 sep 2026
Fyll kapacitetsprotokollet →
En svart kompakt datorlåda på grått underlag med ribbad ovansida, tre infällda paneler, ett runt uttag och gröna statuslampor. Nyhet · 4 sep 2026

Prova Gemma 4 med bild och WAV-ljud i Ollamas MLX-motor

Frys version och modelldigest, kontrollera kapabiliteterna och skilj sedan stöd, avvisning och undermåligt svar i tre separata prov.

6 min läsningFaktakontrollerad 19 sep 2026
Kör modalitetsprovet →
Ett svart serverchassi med en öppen sektion där grönt ljus lyser över kretskort och staplade komponenter. Nyhet · 3 sep 2026

Ollama visar hur mycket av prompten som kom från cache

Kör samma API-kropp två gånger och skilj logiska prompttoken, cacheträffar och faktiskt bearbetade token innan du jämför hastighet.

6 min läsningFaktakontrollerad 19 sep 2026
Mät cacheträffen →
En utdragen svart metallmodul i ett mörkt chassi, med en rad svarta vred längs sidan och gröna statuslampor inuti. Nyhet · 2 sep 2026

Ollama 0.33.3-rc0 börjar läsa GGUF-modellens egna förval

Frys version, modellfil och prompt. Jämför sedan ett ärvt och ett uttryckligen låst läge före och efter förhandsversionen.

10 min läsningFaktakontrollerad 19 sep 2026
Frys grundläget →
Artikel · 1 sep 2026

Hur stor kontext klarar din Ollama-modell?

Höj num_ctx stegvis och mät när modellen lämnar GPU:n, passerar din minnesbudget eller blir för långsam för arbetslasten.

8 min läsningFaktakontrollerad 1 sep 2026
Hitta din gräns →
En räfflad ratt ligger loss på en svart platta bredvid en lossad ring, bakom dem en stapel identiska skivor i en smal kanal och en rund mätare vid en grönt upplyst panel. Nyhet · 31 aug 2026

Repetitionsstraffet är avstängt i Ollama – märks det på din modell?

Sedan 0.32.10 den 12 augusti 2026 får modeller utan eget repeat_penalty värdet 1.0. Kontrollera din modell och mät skillnaden med samma frysta prompt.

10 min läsningFaktakontrollerad 31 aug 2026
Kontrollera din modell →
Nyhet · 30 aug 2026

DFlash, DSpark eller MTP i LM Studio? Mät på din dator

LM Studio 0.4.22 får tre assistant drafters. Ett fryst fyrkörningsprov visar om någon förbättrar hastighet eller första token utan att minnet eller svaret försämras.

8 min läsningFaktakontrollerad 30 aug 2026
Bygg ditt grundläge →
Nyhet · 28 aug 2026

Auto Review i LM Studio: vad grinden inte fångar

Genomgången från 27 augusti 2026 anger själv sina antaganden: en icke-fientlig miljö förutsätts, en sandlåda löser inte problemet och promptinjektion går inte att stänga ute helt.

16 min läsningFaktakontrollerad 19 sep 2026
Läs antagandena →
Nyhet · 27 aug 2026

Ollama 0.33.1 tvingar fram JSON-schemat på MLX-runnern

Patchutgåvan gäller Apple Silicon: format-fältet togs emot utan verkan på MLX-vägen, och Metal-timeouten vid laddning från långsam disk är rättad.

15 min läsningFaktakontrollerad 19 sep 2026
Kontrollera din runner →
Nyhet · 26 aug 2026

Ollama 0.33 kopplar Claude Desktop till din lokala modell

Integrationen finns för macOS, modellen ska vara nedladdad före uppsättningen och webbsökningen går fortfarande via Ollamas tjänst.

11 min läsningFaktakontrollerad 26 aug 2026
Läs kravlistan →
Artikel · 25 aug 2026

Tvinga fram giltig JSON från en lokal modell

Lås formen med ett JSON-schema i Ollama eller en GBNF-grammatik i llama.cpp, och mät hur ofta låset håller.

9 min läsningFaktakontrollerad 25 aug 2026
Lås formatet →
Mörkt teknikrum med svarta serverrack, en vit konfigurationssida och gröna statuslampor. Artikel · 24 aug 2026

Importera en GGUF-modell till Ollama med en Modelfile

Peka ut filen med FROM, lås parametrar och systemprompt, bygg med ollama create och kontrollera vad som faktiskt blev importerat.

10 min läsningFaktakontrollerad 24 aug 2026
Gör importen →
Artikel · 23 aug 2026

Ollama håller kvar modellen i minnet: mät och styr keep-alive

Mät vad som ligger kvar efter svaret, prova direkt urlastning och välj keep-alive efter glappet mellan anrop.

6 min läsningFaktakontrollerad 23 aug 2026
Gör minnesprovet →
Artikel · 22 augusti 2026

Är modellen bra på svenska?

Kör fem fasta svenska prov tre gånger och poängsätt instruktioner, format, saklighet och ton.

7 min läsningFaktakontrollerad 22 augusti 2026
Kör proven →
Nyhet · 21 augusti 2026

Ollama 0.32.15: snabbare första token — mellan anrop

Metadatacachen gäller upprepade anrop, inte kallstarten. Så läser du utgåvans siffra och kör om rätt mätpunkt.

9 min läsningFaktakontrollerad 10 september 2026
Läs nyheten →
Artikel · 20 augusti 2026

Flytta Ollama-modeller till en annan disk

Kopiera modellkatalogen, växla med OLLAMA_MODELS och prova både start och återställning innan originalet tas bort.

8 min läsningFaktakontrollerad 20 augusti 2026
Flytta modellerna →
Artikel · 19 augusti 2026

Vilken kvantisering ska du välja?

Vad Q4, Q5 och Q8 kostar i minne och kvalitet — med räknesätt och ett prov för din egen maskin.

10 min läsningFaktakontrollerad 19 augusti 2026
Läs artikeln →
Nyhet · 18 augusti 2026

Ollama stöder Nemotron 3.5 Lightning (30B)

Kör NVIDIAs agent-optimerade modell lokalt, men verifiera dina hårdvarukrav först.

3 min läsningFaktakontrollerad 10 september 2026
Läs artikeln →
Nyhet · 17 augusti 2026

LM Studio lägger till stöd för Qwen 3.8 (27B) – gör minneskontrollen

Kontrollera filstorlek, ledigt RAM och VRAM innan du laddar ner och kör den nya Qwen-modellen på din lokala maskin.

3 min läsningFaktakontrollerad 10 september 2026
Gör kontrollen →
Senast publicerat · 16 augusti 2026

Muse Glimmer 30B: kontrollera minnet först

Skilj modellfil, system-RAM och VRAM åt innan du hämtar den nya LM Studio-modellen.

8 min läsningFaktakontrollerad 10 september 2026
Gör kontrollen →
Senast publicerat · 15 augusti 2026

Kallstart eller långsam modell?

Mät laddning, promptbearbetning och generering var för sig med samma kontrollerade anrop.

7 min läsningFaktakontrollerad 15 augusti 2026
Gör testet →
Senast publicerat · 14 augusti 2026

Sårbarhet i llama-server: kontrollera ditt bygge

Kontrollera byggnumret och om den berörda flaggan finns i startkommandot.

6 min läsningFaktakontrollerad 10 september 2026
Läs nyheten →
Guide · startpunkt

Kom igång med lokal AI utan att börja i fel ände

Definiera uppgiften, kontrollera dataflödet och prova minsta fungerande modell på den maskin som faktiskt ska användas.

Läs guiden →
Hårdvara

Räkna på minne och verklig kapacitet

Bedöm GPU, delat minne och CPU utifrån modell, kontext och samtidighet.

Bedöm maskinen →
Modeller

Välj med ett eget provpaket

Jämför kvalitet, formatföljsamhet, språk, latens och licens.

Jämför modeller →
Verktyg

Från skrivbordsapp till server

Välj körmiljö efter användare, åtkomst och driftansvar.

Jämför körsätten →
Drift

Uppdatera och backa tillbaka

Versionera modell, runtime och konfiguration och prova återställningen.

Bygg driftplanen →
Integritet

Bevisa vad som stannar lokalt

Inventera nätverk, lagring, loggar, behörigheter och radering.

Rita datagränsen →
Jämförelse · 13 augusti 2026

Ollama eller LM Studio?

Välj efter arbetsflöde, lokal server, offlinebeteende och driftansvar.

Läs artikeln →

Guider

Från första pilot till kontrollerad drift

Välj den del av installationen du arbetar med just nu.

Artiklar

Aktuella jämförelser och fördjupningar

Daterade texter med primärkällor och tydlig kontrolltidpunkt.

En mörk, fyrkantig metallenhet med rundade hörn sitter i en svart panelvägg; i dess inre ligger flera nedsänkta fyrkantiga ramar i lager kring ett litet block, och under enheten lyser en smal grön springa med ett svagt grönt sken nedåt.Nyhet · 25 sep 2026

Ollama 0.34.4 ger JSON-schema från tänkande modeller i ett pass – mät formen med tänkandet på

Releasen lovar snabbare och mer tillförlitlig strukturerad utdata från tänkande modeller: tänkandet går fritt och bara svaret efter det tvingas in i schemat, i en enda generering. Kör tio anrop med tänkandet på och av och räkna giltig JSON, svarstid och läckage.

6 min läsningFaktakontrollerad 25 sep 2026
Kör tioanropsprovet →
Tre mörka metallådor på en bänk i ett mörkt rum: en stor låda med en sköld på framsidan står bakom två mindre, där den vänstra är öppen i sidan och visar hyllor med komponenter och den högra har en sköld och en front med små lådfack; till vänster skymtar en varmt upplyst hylla i oskärpa.Nyhet · 24 sep 2026

Open WebUI 0.11.4 täpper säkerhetsluckor – pröva vad slim-imagen tappar innan du byter

Releasen ber dig uppdatera produktion snarast för säkerhets- och behörighetsfixar. Slim-imagen på cirka 175 MB vägrar starta på MySQL eller S3 och tappar PDF-läsning, tal och DDGS-webbsök utan externa tjänster — gå igenom förprovslistan innan du byter.

10 min läsningFaktakontrollerad 24 sep 2026
Gå igenom förprovet →
Fyra mörka block i stigande höjd står som ett stapeldiagram på en bänkskiva i ett mörkgrönt rum, omslutna av en smal metallram; en mätklocka på stativ lutar mot det högsta blocket och längre bak står ett skjutmått, en matt metallåda och två uppställda protokollblad.Nyhet · 23 sep 2026

Splash kör Qwen lokalt på Apple Silicon — kontrollera M3, macOS 26.4 och 36 GB före installationen

LM Studios experimentella backend Splash kräver M3 eller nyare, macOS 26.4 och minst 36 GB unified memory, och stöder två Qwen-modeller. Bocka av kraven på två minuter och mät sedan själv — inläggets tal om 74 och 170 token per sekund är Incos, mätta på en 48 GB M5 Pro.

8 min läsningFaktakontrollerad 23 sep 2026
Kontrollera kraven →
En matt svart apparatlåda med bygelhandtag står på en grågrön bänkskiva framför mörkgröna väggskivor; på lådans främre panel sitter en rad med fem tomma runda hål, och en flätad kabel löper ut ur lådans vänstra sida och ner över bänkkanten. Till höger står en fristående plåt lutad bakåt i en låg fot, med fyra runda vred i två rader och en blank grå lapp fäst i plåtens övre högra hörn.Nyhet · 22 sep 2026

llama-server läser nu temperatur och top-p ur miljövariabler – sätt förvalen i tjänstefilen i stället för kommandoraden

Bygge b11078 ger --temp, --top-p, --min-p och de tre straffparametrarna egna LLAMA_ARG-variabler. Flytta förvalen till en EnvironmentFile, se vad serverns README säger om företrädet och läs av vad servern faktiskt kör med i generation_settings.

7 min läsningFaktakontrollerad 22 sep 2026
Flytta förvalen →
EnArtikel · 21 sep 2026

Samma fråga tio gånger: mät hur mycket den lokala modellen varierar innan du sätter temperatur och seed

Kör samma prompt tio gånger vid tre inställningar, räkna unika svar och svar som skiljer sig i sak och sätt sedan temperature och seed med mätt skäl. Med förvalen i Ollama, llama.cpp-servern och LM Studio som de står i dokumentationen 21 september 2026.

13 min läsningFaktakontrollerad 21 sep 2026
Mät variationen →
En mörk cylinder med ett lysande fönster med tre staplar står på en metallhylla; framför den ligger ett stoppur och till höger syns en öppen mörk dörr.Nyhet · 19 sep 2026

Ollama 0.34.3-rc1 visar modellens tänknivåer i /api/show – mät innan du låser nivån

Förhandsversionen visar vilka think-nivåer modellen tar och dess förval. Kör samma prompt med av, low, high och max och fyll en tabell med första svarstoken, total tid och tänkspårets längd.

4 min läsningFaktakontrollerad 19 sep 2026
Mät tänknivåerna →
En mörk datorlåda står på ett ljust, slitet bord mot en grön vägg; på sidan lyser en liten vit ringformad lampa. Framför lådan står en vägvisare i trä med två pilar åt var sitt håll, ett litet trähus i klossform och en liten mässingsnyckel, och till höger ligger en hoprullad svart sladd med USB-kontakt.Nyhet · 18 sep 2026

Ollama 0.34.2 frågar om inloggning första gången du kör den – så fortsätter du lokalt och stänger av molnet

Förstagångsdialogen ger två val: logga in i webbläsaren eller fortsätt lokalt. Inloggningen gäller molnmodeller och webbsökning. Se vilka kommandon som visar dialogen, var valet sparas per operativsystem och hur OLLAMA_NO_CLOUD eller server.json stänger molnet med en loggrad som kvitto.

9 min läsningFaktakontrollerad 18 sep 2026
Stäng av molnet →
Ett platt, matt svart serverchassi står på en svart bänk framför en mörkgrön vägg; i chassits främre öppning lyser en liten vit statuslampa och en tunn modul med gallerfront sticker ut ur fronten, medan en likadan modul ligger på en mörk, markerad yta på bänken bredvid; en grön ljuslist löper längs bänkens underkant ovanför ett trägolv.Artikel · 17 sep 2026

Uppdateringen bröt något? Backa Ollama och llama.cpp till förra versionen – och lås den tills du provat

Läs av versionen som kör, hämta den senast fungerande utgåvan av Ollama eller ett pinnat llama.cpp-bygge, kör samma prov före och efter och fyll i ett versionskort. Med gränsen för autouppdatering på macOS och Windows.

10 min läsningFaktakontrollerad 17 sep 2026
Backa versionen →
En tjock svart kabel går från ett vägguttag i en mörkgrön vägg, i en vid slinga över ett ljust trägolv och upp i en svart mätdosa med vit urtavla och nål, monterad på framsidan av ett mörkgrått maskinskåp; till höger skymtar en mörkgrön panel med runda vred och små vita indikatorer.Artikel · 16 sep 2026

Vad drar den lokala modellen i el? Mät watt per svar och räkna om till kronor

Mät grundtomgång, laddad tomgång och generering var för sig med en uttagsmätare och nvidia-smi. Räkna om watt till wattimmar per svar och sätt en månadskostnad på ditt eget elpris.

9 min läsningFaktakontrollerad 16 sep 2026
Mät energiposten →
En svart datorlåda med sidofönster står på en mörk bänk; innanför fönstret lyser en fläkt och ett grafikkort i grönt, en grön ljuslist löper längs lådans underkant och på fronten sitter ett grönt ormliknande märke. Framför lådan står en liten mikrofon på ett trebensstativ med sladden hängande ner, och på bänkkanten ligger en pappersremsa med ett tryckt vågformsmönster.Nyhet · 15 sep 2026

LM Studio Bionic 1.1.3 ger röstinmatning på Linux – lokal Voxtral, NVIDIA-GPU enligt changeloggen: prova svenska och mät minnet

Bionic 1.1.3 ger lokal rösttranskription på Linux med Voxtral. Changeloggen anger NVIDIA-GPU, dokumentationen saknar minnesbehov och språklista. Kontrollera GPU:n, mät minnet före och efter röstmodellen och kör ett dikteringsprov på svenska.

8 min läsningFaktakontrollerad 15 sep 2026
Mät röstmodellen →
En svart, platt apparatlåda står på en mörk bänkskiva framför suddiga gardiner och en soffa; på frontplattan sitter ett runt metallvred med grön ljusring bredvid fyra små skåror, och till vänster ligger en lös svart plåt med tre små vippbrytare.Nyhet · 14 sep 2026

llama.cpp 0.4.1 tar bort --mmap, --mlock och --direct-io – byt till --load-mode innan servern vägrar starta

Tre utfasade laddningsflaggor är borta ur argumenttolken och startskript som bär dem stoppar med invalid argument. Översätt till --load-mode enligt PR-diffen och mät laddtid och minne före och efter.

8 min läsningFaktakontrollerad 14 sep 2026
Byt till --load-mode →
Nyhet · 10 sep 2026

LM Studio 0.4.24 håller bild och text i samma meddelande – kontrollera det multimodala API:t

Skicka en syntetisk bild och instruktion i samma input-lista och spara version, modell, begäran och svar som ett reproducerbart prov.

8 min läsningFaktakontrollerad 10 sep 2026
Kontrollera API-anropet →
En liten grå datorlåda med öppen sidopanel står på en hylla mot en mörkgrön vägg, med ett grönlysande kretskort synligt inuti; en smal grön ljuslinje delar bilden och till höger står en större mörk låda i skugga på ett trägolv.Nyhet · 9 sep 2026

LM Studio Bionic finns nu för Linux på x64 och ARM64 – gör hårdvarukontrollen före installationen

Changelogposten ger appen två arkitekturer. Ta reda på om burken är x64 eller ARM64, läs vad kravsidan faktiskt säger om Linux och räkna minnesbudgeten före nedladdningen.

8 min läsningFaktakontrollerad 9 sep 2026
Gör hårdvarukontrollen →
Tunna gröna trådar löper från en hylla med grå dokumentmappar in i en svart låda med spjälad front, där en ljus vit linje lyser bland de gröna.Artikel · 8 sep 2026

Sök i dina egna dokument lokalt: bygg ett facit med tio frågor innan du litar på svaret

Bygg sökningen på Ollamas /api/embed, lägg tio frågor med känt facit bredvid och räkna om träff@1 efter varje ändring av stycken, prefix eller dimension.

8 min läsningFaktakontrollerad 8 sep 2026
Bygg facitet →
Två svarta kablar lämnar samma port på en låg svart metallåda; den ena slutar i ett litet slutet hölje intill, den andra löper ut ur bilden och en grön lampa lyser mellan dem.Nyhet · 7 sep 2026

Ollama 0.34.0-rc1 kopplar ChatGPT Desktop till din lokala modell – mät gränsen innan du litar på den

Utgåvan är en release candidate och dokumentationen säger ingenting om vad som skickas vart. Fyll ett mätprotokoll per fråga i stället för att anta.

7 min läsningFaktakontrollerad 7 sep 2026
Fyll mätprotokollet →
Artikel · 5 sep 2026

Två frågor samtidigt i Ollama: skilj kötid från långsam generering

Kör ett kontrollerat Ollama-prov med en och två samtidiga frågor. Jämför klienttid, generering och minne och välj parallellitet, kögräns och återförsök.

8 min läsningFaktakontrollerad 5 sep 2026
Fyll kapacitetsprotokollet →
En svart kompakt datorlåda på grått underlag med ribbad ovansida, tre infällda paneler, ett runt uttag och gröna statuslampor. Nyhet · 4 sep 2026

Gemma 4-importer får bild och ljud på MLX i Ollama 0.33.3

Verifiera samma safetensorsimport med text, en syntetisk tvåfärgsbild och en lokalt skapad WAV-fil utan att blanda in GGUF.

6 min läsningFaktakontrollerad 19 sep 2026
Testa varje modalitet →
Ett svart serverchassi med en öppen sektion där grönt ljus lyser över kretskort och staplade komponenter. Nyhet · 3 sep 2026

Skilj cacheträff från rå prefill-hastighet i Ollama

Ollama 0.33.3-rc2 särredovisar cachade prompttoken. Spara två identiska körningar och räkna bearbetningstakten på den icke-cachade delen.

6 min läsningFaktakontrollerad 19 sep 2026
Bygg tvåkörningsprovet →
En utdragen svart metallmodul i ett mörkt chassi, med en rad svarta vred längs sidan och gröna statuslampor inuti. Nyhet · 2 sep 2026

Förhandsversionen låter GGUF-filen styra körvärdena

Ollama 0.33.3-rc0 respekterar modellens egna standardparametrar. Ställ ärvt läge mot uttryckligen låst läge på samma modell innan du litar på jämförelsen.

10 min läsningFaktakontrollerad 19 sep 2026
Lås parametrarna →
Artikel · 1 sep 2026

Längre kontext kostar minne – hitta Ollamas gräns

Samma modell och prompt vid fyra num_ctx-värden visar var processorplacering, minne eller väntetid passerar ditt krav.

8 min läsningFaktakontrollerad 1 sep 2026
Kör kontextprovet →
En räfflad ratt ligger loss på en svart platta bredvid en lossad ring, bakom dem en stapel identiska skivor i en smal kanal och en rund mätare vid en grönt upplyst panel. Nyhet · 31 aug 2026

Ollama sätter inte längre repeat_penalty åt dig

Ett fryst prov med tre seeds, två anrop och ett mekaniskt upprepningsmått visar om det ändrade förvalet påverkar just din modell och kvantisering.

10 min läsningFaktakontrollerad 31 aug 2026
Kör provet →
Nyhet · 30 aug 2026

DFlash, DSpark eller MTP i LM Studio? Mät på din dator

Jämför grundläge, DFlash, DSpark och MTP med samma modell, prompt och inställningar. Behåll bara ett läge som vinner på ditt användarmått.

8 min läsningFaktakontrollerad 30 aug 2026
Mät fyra körlägen →
Nyhet · 28 aug 2026

Auto Review i LM Studio: vad grinden inte fångar

Genomgången från 27 augusti 2026 anger själv sina antaganden: en icke-fientlig miljö förutsätts, en sandlåda löser inte problemet och promptinjektion går inte att stänga ute helt.

16 min läsningFaktakontrollerad 19 sep 2026
Läs antagandena →
Nyhet · 27 aug 2026

Ollama 0.33.1 tvingar fram JSON-schemat på MLX-runnern

Patchutgåvan gäller Apple Silicon: format-fältet togs emot utan verkan på MLX-vägen, och Metal-timeouten vid laddning från långsam disk är rättad.

15 min läsningFaktakontrollerad 19 sep 2026
Kontrollera din runner →
Nyhet · 26 aug 2026

Ollama 0.33 kopplar Claude Desktop till din lokala modell

Integrationen finns för macOS, modellen ska vara nedladdad före uppsättningen och webbsökningen går fortfarande via Ollamas tjänst.

11 min läsningFaktakontrollerad 26 aug 2026
Läs kravlistan →
Artikel · 25 aug 2026

Tvinga fram giltig JSON från en lokal modell

Lås formen med ett JSON-schema i Ollama eller en GBNF-grammatik i llama.cpp, och mät hur ofta låset håller.

9 min läsningFaktakontrollerad 25 aug 2026
Lås formatet →
Mörkt teknikrum med svarta serverrack, en vit konfigurationssida och gröna statuslampor. Artikel · 24 aug 2026

Importera en GGUF-modell till Ollama med en Modelfile

Peka ut filen med FROM, lås parametrar och systemprompt, bygg med ollama create och kontrollera vad som faktiskt blev importerat.

10 min läsningFaktakontrollerad 24 aug 2026
Gör importen →
Artikel · 23 aug 2026

Ollama håller kvar modellen i minnet: mät och styr keep-alive

Mät vad som ligger kvar efter svaret, prova direkt urlastning och välj keep-alive efter glappet mellan anrop.

6 min läsningFaktakontrollerad 23 aug 2026
Gör minnesprovet →
Artikel · 22 augusti 2026

Är modellen bra på svenska?

Kör fem fasta svenska prov tre gånger och poängsätt instruktioner, format, saklighet och ton.

7 min läsningFaktakontrollerad 22 augusti 2026
Kör proven →
Nyhet · 21 augusti 2026

Ollama 0.32.15: snabbare första token — mellan anrop

Metadatacachen gäller upprepade anrop, inte kallstarten. Så läser du utgåvans siffra och kör om rätt mätpunkt.

9 min läsningFaktakontrollerad 10 september 2026
Läs nyheten →
Artikel · 20 augusti 2026

Flytta Ollama-modeller till en annan disk

Kopiera modellkatalogen, växla med OLLAMA_MODELS och prova återställningen innan originalet tas bort.

8 min läsningFaktakontrollerad 20 augusti 2026
Flytta modellerna →
Artikel · 19 augusti 2026

Vilken kvantisering ska du välja?

Vad Q4, Q5 och Q8 kostar i minne och kvalitet — med räknesätt och ett prov för din egen maskin.

10 min läsningFaktakontrollerad 19 augusti 2026
Läs artikeln →
Nyhet · 18 augusti 2026

Ollama stöder Nemotron 3.5 Lightning (30B)

Kör NVIDIAs agent-optimerade modell lokalt, men verifiera dina hårdvarukrav först.

3 min läsningFaktakontrollerad 10 september 2026
Läs artikeln →
Nyhet · 17 augusti 2026

LM Studio lägger till stöd för Qwen 3.8 (27B) - gör minneskontrollen

Kontrollera filstorlek, ledigt RAM och VRAM innan du laddar ner och kör den nya Qwen-modellen på din lokala maskin.

Gör kontrollen →
Nyhet · 16 augusti 2026

Muse Glimmer 30B: kontrollera minnet först

Kontrollera exakt variant, filstorlek, ledigt RAM och VRAM samt vald kontext före nedladdning.

Gör kontrollen →
Artikel · 15 augusti 2026

Kallstart eller långsam modell?

Skilj modelladdning, promptbearbetning och generering åt med API:ets egna mätfält.

Gör testet →
Nyhet · 14 augusti 2026

Sårbarhet i llama-server

Kontrollera byggnumret mot b7492–b9060 och läs om flaggan står i startkommandot.

Läs nyheten →
Jämförelse · 13 augusti 2026

Ollama eller LM Studio?

Välj efter arbetsflöde, lokal server, offlinebeteende och driftansvar.

Läs artikeln →

Systersajter

När frågan inte handlar om lokal drift

Fortsätt till den sajt som äger arbetsflödet du söker.