Fördjupning · jämförelse · förändring

Artiklar om lokal AI

Daterade texter för beslut som kräver aktuell produktdokumentation, jämförbara prov eller en tydligare avgränsning än de stabila guiderna.

En mörk, fyrkantig metallenhet med rundade hörn sitter i en svart panelvägg; i dess inre ligger flera nedsänkta fyrkantiga ramar i lager kring ett litet block, och under enheten lyser en smal grön springa med ett svagt grönt sken nedåt.Nyhet · 25 sep 2026

Ollama 0.34.4 ger JSON-schema från tänkande modeller i ett pass – mät formen med tänkandet på

Releasen lovar snabbare och mer tillförlitlig strukturerad utdata från tänkande modeller: tänkandet går fritt och bara svaret efter det tvingas in i schemat, i en enda generering. Kör tio anrop med tänkandet på och av och räkna giltig JSON, svarstid och läckage.

6 min läsningFaktakontrollerad 25 sep 2026
Kör tioanropsprovet →
Tre mörka metallådor på en bänk i ett mörkt rum: en stor låda med en sköld på framsidan står bakom två mindre, där den vänstra är öppen i sidan och visar hyllor med komponenter och den högra har en sköld och en front med små lådfack; till vänster skymtar en varmt upplyst hylla i oskärpa.Nyhet · 24 sep 2026

Open WebUI 0.11.4 täpper säkerhetsluckor – pröva vad slim-imagen tappar innan du byter

Releasen ber dig uppdatera produktion snarast för säkerhets- och behörighetsfixar. Slim-imagen på cirka 175 MB vägrar starta på MySQL eller S3 och tappar PDF-läsning, tal och DDGS-webbsök utan externa tjänster — gå igenom förprovslistan innan du byter.

10 min läsningFaktakontrollerad 24 sep 2026
Gå igenom förprovet →
Fyra mörka block i stigande höjd står som ett stapeldiagram på en bänkskiva i ett mörkgrönt rum, omslutna av en smal metallram; en mätklocka på stativ lutar mot det högsta blocket och längre bak står ett skjutmått, en matt metallåda och två uppställda protokollblad.Nyhet · 23 sep 2026

Splash kör Qwen lokalt på Apple Silicon — kontrollera M3, macOS 26.4 och 36 GB före installationen

LM Studios experimentella backend Splash kräver M3 eller nyare, macOS 26.4 och minst 36 GB unified memory, och stöder två Qwen-modeller. Bocka av kraven på två minuter och mät sedan själv — inläggets tal om 74 och 170 token per sekund är Incos, mätta på en 48 GB M5 Pro.

8 min läsningFaktakontrollerad 23 sep 2026
Kontrollera kraven →
En matt svart apparatlåda med bygelhandtag står på en grågrön bänkskiva framför mörkgröna väggskivor; på lådans främre panel sitter en rad med fem tomma runda hål, och en flätad kabel löper ut ur lådans vänstra sida och ner över bänkkanten. Till höger står en fristående plåt lutad bakåt i en låg fot, med fyra runda vred i två rader och en blank grå lapp fäst i plåtens övre högra hörn.Nyhet · 22 sep 2026

llama-server läser nu temperatur och top-p ur miljövariabler – sätt förvalen i tjänstefilen i stället för kommandoraden

Bygge b11078 ger --temp, --top-p, --min-p och de tre straffparametrarna egna LLAMA_ARG-variabler. Flytta förvalen till en EnvironmentFile, se vad serverns README säger om företrädet och läs av vad servern faktiskt kör med i generation_settings.

7 min läsningFaktakontrollerad 22 sep 2026
Flytta förvalen →
EnArtikel · 21 sep 2026

Samma fråga tio gånger: mät hur mycket den lokala modellen varierar innan du sätter temperatur och seed

Kör samma prompt tio gånger vid tre inställningar, räkna unika svar och svar som skiljer sig i sak och sätt sedan temperature och seed med mätt skäl. Med förvalen i Ollama, llama.cpp-servern och LM Studio som de står i dokumentationen 21 september 2026.

13 min läsningFaktakontrollerad 21 sep 2026
Mät variationen →
En mörk cylinder med ett lysande fönster med tre staplar står på en metallhylla; framför den ligger ett stoppur och till höger syns en öppen mörk dörr.Nyhet · 19 sep 2026

Ollama 0.34.3-rc1 visar modellens tänknivåer i /api/show – mät innan du låser nivån

Förhandsversionen visar vilka think-nivåer modellen tar och dess förval. Kör samma prompt med av, low, high och max och fyll en tabell med första svarstoken, total tid och tänkspårets längd.

4 min läsningFaktakontrollerad 19 sep 2026
Mät tänknivåerna →
En mörk datorlåda står på ett ljust, slitet bord mot en grön vägg; på sidan lyser en liten vit ringformad lampa. Framför lådan står en vägvisare i trä med två pilar åt var sitt håll, ett litet trähus i klossform och en liten mässingsnyckel, och till höger ligger en hoprullad svart sladd med USB-kontakt.Nyhet · 18 sep 2026

Ollama 0.34.2 frågar om inloggning första gången du kör den – så fortsätter du lokalt och stänger av molnet

Förstagångsdialogen ger två val: logga in i webbläsaren eller fortsätt lokalt. Inloggningen gäller molnmodeller och webbsökning. Se vilka kommandon som visar dialogen, var valet sparas per operativsystem och hur OLLAMA_NO_CLOUD eller server.json stänger molnet med en loggrad som kvitto.

9 min läsningFaktakontrollerad 18 sep 2026
Stäng av molnet →
Ett platt, matt svart serverchassi står på en svart bänk framför en mörkgrön vägg; i chassits främre öppning lyser en liten vit statuslampa och en tunn modul med gallerfront sticker ut ur fronten, medan en likadan modul ligger på en mörk, markerad yta på bänken bredvid; en grön ljuslist löper längs bänkens underkant ovanför ett trägolv.Artikel · 17 sep 2026

Uppdateringen bröt något? Backa Ollama och llama.cpp till förra versionen – och lås den tills du provat

Läs av versionen som kör, hämta den senast fungerande utgåvan av Ollama eller ett pinnat llama.cpp-bygge, kör samma prov före och efter och fyll i ett versionskort. Med gränsen för autouppdatering på macOS och Windows.

10 min läsningFaktakontrollerad 17 sep 2026
Backa versionen →
En tjock svart kabel går från ett vägguttag i en mörkgrön vägg, i en vid slinga över ett ljust trägolv och upp i en svart mätdosa med vit urtavla och nål, monterad på framsidan av ett mörkgrått maskinskåp; till höger skymtar en mörkgrön panel med runda vred och små vita indikatorer.Artikel · 16 sep 2026

Vad drar den lokala modellen i el? Mät watt per svar och räkna om till kronor

Mät grundtomgång, laddad tomgång och generering var för sig med en uttagsmätare och nvidia-smi. Räkna om watt till wattimmar per svar och sätt en månadskostnad på ditt eget elpris.

9 min läsningFaktakontrollerad 16 sep 2026
Mät energiposten →
En svart datorlåda med sidofönster står på en mörk bänk; innanför fönstret lyser en fläkt och ett grafikkort i grönt, en grön ljuslist löper längs lådans underkant och på fronten sitter ett grönt ormliknande märke. Framför lådan står en liten mikrofon på ett trebensstativ med sladden hängande ner, och på bänkkanten ligger en pappersremsa med ett tryckt vågformsmönster.Nyhet · 15 sep 2026

LM Studio Bionic 1.1.3 ger röstinmatning på Linux – lokal Voxtral, NVIDIA-GPU enligt changeloggen: prova svenska och mät minnet

Bionic 1.1.3 ger lokal rösttranskription på Linux med Voxtral. Changeloggen anger NVIDIA-GPU, dokumentationen saknar minnesbehov och språklista. Kontrollera GPU:n, mät minnet före och efter röstmodellen och kör ett dikteringsprov på svenska.

8 min läsningFaktakontrollerad 15 sep 2026
Mät röstmodellen →
En svart, platt apparatlåda står på en mörk bänkskiva framför suddiga gardiner och en soffa; på frontplattan sitter ett runt metallvred med grön ljusring bredvid fyra små skåror, och till vänster ligger en lös svart plåt med tre små vippbrytare.Nyhet · 14 sep 2026

llama.cpp 0.4.1 tar bort --mmap, --mlock och --direct-io – byt till --load-mode innan servern vägrar starta

Tre utfasade laddningsflaggor är borta ur argumenttolken och startskript som bär dem stoppar med invalid argument. Översätt till --load-mode enligt PR-diffen och mät laddtid och minne före och efter.

8 min läsningFaktakontrollerad 14 sep 2026
Byt till --load-mode →
Nyhet · 10 sep 2026

LM Studio 0.4.24 håller bild och text i samma meddelande – kontrollera det multimodala API:t

Skicka en syntetisk bild och instruktion i samma input-lista och spara version, modell, begäran och svar som ett reproducerbart prov.

8 min läsningFaktakontrollerad 10 sep 2026
Kontrollera API-anropet →
En liten grå datorlåda med öppen sidopanel står på en hylla mot en mörkgrön vägg, med ett grönlysande kretskort synligt inuti; en smal grön ljuslinje delar bilden och till höger står en större mörk låda i skugga på ett trägolv.Nyhet · 9 sep 2026

LM Studio Bionic finns nu för Linux på x64 och ARM64 – gör hårdvarukontrollen före installationen

Changelogposten ger appen två arkitekturer. Ta reda på om burken är x64 eller ARM64, läs vad kravsidan faktiskt säger om Linux och räkna minnesbudgeten före nedladdningen.

8 min läsningFaktakontrollerad 9 sep 2026
Gör hårdvarukontrollen →
Tunna gröna trådar löper från en hylla med grå dokumentmappar in i en svart låda med spjälad front, där en ljus vit linje lyser bland de gröna.Artikel · 8 sep 2026

Sök i dina egna dokument lokalt: bygg ett facit med tio frågor innan du litar på svaret

Bygg sökningen på Ollamas /api/embed, lägg tio frågor med känt facit bredvid och räkna om träff@1 efter varje ändring av stycken, prefix eller dimension.

8 min läsningFaktakontrollerad 8 sep 2026
Bygg facitet →
Två svarta kablar lämnar samma port på en låg svart metallåda; den ena slutar i ett litet slutet hölje intill, den andra löper ut ur bilden och en grön lampa lyser mellan dem.Nyhet · 7 sep 2026

Ollama 0.34.0-rc1 kopplar ChatGPT Desktop till din lokala modell – mät gränsen innan du litar på den

Utgåvan är en release candidate och dokumentationen säger ingenting om vad som skickas vart. Fyll ett mätprotokoll per fråga i stället för att anta.

7 min läsningFaktakontrollerad 7 sep 2026
Fyll mätprotokollet →
Artikel · 5 sep 2026

Två frågor samtidigt i Ollama: skilj kötid från långsam generering

Kör ett kontrollerat Ollama-prov med en och två samtidiga frågor. Jämför klienttid, generering och minne och välj parallellitet, kögräns och återförsök.

8 min läsningFaktakontrollerad 5 sep 2026
Fyll kapacitetsprotokollet →
En svart kompakt datorlåda på grått underlag med ribbad ovansida, tre infällda paneler, ett runt uttag och gröna statuslampor. Nyhet · 4 sep 2026

Ollama 0.33.3 ger Gemma 4 bild och ljud i MLX – kör ett lokalt modalitetsprov

Dokumentera version och modellartefakt, kontrollera annonserade kapabiliteter och kör separata facitprov för text, PNG och WAV-ljud.

6 min läsningFaktakontrollerad 19 sep 2026
Skilj stöd från svarskvalitet →
Ett svart serverchassi med en öppen sektion där grönt ljus lyser över kretskort och staplade komponenter. Nyhet · 3 sep 2026

Ollama 0.33.3 visar cachade prompttoken – mät återanvändningen utan att lura hastigheten

Kör två identiska anrop och håll isär promptens logiska total, cacheträffen och den del som faktiskt bearbetades innan du jämför token per sekund.

6 min läsningFaktakontrollerad 19 sep 2026
Mät logiskt, cachat och bearbetat →
En utdragen svart metallmodul i ett mörkt chassi, med en rad svarta vred längs sidan och gröna statuslampor inuti. Nyhet · 2 sep 2026

Ollama 0.33.3-rc0 läser GGUF-förval – lås parametrarna före test

Bevara version, kontrollsumma, Modelfile och råsvar. Ett fyrfältsprov skiljer nytt parameterarv från andra motorändringar i samma release.

10 min läsningFaktakontrollerad 19 sep 2026
Kör före- och efterprovet →
Artikel · 1 sep 2026

Längre kontext kostar minne – hitta Ollamas gräns på din dator

Kör samma modell och prompt med flera num_ctx-värden. Kontrollera processorplacering, RAM, VRAM och tider innan du väljer den största praktiska kontexten.

8 min läsningFaktakontrollerad 1 sep 2026
Kör kontextprovet →
En räfflad ratt ligger loss på en svart platta bredvid en lossad ring, bakom dem en stapel identiska skivor i en smal kanal och en rund mätare vid en grönt upplyst panel. Nyhet · 31 aug 2026

Ollama sätter inte längre repeat_penalty åt dig – mät om modellen börjar upprepa sig

Sedan 0.32.10 får modeller utan eget värde 1.0, alltså avstängt straff. Kontrollera din modell, kör samma frysta prompt med och utan straff och poängsätt upprepningen.

10 min läsningFaktakontrollerad 31 aug 2026
Kör provet på din modell →
Nyhet · 30 aug 2026

LM Studio 0.4.22 får DFlash, DSpark och MTP – mät vinsten själv

Frys målmodell, prompt och laddningsval. Kör sedan grundläge plus tre assistant drafters och jämför hastighet, första token, minne och svarskrav.

8 min läsningFaktakontrollerad 30 aug 2026
Bygg fyrkörningsprovet →
Nyhet · 28 aug 2026

LM Studio förklarar vad Auto Review släpper igenom – och vad den uttryckligen inte fångar

Två grindar i följd avgör vilka shell-kommandon som körs utan bekräftelse. De tre antagandena bakom dem står i inlägget, och det första gäller din egen maskin.

16 min läsningFaktakontrollerad 19 sep 2026
Läs antagandena →
Nyhet · 27 aug 2026

Ollama 0.33.1: MLX-runnern får strukturerad utdata – och slutar timeouta på långsam disk

Patchutgåvan efter 0.33.0 rör Apple Silicon: så avgör du vilken runner modellen körs under, och så kör du om schemaprovet på MLX-vägen.

15 min läsningFaktakontrollerad 19 sep 2026
Kontrollera din runner →
Nyhet · 26 aug 2026

Ollama 0.33 kopplar Claude Desktop till din lokala modell – men bara på macOS

Kravlistan i dokumentationen, de tre stegen för att slå på integrationen och gränsen mellan det som körs på din maskin och det som lämnar den.

11 min läsningFaktakontrollerad 26 aug 2026
Läs kravlistan →
Artikel · 25 aug 2026

Tvinga fram giltig JSON från en lokal modell – och mät hur ofta den håller

Schema på Ollamas format-parameter, GBNF i llama.cpp och ett protokoll med tio körningar som visar hur ofta formen håller.

9 min läsningFaktakontrollerad 25 aug 2026
Lås formatet →
Mörkt teknikrum med svarta serverrack, en vit konfigurationssida och gröna statuslampor. Artikel · 24 aug 2026

Kör en modell som inte finns i Ollamas bibliotek: importera en GGUF med Modelfile

Fyra instruktioner i en Modelfile, ett bygge med ollama create och ett prov som visar att systemprompt och parametrar följde med in.

10 min läsningFaktakontrollerad 24 aug 2026
Gör importen →
Artikel · 23 aug 2026

Ollama håller kvar modellen i minnet: mät och styr keep-alive

Se vad som är laddat, frigör minnet direkt och mät vad urlastningen kostar vid nästa anrop.

6 min läsningFaktakontrollerad 23 aug 2026
Gör minnesprovet →
Artikel · 22 augusti 2026

Är modellen bra på svenska? Fem fasta prov

Jämför lokala modeller med samma svenska prompter, låsta inställningar och ett protokoll med tio möjliga poäng.

7 min läsningFaktakontrollerad 22 augusti 2026
Kör proven →
Nyhet · 21 augusti 2026

Ollama 0.32.15: snabbare första token — mellan anrop

Metadatacachen gäller upprepade anrop, inte kallstarten. Så läser du utgåvans siffra och kör om rätt mätpunkt.

9 min läsningFaktakontrollerad 10 september 2026
Läs nyheten →
Artikel · 20 augusti 2026

Flytta Ollama-modeller till en annan disk

Kopiera modellkatalogen, växla säkert med OLLAMA_MODELS och prova både start och återställning innan originalet tas bort.

8 min läsningFaktakontrollerad 20 augusti 2026
Flytta modellerna →
Artikel · 19 augusti 2026

Vilken kvantisering ska du välja?

Vad Q4, Q5 och Q8 kostar i minne och kvalitet — med räknesätt och ett prov för din egen maskin.

10 min läsningFaktakontrollerad 19 augusti 2026
Läs artikeln →
Nyhet · 18 augusti 2026

Ollama stöder Nemotron 3.5 Lightning (30B)

Kör NVIDIAs agent-optimerade modell lokalt, men verifiera dina hårdvarukrav först.

3 min läsningFaktakontrollerad 10 september 2026
Läs artikeln →
Nyhet · 17 augusti 2026

LM Studio lägger till stöd för Qwen 3.8 (27B) – gör minneskontrollen

Kontrollera filstorlek, ledigt RAM och VRAM innan du laddar ner och kör den nya Qwen-modellen på din lokala maskin.

3 min läsningFaktakontrollerad 10 september 2026
Gör kontrollen →
Nyhet · 16 augusti 2026

LM Studio lanserar Muse Glimmer 30B – gör minneskontrollen före nedladdning

Tre minnesuppgifter beskriver olika saker. Så kontrollerar du variant, filstorlek, RAM, VRAM och kontext innan du hämtar modellen.

8 min läsningFaktakontrollerad 10 september 2026
Gör kontrollen →
Artikel · 15 augusti 2026

Kallstart eller långsam modell? Mät laddning, prompt och generering var för sig

Kör samma Ollama-anrop kallt och varmt. API-fälten visar om väntan ligger i modelladdning, promptbearbetning eller tokengenerering.

7 min läsning7 officiella källor
Gör testet →
Nyhet · 14 augusti 2026

Kritisk sårbarhet i llama-server: kontrollera ditt bygge och flaggan

CVE-2026-43631 pekar ut byggena b7492 till b9060 när --sleep-idle-seconds är aktiverad. Inget rättat bygge är namngivet — så läser du ut byggnumret och kontrollerar startkommandot.

6 min läsning6 officiella källor
Läs nyheten →
Jämförelse · 13 augusti 2026

Ollama eller LM Studio? Välj efter arbetsflödet

Båda kan köra lokalt och erbjuda API. Så provar du gränssnitt, reproducerbarhet, nätverksgräns och offlinebeteende innan du väljer.

5 min läsning5 officiella källor
Läs artikeln →

Publiceringsprincip

Vad som blir en artikel här

En artikel ska hjälpa läsaren fatta ett konkret beslut som kräver mer aktualitets- eller källarbete än en tidlös guide.

Jämförelse

Samma prov, samma villkor

Verktyg eller modeller jämförs med redovisad version, konfiguration och uppgift.

Förändring

Vad behöver läsaren göra?

En ny version blir artikel först när förändringen får en praktisk konsekvens.

Fördjupning

Ett problem, en avgränsning

Drift, säkerhet och prestanda behandlas med testbara kontrollpunkter.