Var ska jag börja?
Guide · 26 sep 2026Open WebUI med Ollama: installera ett lokalt chattfönster
Docker eller Python 3.11/3.12, rätt adress till Ollama, en WEBUI_SECRET_KEY som ligger kvar och ett adminkonto med stängd registrering. Avsluta med tre prov och facit: modellen syns, ingen andra person kan registrera sig och chattsvaret kommer utan nät.
Installera och pröva →
Nyhet · 25 sep 2026Ollama 0.34.4 ger JSON-schema från tänkande modeller i ett pass – mät formen med tänkandet på
Releasen lovar snabbare och mer tillförlitlig strukturerad utdata från tänkande modeller: tänkandet går fritt och bara svaret efter det tvingas in i schemat, i en enda generering. Kör tio anrop med tänkandet på och av och räkna giltig JSON, svarstid och läckage.
Kör tioanropsprovet →
Nyhet · 24 sep 2026Open WebUI 0.11.4 täpper säkerhetsluckor – pröva vad slim-imagen tappar innan du byter
Releasen ber dig uppdatera produktion snarast för säkerhets- och behörighetsfixar. Slim-imagen på cirka 175 MB vägrar starta på MySQL eller S3 och tappar PDF-läsning, tal och DDGS-webbsök utan externa tjänster — gå igenom förprovslistan innan du byter.
Gå igenom förprovet →Splash kör Qwen lokalt på Apple Silicon — kontrollera M3, macOS 26.4 och 36 GB före installationen
LM Studios experimentella backend Splash kräver M3 eller nyare, macOS 26.4 och minst 36 GB unified memory, och stöder två Qwen-modeller. Bocka av kraven på två minuter och mät sedan själv — inläggets tal om 74 och 170 token per sekund är Incos, mätta på en 48 GB M5 Pro.
Kontrollera kraven →
Nyhet · 22 sep 2026llama-server läser nu temperatur och top-p ur miljövariabler – sätt förvalen i tjänstefilen i stället för kommandoraden
Bygge b11078 ger --temp, --top-p, --min-p och de tre straffparametrarna egna LLAMA_ARG-variabler. Flytta förvalen till en EnvironmentFile, se vad serverns README säger om företrädet och läs av vad servern faktiskt kör med i generation_settings.
Flytta förvalen →
Artikel · 21 sep 2026Samma fråga tio gånger: mät hur mycket den lokala modellen varierar innan du sätter temperatur och seed
Kör samma prompt tio gånger vid tre inställningar, räkna unika svar och svar som skiljer sig i sak och sätt sedan temperature och seed med mätt skäl. Med förvalen i Ollama, llama.cpp-servern och LM Studio som de står i dokumentationen 21 september 2026.
Mät variationen →
Nyhet · 19 sep 2026Ollama 0.34.3-rc1 visar modellens tänknivåer i /api/show – mät innan du låser nivån
Förhandsversionen visar vilka think-nivåer modellen tar och dess förval. Kör samma prompt med av, low, high och max och fyll en tabell med första svarstoken, total tid och tänkspårets längd.
Mät tänknivåerna →
Nyhet · 18 sep 2026Ollama 0.34.2 frågar om inloggning första gången du kör den – så fortsätter du lokalt och stänger av molnet
Förstagångsdialogen ger två val: logga in i webbläsaren eller fortsätt lokalt. Inloggningen gäller molnmodeller och webbsökning. Se vilka kommandon som visar dialogen, var valet sparas per operativsystem och hur OLLAMA_NO_CLOUD eller server.json stänger molnet med en loggrad som kvitto.
Stäng av molnet →
Artikel · 17 sep 2026Uppdateringen bröt något? Backa Ollama och llama.cpp till förra versionen – och lås den tills du provat
Läs av versionen som kör, hämta den senast fungerande utgåvan av Ollama eller ett pinnat llama.cpp-bygge, kör samma prov före och efter och fyll i ett versionskort. Med gränsen för autouppdatering på macOS och Windows.
Backa versionen →
Artikel · 16 sep 2026Vad drar den lokala modellen i el? Mät watt per svar och räkna om till kronor
Mät grundtomgång, laddad tomgång och generering var för sig med en uttagsmätare och nvidia-smi. Räkna om watt till wattimmar per svar och sätt en månadskostnad på ditt eget elpris.
Mät energiposten →
Nyhet · 15 sep 2026LM Studio Bionic 1.1.3 ger röstinmatning på Linux – lokal Voxtral, NVIDIA-GPU enligt changeloggen: prova svenska och mät minnet
Bionic 1.1.3 ger lokal rösttranskription på Linux med Voxtral. Changeloggen anger NVIDIA-GPU, dokumentationen saknar minnesbehov och språklista. Kontrollera GPU:n, mät minnet före och efter röstmodellen och kör ett dikteringsprov på svenska.
Mät röstmodellen →
Nyhet · 14 sep 2026llama.cpp 0.4.1 tar bort --mmap, --mlock och --direct-io – byt till --load-mode innan servern vägrar starta
Tre utfasade laddningsflaggor är borta ur argumenttolken och startskript som bär dem stoppar med invalid argument. Översätt till --load-mode enligt PR-diffen och mät laddtid och minne före och efter.
Byt till --load-mode →
Nyhet · 10 sep 2026LM Studio 0.4.24 håller bild och text i samma meddelande – kontrollera det multimodala API:t
Skicka en syntetisk bild och instruktion i samma input-lista och spara version, modell, begäran och svar som ett reproducerbart prov.
Kontrollera API-anropet →
Nyhet · 9 sep 2026LM Studio Bionic finns nu för Linux på x64 och ARM64 – gör hårdvarukontrollen före installationen
Changelogposten ger appen två arkitekturer. Ta reda på om burken är x64 eller ARM64, läs vad kravsidan faktiskt säger om Linux och räkna minnesbudgeten före nedladdningen.
Gör hårdvarukontrollen →
Artikel · 8 sep 2026Sök i dina egna dokument lokalt: bygg ett facit med tio frågor innan du litar på svaret
Bygg sökningen på Ollamas /api/embed, lägg tio frågor med känt facit bredvid och räkna om träff@1 efter varje ändring av stycken, prefix eller dimension.
Bygg facitet →
Nyhet · 7 sep 2026Ollama 0.34.0-rc1 kopplar ChatGPT Desktop till din lokala modell – mät gränsen innan du litar på den
Utgåvan är en release candidate och dokumentationen säger ingenting om vad som skickas vart. Fyll ett mätprotokoll per fråga i stället för att anta.
Fyll mätprotokollet →
Artikel · 5 sep 2026Två frågor samtidigt i Ollama: skilj kötid från långsam generering
Kör ett kontrollerat Ollama-prov med en och två samtidiga frågor. Jämför klienttid, generering och minne och välj parallellitet, kögräns och återförsök.
Fyll kapacitetsprotokollet →
Nyhet · 4 sep 2026
Prova Gemma 4 med bild och WAV-ljud i Ollamas MLX-motor
Frys version och modelldigest, kontrollera kapabiliteterna och skilj sedan stöd, avvisning och undermåligt svar i tre separata prov.
Kör modalitetsprovet →
Nyhet · 3 sep 2026
Ollama visar hur mycket av prompten som kom från cache
Kör samma API-kropp två gånger och skilj logiska prompttoken, cacheträffar och faktiskt bearbetade token innan du jämför hastighet.
Mät cacheträffen →
Nyhet · 2 sep 2026
Ollama 0.33.3-rc0 börjar läsa GGUF-modellens egna förval
Frys version, modellfil och prompt. Jämför sedan ett ärvt och ett uttryckligen låst läge före och efter förhandsversionen.
Frys grundläget →
Artikel · 1 sep 2026
Hur stor kontext klarar din Ollama-modell?
Höj num_ctx stegvis och mät när modellen lämnar GPU:n, passerar din minnesbudget eller blir för långsam för arbetslasten.
Hitta din gräns →
Nyhet · 31 aug 2026
Repetitionsstraffet är avstängt i Ollama – märks det på din modell?
Sedan 0.32.10 den 12 augusti 2026 får modeller utan eget repeat_penalty värdet 1.0. Kontrollera din modell och mät skillnaden med samma frysta prompt.
Kontrollera din modell →
Nyhet · 30 aug 2026
DFlash, DSpark eller MTP i LM Studio? Mät på din dator
LM Studio 0.4.22 får tre assistant drafters. Ett fryst fyrkörningsprov visar om någon förbättrar hastighet eller första token utan att minnet eller svaret försämras.
Bygg ditt grundläge →
Nyhet · 28 aug 2026
Auto Review i LM Studio: vad grinden inte fångar
Genomgången från 27 augusti 2026 anger själv sina antaganden: en icke-fientlig miljö förutsätts, en sandlåda löser inte problemet och promptinjektion går inte att stänga ute helt.
Läs antagandena →
Nyhet · 27 aug 2026
Ollama 0.33.1 tvingar fram JSON-schemat på MLX-runnern
Patchutgåvan gäller Apple Silicon: format-fältet togs emot utan verkan på MLX-vägen, och Metal-timeouten vid laddning från långsam disk är rättad.
Kontrollera din runner →
Nyhet · 26 aug 2026
Ollama 0.33 kopplar Claude Desktop till din lokala modell
Integrationen finns för macOS, modellen ska vara nedladdad före uppsättningen och webbsökningen går fortfarande via Ollamas tjänst.
Läs kravlistan →
Artikel · 25 aug 2026
Tvinga fram giltig JSON från en lokal modell
Lås formen med ett JSON-schema i Ollama eller en GBNF-grammatik i llama.cpp, och mät hur ofta låset håller.
Lås formatet →
Artikel · 24 aug 2026
Importera en GGUF-modell till Ollama med en Modelfile
Peka ut filen med FROM, lås parametrar och systemprompt, bygg med ollama create och kontrollera vad som faktiskt blev importerat.
Gör importen →
Artikel · 23 aug 2026
Ollama håller kvar modellen i minnet: mät och styr keep-alive
Mät vad som ligger kvar efter svaret, prova direkt urlastning och välj keep-alive efter glappet mellan anrop.
Gör minnesprovet →
Artikel · 22 augusti 2026
Är modellen bra på svenska?
Kör fem fasta svenska prov tre gånger och poängsätt instruktioner, format, saklighet och ton.
Kör proven →
Nyhet · 21 augusti 2026
Ollama 0.32.15: snabbare första token — mellan anrop
Metadatacachen gäller upprepade anrop, inte kallstarten. Så läser du utgåvans siffra och kör om rätt mätpunkt.
Läs nyheten →
Artikel · 20 augusti 2026
Flytta Ollama-modeller till en annan disk
Kopiera modellkatalogen, växla med OLLAMA_MODELS och prova både start och återställning innan originalet tas bort.
Flytta modellerna →
Artikel · 19 augusti 2026
Vilken kvantisering ska du välja?
Vad Q4, Q5 och Q8 kostar i minne och kvalitet — med räknesätt och ett prov för din egen maskin.
Läs artikeln →
Nyhet · 18 augusti 2026
Ollama stöder Nemotron 3.5 Lightning (30B)
Kör NVIDIAs agent-optimerade modell lokalt, men verifiera dina hårdvarukrav först.
Läs artikeln →
Nyhet · 17 augusti 2026
LM Studio lägger till stöd för Qwen 3.8 (27B) – gör minneskontrollen
Kontrollera filstorlek, ledigt RAM och VRAM innan du laddar ner och kör den nya Qwen-modellen på din lokala maskin.
Gör kontrollen →
Senast publicerat · 16 augusti 2026
Muse Glimmer 30B: kontrollera minnet först
Skilj modellfil, system-RAM och VRAM åt innan du hämtar den nya LM Studio-modellen.
Gör kontrollen →
Senast publicerat · 15 augusti 2026
Kallstart eller långsam modell?
Mät laddning, promptbearbetning och generering var för sig med samma kontrollerade anrop.
Gör testet →
Senast publicerat · 14 augusti 2026
Sårbarhet i llama-server: kontrollera ditt bygge
Kontrollera byggnumret och om den berörda flaggan finns i startkommandot.
Läs nyheten →
Guide · startpunkt
Kom igång med lokal AI utan att börja i fel ände
Definiera uppgiften, kontrollera dataflödet och prova minsta fungerande modell på den maskin som faktiskt ska användas.
Läs guiden →
HårdvaraRäkna på minne och verklig kapacitet
Bedöm GPU, delat minne och CPU utifrån modell, kontext och samtidighet.
Bedöm maskinen → ModellerVälj med ett eget provpaket
Jämför kvalitet, formatföljsamhet, språk, latens och licens.
Jämför modeller → VerktygFrån skrivbordsapp till server
Välj körmiljö efter användare, åtkomst och driftansvar.
Jämför körsätten → DriftUppdatera och backa tillbaka
Versionera modell, runtime och konfiguration och prova återställningen.
Bygg driftplanen → IntegritetBevisa vad som stannar lokalt
Inventera nätverk, lagring, loggar, behörigheter och radering.
Rita datagränsen → Jämförelse · 13 augusti 2026Ollama eller LM Studio?
Välj efter arbetsflöde, lokal server, offlinebeteende och driftansvar.
Läs artikeln →Guider
Från första pilot till kontrollerad drift
Välj den del av installationen du arbetar med just nu.
Guide · 26 sep 2026Open WebUI med Ollama: installera ett lokalt chattfönster
Docker eller Python 3.11/3.12, rätt adress till Ollama, en WEBUI_SECRET_KEY som ligger kvar och ett adminkonto med stängd registrering. Avsluta med tre prov och facit: modellen syns, ingen andra person kan registrera sig och chattsvaret kommer utan nät.
Installera och pröva → StartpunktKom igång med lokal AI
Avgränsa arbetslasten, bygg ett provpaket och sätt en stoppregel.
Planera piloten →
HårdvaraRäkna på minne och verklig kapacitet
Bedöm GPU, delat minne och CPU utifrån modell, kontext och samtidighet.
Bedöm maskinen → ModellerVälj med ett eget provpaket
Jämför kvalitet, formatföljsamhet, språk, latens och licens.
Jämför modeller → VerktygFrån skrivbordsapp till server
Välj körmiljö efter användare, åtkomst och driftansvar.
Jämför körsätten → DriftUppdatera och backa tillbaka
Versionera modell, runtime och konfiguration och prova återställningen.
Bygg driftplanen → IntegritetBevisa vad som stannar lokalt
Inventera nätverk, lagring, loggar, behörigheter och radering.
Rita datagränsen →Artiklar
Aktuella jämförelser och fördjupningar
Daterade texter med primärkällor och tydlig kontrolltidpunkt.
Nyhet · 25 sep 2026Ollama 0.34.4 ger JSON-schema från tänkande modeller i ett pass – mät formen med tänkandet på
Releasen lovar snabbare och mer tillförlitlig strukturerad utdata från tänkande modeller: tänkandet går fritt och bara svaret efter det tvingas in i schemat, i en enda generering. Kör tio anrop med tänkandet på och av och räkna giltig JSON, svarstid och läckage.
Kör tioanropsprovet →
Nyhet · 24 sep 2026Open WebUI 0.11.4 täpper säkerhetsluckor – pröva vad slim-imagen tappar innan du byter
Releasen ber dig uppdatera produktion snarast för säkerhets- och behörighetsfixar. Slim-imagen på cirka 175 MB vägrar starta på MySQL eller S3 och tappar PDF-läsning, tal och DDGS-webbsök utan externa tjänster — gå igenom förprovslistan innan du byter.
Gå igenom förprovet →Splash kör Qwen lokalt på Apple Silicon — kontrollera M3, macOS 26.4 och 36 GB före installationen
LM Studios experimentella backend Splash kräver M3 eller nyare, macOS 26.4 och minst 36 GB unified memory, och stöder två Qwen-modeller. Bocka av kraven på två minuter och mät sedan själv — inläggets tal om 74 och 170 token per sekund är Incos, mätta på en 48 GB M5 Pro.
Kontrollera kraven →
Nyhet · 22 sep 2026llama-server läser nu temperatur och top-p ur miljövariabler – sätt förvalen i tjänstefilen i stället för kommandoraden
Bygge b11078 ger --temp, --top-p, --min-p och de tre straffparametrarna egna LLAMA_ARG-variabler. Flytta förvalen till en EnvironmentFile, se vad serverns README säger om företrädet och läs av vad servern faktiskt kör med i generation_settings.
Flytta förvalen →
Artikel · 21 sep 2026Samma fråga tio gånger: mät hur mycket den lokala modellen varierar innan du sätter temperatur och seed
Kör samma prompt tio gånger vid tre inställningar, räkna unika svar och svar som skiljer sig i sak och sätt sedan temperature och seed med mätt skäl. Med förvalen i Ollama, llama.cpp-servern och LM Studio som de står i dokumentationen 21 september 2026.
Mät variationen →
Nyhet · 19 sep 2026Ollama 0.34.3-rc1 visar modellens tänknivåer i /api/show – mät innan du låser nivån
Förhandsversionen visar vilka think-nivåer modellen tar och dess förval. Kör samma prompt med av, low, high och max och fyll en tabell med första svarstoken, total tid och tänkspårets längd.
Mät tänknivåerna →
Nyhet · 18 sep 2026Ollama 0.34.2 frågar om inloggning första gången du kör den – så fortsätter du lokalt och stänger av molnet
Förstagångsdialogen ger två val: logga in i webbläsaren eller fortsätt lokalt. Inloggningen gäller molnmodeller och webbsökning. Se vilka kommandon som visar dialogen, var valet sparas per operativsystem och hur OLLAMA_NO_CLOUD eller server.json stänger molnet med en loggrad som kvitto.
Stäng av molnet →
Artikel · 17 sep 2026Uppdateringen bröt något? Backa Ollama och llama.cpp till förra versionen – och lås den tills du provat
Läs av versionen som kör, hämta den senast fungerande utgåvan av Ollama eller ett pinnat llama.cpp-bygge, kör samma prov före och efter och fyll i ett versionskort. Med gränsen för autouppdatering på macOS och Windows.
Backa versionen →
Artikel · 16 sep 2026Vad drar den lokala modellen i el? Mät watt per svar och räkna om till kronor
Mät grundtomgång, laddad tomgång och generering var för sig med en uttagsmätare och nvidia-smi. Räkna om watt till wattimmar per svar och sätt en månadskostnad på ditt eget elpris.
Mät energiposten →
Nyhet · 15 sep 2026LM Studio Bionic 1.1.3 ger röstinmatning på Linux – lokal Voxtral, NVIDIA-GPU enligt changeloggen: prova svenska och mät minnet
Bionic 1.1.3 ger lokal rösttranskription på Linux med Voxtral. Changeloggen anger NVIDIA-GPU, dokumentationen saknar minnesbehov och språklista. Kontrollera GPU:n, mät minnet före och efter röstmodellen och kör ett dikteringsprov på svenska.
Mät röstmodellen →
Nyhet · 14 sep 2026llama.cpp 0.4.1 tar bort --mmap, --mlock och --direct-io – byt till --load-mode innan servern vägrar starta
Tre utfasade laddningsflaggor är borta ur argumenttolken och startskript som bär dem stoppar med invalid argument. Översätt till --load-mode enligt PR-diffen och mät laddtid och minne före och efter.
Byt till --load-mode →
Nyhet · 10 sep 2026LM Studio 0.4.24 håller bild och text i samma meddelande – kontrollera det multimodala API:t
Skicka en syntetisk bild och instruktion i samma input-lista och spara version, modell, begäran och svar som ett reproducerbart prov.
Kontrollera API-anropet →
Nyhet · 9 sep 2026LM Studio Bionic finns nu för Linux på x64 och ARM64 – gör hårdvarukontrollen före installationen
Changelogposten ger appen två arkitekturer. Ta reda på om burken är x64 eller ARM64, läs vad kravsidan faktiskt säger om Linux och räkna minnesbudgeten före nedladdningen.
Gör hårdvarukontrollen →
Artikel · 8 sep 2026Sök i dina egna dokument lokalt: bygg ett facit med tio frågor innan du litar på svaret
Bygg sökningen på Ollamas /api/embed, lägg tio frågor med känt facit bredvid och räkna om träff@1 efter varje ändring av stycken, prefix eller dimension.
Bygg facitet →
Nyhet · 7 sep 2026Ollama 0.34.0-rc1 kopplar ChatGPT Desktop till din lokala modell – mät gränsen innan du litar på den
Utgåvan är en release candidate och dokumentationen säger ingenting om vad som skickas vart. Fyll ett mätprotokoll per fråga i stället för att anta.
Fyll mätprotokollet →
Artikel · 5 sep 2026Två frågor samtidigt i Ollama: skilj kötid från långsam generering
Kör ett kontrollerat Ollama-prov med en och två samtidiga frågor. Jämför klienttid, generering och minne och välj parallellitet, kögräns och återförsök.
Fyll kapacitetsprotokollet →
Nyhet · 4 sep 2026
Gemma 4-importer får bild och ljud på MLX i Ollama 0.33.3
Verifiera samma safetensorsimport med text, en syntetisk tvåfärgsbild och en lokalt skapad WAV-fil utan att blanda in GGUF.
Testa varje modalitet →
Nyhet · 3 sep 2026
Skilj cacheträff från rå prefill-hastighet i Ollama
Ollama 0.33.3-rc2 särredovisar cachade prompttoken. Spara två identiska körningar och räkna bearbetningstakten på den icke-cachade delen.
Bygg tvåkörningsprovet →
Nyhet · 2 sep 2026
Förhandsversionen låter GGUF-filen styra körvärdena
Ollama 0.33.3-rc0 respekterar modellens egna standardparametrar. Ställ ärvt läge mot uttryckligen låst läge på samma modell innan du litar på jämförelsen.
Lås parametrarna →
Artikel · 1 sep 2026
Längre kontext kostar minne – hitta Ollamas gräns
Samma modell och prompt vid fyra num_ctx-värden visar var processorplacering, minne eller väntetid passerar ditt krav.
Kör kontextprovet →
Nyhet · 31 aug 2026
Ollama sätter inte längre repeat_penalty åt dig
Ett fryst prov med tre seeds, två anrop och ett mekaniskt upprepningsmått visar om det ändrade förvalet påverkar just din modell och kvantisering.
Kör provet →
Nyhet · 30 aug 2026
DFlash, DSpark eller MTP i LM Studio? Mät på din dator
Jämför grundläge, DFlash, DSpark och MTP med samma modell, prompt och inställningar. Behåll bara ett läge som vinner på ditt användarmått.
Mät fyra körlägen →
Nyhet · 28 aug 2026
Auto Review i LM Studio: vad grinden inte fångar
Genomgången från 27 augusti 2026 anger själv sina antaganden: en icke-fientlig miljö förutsätts, en sandlåda löser inte problemet och promptinjektion går inte att stänga ute helt.
Läs antagandena →
Nyhet · 27 aug 2026
Ollama 0.33.1 tvingar fram JSON-schemat på MLX-runnern
Patchutgåvan gäller Apple Silicon: format-fältet togs emot utan verkan på MLX-vägen, och Metal-timeouten vid laddning från långsam disk är rättad.
Kontrollera din runner →
Nyhet · 26 aug 2026
Ollama 0.33 kopplar Claude Desktop till din lokala modell
Integrationen finns för macOS, modellen ska vara nedladdad före uppsättningen och webbsökningen går fortfarande via Ollamas tjänst.
Läs kravlistan →
Artikel · 25 aug 2026
Tvinga fram giltig JSON från en lokal modell
Lås formen med ett JSON-schema i Ollama eller en GBNF-grammatik i llama.cpp, och mät hur ofta låset håller.
Lås formatet →
Artikel · 24 aug 2026
Importera en GGUF-modell till Ollama med en Modelfile
Peka ut filen med FROM, lås parametrar och systemprompt, bygg med ollama create och kontrollera vad som faktiskt blev importerat.
Gör importen →
Artikel · 23 aug 2026
Ollama håller kvar modellen i minnet: mät och styr keep-alive
Mät vad som ligger kvar efter svaret, prova direkt urlastning och välj keep-alive efter glappet mellan anrop.
Gör minnesprovet →
Artikel · 22 augusti 2026
Är modellen bra på svenska?
Kör fem fasta svenska prov tre gånger och poängsätt instruktioner, format, saklighet och ton.
Kör proven →
Nyhet · 21 augusti 2026
Ollama 0.32.15: snabbare första token — mellan anrop
Metadatacachen gäller upprepade anrop, inte kallstarten. Så läser du utgåvans siffra och kör om rätt mätpunkt.
Läs nyheten →
Artikel · 20 augusti 2026
Flytta Ollama-modeller till en annan disk
Kopiera modellkatalogen, växla med OLLAMA_MODELS och prova återställningen innan originalet tas bort.
Flytta modellerna →
Artikel · 19 augusti 2026
Vilken kvantisering ska du välja?
Vad Q4, Q5 och Q8 kostar i minne och kvalitet — med räknesätt och ett prov för din egen maskin.
Läs artikeln →
Nyhet · 18 augusti 2026
Ollama stöder Nemotron 3.5 Lightning (30B)
Kör NVIDIAs agent-optimerade modell lokalt, men verifiera dina hårdvarukrav först.
Läs artikeln →
Nyhet · 17 augusti 2026LM Studio lägger till stöd för Qwen 3.8 (27B) - gör minneskontrollen
Kontrollera filstorlek, ledigt RAM och VRAM innan du laddar ner och kör den nya Qwen-modellen på din lokala maskin.
Gör kontrollen →
Nyhet · 16 augusti 2026Muse Glimmer 30B: kontrollera minnet först
Kontrollera exakt variant, filstorlek, ledigt RAM och VRAM samt vald kontext före nedladdning.
Gör kontrollen →
Artikel · 15 augusti 2026Kallstart eller långsam modell?
Skilj modelladdning, promptbearbetning och generering åt med API:ets egna mätfält.
Gör testet →
Nyhet · 14 augusti 2026Sårbarhet i llama-server
Kontrollera byggnumret mot b7492–b9060 och läs om flaggan står i startkommandot.
Läs nyheten → Jämförelse · 13 augusti 2026Ollama eller LM Studio?
Välj efter arbetsflöde, lokal server, offlinebeteende och driftansvar.
Läs artikeln →Systersajter
När frågan inte handlar om lokal drift
Fortsätt till den sajt som äger arbetsflödet du söker.
Bygg appar utan att vara programmerare
Planera, bygga, publicera och förvalta AI-byggda appar utan kodbakgrund.
MonkeybaseAI-assisterad programmering
Svenska arbetsflöden för utvecklare som skriver och granskar kod med AI.
AI-kreatörAI för text, bild, ljud och video
Praktiska arbetsflöden för kreatörer som vill skapa, granska och kunna göra om resultat.
AI på svenskaAI på arbetsplatsen
Införande, ansvar, juridik, policy och verksamhetsnära användning.