# Lokal AI

> Lokal AI innebär att en modell körs på samma maskin som använder den — din dator, din telefon eller din egen server — i stället för att anropa en leverantör…

Source: https://northerngo.com/sv/ordlista/lokal-ai/
Language: sv
Updated: 2026-08-28

---
**Lokal AI innebär att en modell körs på samma maskin som använder den — din dator, din telefon eller din egen server — i stället för att anropa en leverantör över internet. Prompten och svaret stannar på enheten, och inget kostar per anrop.**

### Varför folk vill ha det

Tre skäl, oftast i den här ordningen. **Sekretess:** text som aldrig lämnar maskinen kan inte loggas, sparas eller användas för träning av någon annan. **Kostnad:** när hårdvaran är betald är generering gratis, så du kan köra samma prompt femtio gånger medan du itererar. **Oberoende:** inga anropstak, inga avvecklingsbesked, inga prisändringar.

Det finns två vanliga former. Antingen körs modellen i webbläsaren via [WebGPU](/sv/ordlista/webgpu/), vilket inte kräver någon installation av användaren, eller så körs den som en egen process på maskinen — [Ollama](/sv/ordlista/ollama/), llama.cpp, LM Studio — som applikationer pratar med över localhost.

### Avvägningen är verklig

Lokala modeller är mindre modeller. En [kvantiserad](/sv/ordlista/quantization/) modell med sju miljarder parametrar som får plats i 5 GB grafikminne är inte konkurrenskraftig mot en stor molnmodell på svåra resonemang, långa dokument eller smal kunskap. Den är ofta fullt tillräcklig för klassificering, extrahering, sammanfattning, omskrivning och utkast.

De övriga kostnaderna är praktiska: en första nedladdning på flera gigabyte, ett fast och oftast litet kontextfönster, märkbart färre tokens per sekund, och supportfrågor från användare vars hårdvara inte klarar det.

### Det folk brukar blanda ihop

**Lokalt är inte samma sak som offline, och inte automatiskt privat hela vägen.** Två saker är värda att skilja på:

1. **Var modellen körs** kontra **om appen behöver nätet.** Vikterna laddas ner över internet första gången. En sida som kör en modell lokalt kan fortfarande skicka statistik, telemetri eller din prompt någon annanstans.
2. **Lokal generering** kontra **lokalt alltihop.** En produkt kan marknadsföra ett lokalt läge och ändå göra ett molnanrop per session för planering, routning eller innehållsfiltrering.

Frågan värd att ställa till en leverantör är inte "stödjer ni lokala modeller" utan "vilka specifika anrop lämnar enheten, och när". NorthernGos svar är att lokal generering körs helt på ditt eget grafikkort i alla planer och inte skickar någon förfrågan från enheten, medan molnläget använder Googles Gemini-modeller och är kvoterat — två olika vägar, inte en väg med en sekretessetikett.

En tredje väg folk blandar in är [egen API-nyckel](/sv/ordlista/egen-api-nyckel/). Det är fortfarande ett molnanrop: prompten lämnar enheten, och bara notan och modellfamiljen ändras. Det är inte lokal AI.

---

NorthernGo är en AI-driven plattform för att bygga produktionsklara webbappar utan kod. Lokal AI-generering via WebGPU är obegränsad och gratis, och du äger all genererad källkod. https://northerngo.com/
