Hoppa till innehållet

Grundbegrepp

LLM (Large Language Model)

En stor språkmodell, på engelska large language model eller LLM, är den teknik som ligger bakom de AI-verktyg som skriver text. Den är tränad på mycket stora textmängder och räknar ut vilket ord som rimligen kommer härnäst, om och om igen, tills svaret är färdigt.

Vad en LLM förväxlas med

Chattverktyget du använder. Modellen är motorn, verktyget är bilen. Samma modell kan sitta i flera olika produkter, och en produkt kan byta modell utan att du märker det.

En databas. Modellen slår inte upp svaret någonstans. Den räknar fram det, vilket är precis varför den kan låta säker och ha fel.

Sökmotor med extra steg. Vissa verktyg söker på riktigt och visar källor. Andra svarar ur modellen. Skillnaden syns sällan i gränssnittet och avgör hur mycket du kan lita på svaret.

Var du möter ordet LLM

I leverantörsavtal, där det står vilken modell som används. I diskussioner om var data hamnar, eftersom svaret beror på vem som kör modellen och inte på vem som byggt den. Och när någon undrar varför två verktyg svarar olika på samma fråga.

Vad du kan göra med det

Två saker är värda att veta i vardagen. Modellen kan bara det som fanns i träningen, så färska uppgifter måste du ge den. Och den har ingen aning om vad som är sant, bara om vad som är vanligt formulerat.

Det gör att den är stark på form och svag på fakta, vilket är en bra tumregel för vad du ber den om.

Vidare

Kontextfönster (Context Window) om hur mycket modellen kan hålla i huvudet åt gången. Tokenisering om hur texten delas upp innan modellen räknar. Se kurserna