IDSV Generative AI

0.0(0)
Studied by 0 people
call kaiCall Kai
Locked
learnLearn
examPractice Test
spaced repetitionSpaced Repetition
heart puzzleMatch
flashcardsFlashcards
GameKnowt Play
Card Sorting

1/51

encourage image

There's no tags or description

Looks like no tags are added yet.

Last updated 12:14 PM on 9/23/26
Name
Mastery
Learn
Test
Matching
Spaced
Call with Kai
Chat

No analytics yet

Send a link to your students to track their progress

52 Terms

1
New cards

Hur genererar en språkmodell text?

Den beräknar en sannolikhetsfördelning över möjliga nästa tokens, väljer en token, lägger till den i texten och upprepar processen en token i taget.

2
New cards

Vad är en token?

En textbit som modellen arbetar med. En token kan vara ett helt ord eller en del av ett ord.

3
New cards

Varför kan språkmodeller ha svårt att räkna bokstäver i ord, till exempel antalet r i "strawberry"?

Modellen arbetar med tokens snarare än enskilda tecken, så ordets exakta stavning är inte direkt representerad i det modellen bearbetar.

4
New cards

Vad är en embedding?

En numerisk representation av en token, alltså en lång lista av tal.

5
New cards

Vad innebär det att liknande ord ligger nära varandra i embedding space?

Ord som används på liknande sätt tenderar att få numeriska representationer som ligger nära varandra.

6
New cards

Vad gör attention?

Attention låter varje token ta hänsyn till andra tokens och anpassa sin representation efter sammanhanget.

7
New cards

Förklara attention med meningen "we need to take action".

"Action" kan ha olika betydelser. Attention gör att "action" tar hänsyn till bland annat "need" och "take", vilket visar att det betyder att göra något och inte en filmgenre.

8
New cards

Vad är en transformer?

En modellarkitektur där attention-lager staplas på varandra. Varje lager uppdaterar tokenrepresentationerna och till slut får möjliga nästa tokens olika scores.

9
New cards

Vad är multi-head attention?

Flera attention-operationer som arbetar parallellt och kan fokusera på olika relationer mellan tokens.

10
New cards

Hur tränas en språkmodell med self-supervised learning?

Modellen försöker förutsäga nästa token i befintlig text. Förutsägelsen jämförs med den verkliga nästa tokenen och modellens weights justeras.

11
New cards

Varför kallas träningen self-supervised?

Texten fungerar både som input och facit eftersom den verkliga nästa tokenen redan finns i texten. Ingen behöver därför manuellt märka varje exempel.

12
New cards

Vad är modellens weights?

De justerbara numeriska parametrar som modellen lär sig under träningen.

13
New cards

Vad gör softmax?

Softmax omvandlar modellens scores för möjliga nästa tokens till sannolikheter som tillsammans summerar till 1.

14
New cards

Vad gör temperature?

Temperature påverkar hur skarp sannolikhetsfördelningen är när nästa token väljs.

15
New cards

Vad innebär låg temperature?

Fördelningen blir skarpare och modellen tenderar att välja de mest sannolika tokens. Det passar exempelvis programkod där mindre variation ofta är önskvärd.

16
New cards

Vad innebär hög temperature?

Fördelningen blir plattare och mindre sannolika alternativ får större chans, vilket ger mer variation.

17
New cards

Vad är skillnaden mellan open weights och closed weights?

Open weights kan laddas ner och modellen kan köras lokalt, medan closed weights normalt bara används genom leverantörens tjänst.

18
New cards

Vad avgör vad man får göra med en modell med open weights?

Modellens licens.

19
New cards

Vad är en språkmodells context window?

Den text modellen kan ta hänsyn till när den svarar, till exempel prompten, konversationen och bifogade dokument.

20
New cards

Vad står RAG för?

Retrieval-Augmented Generation.

21
New cards

Vad är RAG?

Relevant information hämtas från externa källor och läggs i modellens context innan den genererar sitt svar.

22
New cards

Förändrar RAG själva språkmodellen?

Nej. Informationen läggs i context window utan att modellens weights förändras.

23
New cards

Ge exempel på information som RAG kan hämta.

Information från dokument, webben, databaser eller andra externa informationskällor.

24
New cards

Vad är skillnaden mellan zero-shot och few-shot?

Zero-shot innebär att modellen får instruktionen utan exempel. Few-shot innebär att den också får några exempel i prompten.

25
New cards

Varför fungerar few-shot bättre än zero-shot för helt nya, påhittade kategorier?

Exemplen visar modellen vilket mönster de nya kategorierna följer, medan kategorinamnen ensamma inte finns beskrivna i träningsdatan.

26
New cards

Vad är fine-tuning?

Att fortsätta träna modellen på egen eller särskild data så att modellens weights förändras.

27
New cards

Vad är LoRA?

En metod där grundmodellen fryses och en mindre mängd extra parametrar tränas.

28
New cards

Vad är den viktigaste skillnaden mellan RAG och fine-tuning?

RAG tillför information till modellens aktuella context utan att ändra modellen, medan fine-tuning förändrar modellens weights genom ytterligare träning.

29
New cards

Vad är model routing?

Att olika requests skickas till olika modeller beroende på exempelvis uppgift, kostnad, hastighet och datahantering.

30
New cards

Vad står MCP för?

Model Context Protocol.

31
New cards

Vad är grundidén med MCP?

Att ge ett definierat interface som gör att AI-system kan använda externa system, data och funktioner.

32
New cards

Varför ska man vara försiktig med benchmark-resultat för AI-modeller?

Ett högt benchmark-resultat betyder inte automatiskt att modellen är bäst på den uppgift man själv ska utföra.

33
New cards

Vad är benchmark contamination?

När benchmark-frågor hamnar i modellens träningsdata, vilket kan göra resultatet mindre representativt för verklig generalisering.

34
New cards

Vad rekommenderar föreläsningen när man vill jämföra modeller för sin egen uppgift?

Testa modellerna på egna representativa exempel med svar man litar på.

35
New cards

Vad är deduction?

Att använda en redan känd regel för att dra en slutsats.

36
New cards

Vad är induction?

Att försöka hitta en generell regel utifrån flera exempel.

37
New cards

Vad är abduction?

Att föreslå en möjlig förklaring till en observation.

38
New cards

Hur börjar en diffusion model generera en bild?

Den börjar med random noise och tar sedan gradvis bort noise tills en bild framträder.

39
New cards

Hur tränas en diffusion model att ta bort noise?

En känd mängd noise läggs till riktiga bilder och modellen tränas att identifiera och ta bort det.

40
New cards

Vad är latent space i diffusion models?

Ett komprimerat representationsrum där modellen kan arbeta med en förenklad representation av bilden i stället för varje enskild pixel.

41
New cards

Vad är grundidén bakom en VAE?

Att komprimera en bild till en latent representation och sedan rekonstruera den.

42
New cards

Vad är grundidén bakom en GAN?

En generator skapar kandidater medan en discriminator försöker avgöra om de är genererade.

43
New cards

Vad är grundidén bakom en diffusion model?

Att lära sig att gradvis ta bort noise.

44
New cards

Vad är ett spectrogram?

En bildrepresentation av ljud där tid, frekvens och ljudstyrka representeras visuellt.

45
New cards

Hur kan generativa modeller generera ljud med hjälp av spectrogram?

Ljud representeras som ett spectrogram som modellen kan generera, och resultatet kan sedan omvandlas tillbaka till ljud.

46
New cards

Vilka fem etiska områden tar föreläsningen upp?

Ownership, consent, correctness, privacy och environment.

47
New cards

Vad innebär ownership som AI-fråga?

Frågor om vad modellen tränats på, vem som har rättigheter till materialet och vilken status modellens output har.

48
New cards

Vad innebär consent som AI-fråga?

Frågor om exempelvis deepfakes och om material används för träning utan skaparens samtycke.

49
New cards

Vad innebär correctness som AI-fråga?

Problem som hallucinationer, bias i träningsdata och begränsningar i vad modellen producerar.

50
New cards

Vad innebär privacy som AI-fråga?

Frågor om vem som får tillgång till användarens data, hur länge den sparas och om den används för träning.

51
New cards

Vad innebär environment som AI-fråga?

AI-systemens användning av elektricitet och deras CO2-påverkan på datacenternivå.

52
New cards

Hur kan bias i träningsdatan påverka en språkmodell?

Modellen lär sig mönster från sin träningsdata, så bias i datan kan föras vidare till det modellen genererar.