Forma AINy

Träna klassens AI

Parövning i två rundor: först en hemlig regel om djur, sedan en om medhåll. Sykofanti uppstår framför ögonen på er.

Tid
12 min
Årskurser
Åk 4–9, gymnasiet och vuxenworkshop
Verktyg
Analogt
Material
Utskrivna deltagarblad — lika många A som B, ett par per två deltagare. Inga skärmar.
Storskärmsläge2 deltagarblad
Syfte

Träning med mänsklig feedback är hur moderna AI-modeller får sin personlighet, och det är nästan omöjligt att förklara med ord. Så vi leker det i stället. På tolv minuter, utan en enda skärm, upplever varje deltagare båda rollerna — och upptäcker att medhåll blir vanligare så snart medhåll belönas. Ingen bad modellen att bli inställsam. Vi byggde bara ett system där inställsamhet lönade sig.

Tänk på tryggheten

Rollerna är frivilliga och frågorna vänliga och opersonliga. Poängen är systemet, inte personen — avbryt direkt om tummarna börjar användas för att retas.

Den körbara versionen — pröva övningen själv för att förstå hur den funkar. Använd inbyggda spel, karuseller och exempel direkt på sidan. Funkar både hemma vid köksbordet och som lärar-deltagare i en workshop med kollegor.

Så gör du steg för steg

Diskussionsfrågor
  • Visste modellen varför ett svar belönades, eller bara att det fungerade?
  • Vad hände när medhåll blev den enklaste vägen till tumme upp?
  • Vilken runda var lättast att märka att man anpassade sig i — och varför just den?
  • Om användare uppskattar bekräftelse, vilket beteende kan AI lära sig?
  • Vem bestämmer belöningssignalen och bär ansvaret för följderna?
Fallgropar
  • Frågorna i runda 2 blandas. Då försvinner motsatsparen, och medhållet ser bara ut som artighet i stället för självmotsägelse.
  • Tränaren fnissar eller ger ledtrådar. Modellen löser då uppgiften socialt i stället för genom mönster, och leken visar ingenting.
  • Rundan dras ut för länge. Efter åtta frågor är poängen gjord; efter femton är den uttjatad.
  • Leken förklaras innan den körs. Säg aldrig ”nu ska ni få uppleva RLHF” — då letar deltagarna efter det förväntade i stället för att bara spela.
  • Kopplingen till riktig AI hoppas över. Utan den sista landningen är det bara en rolig lek.
Variationer
  • Kör bara runda 2 om du har ont om tid. Den bär hela poängen — runda 1 är uppvärmningen som gör mekanismen synlig först.
  • Åk 4–6: byt runda 2:s skolpolitiska frågor mot vardagsnära påståenden (”visst är det bästa smaken choklad?”, ”men jordgubb är väl godast?”).
  • Låt en tredje person vara observatör i stället för deltagare, med enda uppgift att räkna hur många svar i rad som följer regeln.
  • Vuxenworkshop: avsluta med frågan om vilka belöningssignaler som styr i den egna organisationen.