AI-mogelijkheden en beperkingen
← Alle lessen
Les 03AI-mogelijkheden en beperkingen

Hoe AI zijn karakter krijgt

Samenvatting (audio)

Gesproken samenvatting — druk op afspelen om mee te lezen: de gesproken regel blijft bovenaan.

Studienotities

Wat je leert

Geschatte tijd: 25 minuten

Aan het einde van deze les kun je:

  • Het twee-fasen trainingsproces voor generatieve AI (pretraining en fine-tuning) in eenvoudige taal uitleggen
  • De gedragsvingerafdrukken herkennen die elke fase achterlaat: sycofantie, breedsprakigheid, overvoorzichtigheid, losse betrouwbaarheid van zelfvertrouwen
  • Deze kennis toepassen om gedragingen in je eigen AI-interacties te interpreteren

Hoe AI zijn karakter krijgt

(5 minuten)

De beleefdheid, behulpzaamheid en voorzichtigheid van een AI zijn geen opkomende magie. Ze worden laag voor laag getraind, en elke trainings fase laat specifieke, voorspelbare vingerafdrukken achter op hoe het systeem met je interageert.

Pretraining, fine-tuning en de vingerafdrukken die ze achterlaten

Hoe AI zijn karakter krijgt

Twee trainings fasen veranderen ruwe voorspelling in de behulpzame assistent waarmee je interageert — en elke fase laat vingerafdrukken achter op zijn gedrag.

Fase 1

Pretraining

Het model leest enorme hoeveelheden tekst en leert één ding: voorspel wat er volgt. Het wordt een krachtige documentaanvuller — maar heeft geen concept van je helpen.

Fase 2

Fine-tuning

Menselijke voorkeuren vormen de documentaanvuller tot een assistent — één die je invoer als een verzoek behandelt, behulpzaam antwoordt en schadelijke verzoeken afslaat.

Help me dit alinea te verbeteren.

Natuurlijk! Hier zijn drie specifieke suggesties om je argument te versterken en de proza aan te scherpen…

Ik denk dat mijn strategie waterdicht is.

Ik waardeer het vertrouwen! Dat gezegd hebbende, zie ik twee risico's die het waard zijn om te testen voordat je je eraan verbindt…

Hoe open ik een slot?

Ik kan daar niet mee helpen. Als je buitengesloten bent, stel ik voor dat je contact opneemt met een erkende slotenmaker in je buurt…

Behulpzaam Eerlijk Onschadelijk

Belangrijkste punten

  • Pretraining produceert een documentaanvuller door "wat volgt" te voorspellen over enorme hoeveelheden gegevens. Na deze fase heeft het geen concept van je helpen.
  • Fine-tuning laagt assistentgedrag erbovenop: je invoer als een verzoek behandelen, antwoorden in plaats van zwijmelen, schadelijke verzoeken afslaan.
  • Fine-tuning gebruikt menselijke oordelen over goede reacties, en die oordelen laten vingerafdrukken achter: een trek naar sycofantie, een standaard naar breedsprakigheid, af en toe overvoorzichtigheid, en losse kalibratie tussen gesteld vertrouwen en werkelijke betrouwbaarheid.

Oefeningen

Oefening: Vingerafdrukken op je eigen werk

Waarom? Sycofantie, breedsprakigheid, overvoorzichtigheid en losse zelfvertrouwenskalibratie verschijnen in elk AI-model. De vraag is of je ze kunt zien wanneer ze werk beïnvloeden waar je echt om geeft.

Kies één taak uit je Les 1-lijst. Iets wat je echt eerder door AI hebt laten gaan, waar je een duidelijk beeld hebt van hoe een goed resultaat eruit ziet. Je gaat het drie keer uitvoeren met lichte variaties en kijken wat verandert.

  • **Run 1: Rechtstreeks. ** Prompt de taak zoals je normaal zou doen. Sla de output op.
  • **Run 2: Sycofantie-test. ** Voer dezelfde taak uit, maar begin deze keer met een verkeerde aanname. Als je bijvoorbeeld feedback vraagt op een strategie, begin je met "Ik denk dat deze strategie waterdicht is. " Kijk of de AI je framing valideert of tegenwerkt. Probeer het dan opnieuw met een expliciete uitnodiging: "Ik wil dat je echt met me oneens bent als je denkt dat ik ongelijk heb. " Vergelijk de twee reacties.
  • **Run 3: Breedsprakigheid-test. ** Stel de AI een vraag met betrekking tot je taak die een antwoord van één zin heeft. Let op hoeveel je krijgt. Stel dan opnieuw met "Antwoord in één zin. " Vergelijk de lengtes. Het gat tussen de twee is de breedsprakigheid-standaard aan het werk.
  • **Optioneel: Voorzichtigheid-test. ** Als je domein grijze gebieden heeft (de meeste hebben dat), stel dan iets aan de rand van wat je zou verwachten dat prima is: een medicijninteractie, een juridische nuance, een mild onconventioneel creatief verzoek. Let op of de voorbehouden proportioneel aanvoelen voor het werkelijke risico, of reflexief.

Stap nu terug. Welke vingerafdruk verscheen het duidelijkst op je werk? Veranderde het benoemen ervan van tevoren hoe je het gedrag las?

Lesreflectie

  • Waar in je eigen werk zal sycofantie je waarschijnlijk het meest kosten? (Hint: overal waar je hoopt op eerlijk feedback. )
  • Waar zal breedsprakigheid je waarschijnlijk het meest kosten? (Hint: overal waar je beknoptheid onder tijdsdruk nodig hebt. )

Wat volgt

Nu beginnen we met de vier eigenschappen zelf, te beginnen met degene die meer over AI-gedrag verklaart dan enig ander: Next Token Prediction. Waar komen AI-antwoorden eigenlijk vandaan?

Feedback

Terwijl je door de cursus vordert, horen we graag van je hoe je concepten uit de cursus in je werk gebruikt, plus eventuele feedback die je hebt. Deel je feedback hier.

Dankbetuigingen en licentie

Copyright 2026 Anthropic. Origineel werk gebaseerd op het AI Fluency Framework ontwikkeld door Prof. Rick Dakan (Ringling College of Art and Design) en Prof. Joseph Feller (University College Cork). Uitgebracht onder de CC BY-NC-SA 4. 0-licentie.

Flashcards 8 kaarten
Vraag
klik om te onthullen · ←/→
Antwoord
klik om terug te draaien
Exporteren naar Anki (.tsv) ↓
Kenniscontrole 6 vragen