Nakijken met AI voor Nederlands: tekstbegrip, formuleren en schrijfopdrachten
Bij Nederlands beoordeel je betekenis, niet trefwoorden. Zo maak je een correctiemodel voor tekstbegripvragen en schrijfopdrachten dat een AI-model eigen formuleringen laat herkennen, en je eigen oordeel over taal overeind laat.
Een AI-model kan tekstbegrip goed nakijken als je per vraag de kernelementen, toegestane omschrijvingen en veelgemaakte fouten noemt, en vastlegt hoe je omgaat met woordgrenzen, citeervragen en taalfouten. De tekstherkenning neemt spelling en interpunctie van de leerling ongewijzigd over, zodat taalverzorging eerlijk beoordeeld kan worden. Voor een betoog of beschouwing gebruik je criteria met niveaus in plaats van losse vragen.
- Beschrijf per vraag de kernelementen en de omschrijvingen die je goed rekent, niet alleen het ideale antwoord.
- Leg vast wat er gebeurt bij een overschreden woordgrens, bij te veel elementen en bij taalfouten.
- Spelling en interpunctie van de leerling blijven in de transcriptie staan zoals ze op papier staan.
- Een betoog of beschouwing beoordeel je op criteria met niveaus, met markeringen in de tekst.
Nederlands is het vak waar trefwoorden het minst zeggen. Een leerling die bij een functievraag "tegenwerping" opschrijft kan het goed hebben, en een leerling die het woord "tegenargument" gebruikt kan het fout hebben als hij het verkeerde tegenargument noemt. Wat je beoordeelt is of de leerling de tekst begrepen heeft en dat helder kan opschrijven. Dat vraagt om een correctiemodel dat betekenis beschrijft.
De vraagtypen bij tekstbegrip
Elk type vraag vraagt iets anders van je correctiemodel. Een overzicht van wat je per type vastlegt:
| Vraagtype | Voorbeeld | Wat je vastlegt |
|---|---|---|
| Functie of verband | Welke functie heeft alinea 4 ten opzichte van alinea 3? | De juiste functie plus de omschrijvingen die je goedrekent ("geeft een voorbeeld", "illustreert") |
| Hoofdgedachte | Wat is de hoofdgedachte van de tekst? Gebruik maximaal 25 woorden. | De verplichte elementen, elk met een eigen punt, en wat er gebeurt boven de woordgrens |
| Citeervraag | Citeer de zin waarin de schrijver zijn standpunt geeft. | Welke zin goed is, en of eerste en laatste woorden volstaan |
| In eigen woorden | Leg in eigen woorden uit wat de schrijver bedoelt met "een digitale fuik". | De kern van de betekenis, en dat letterlijk overschrijven niet telt |
| Meerkeuze en juist/onjuist | Is de volgende bewering juist of onjuist volgens de tekst? | Alleen het juiste antwoord. Dit wordt vast gescoord, zonder interpretatie |
Kernelementen in plaats van een modelantwoord
Een modelantwoord zegt hoe het goede antwoord eruitziet. Een correctiemodel met kernelementen zegt waaraan je een goed antwoord herkent. Het verschil wordt duidelijk bij een samenvattende vraag:
- Modelantwoord
- "De schrijver vindt dat scholen smartphones moeten verbieden, omdat leerlingen zich dan beter concentreren." (2 punten)
- Met kernelementen
- 1 punt: het standpunt, een verbod op smartphones op school (ook goed: "telefoons in de kluis", "geen mobiel in de klas"). 1 punt: het hoofdargument, betere concentratie (ook goed: "minder afleiding", "meer aandacht voor de les"). Niet goed: "telefoons zijn slecht" zonder de koppeling met school.
Met de tweede versie herkent een AI-model eigen formuleringen, en weet het ook welk antwoord in de buurt komt maar niet genoeg is. Dat laatste is bij Nederlands het belangrijkst: de meeste discussie na een toets gaat over antwoorden die half goed zijn.
Drie afspraken die bij Nederlands horen
Te veel elementen
Vraagt de vraag om twee argumenten en noemt de leerling er vier, dan worden bij het centraal examen alleen de eerste twee beoordeeld. Een leerling kan dus niet alles opsommen in de hoop dat het goede ertussen zit. Wil je dat ook, zet het dan in de AI-context.
De woordgrens
Bepaal wat er gebeurt als een antwoord langer is dan toegestaan: een punt eraf, alleen de eerste woorden beoordelen, of niets. Zonder afspraak telt het AI-model de woorden misschien niet mee.
Taalfouten
Bij een tekstbegripvraag meet je begrip. Wil je dat spelfouten niet meetellen zolang het antwoord te begrijpen is, zeg dat dan. Bij een formuleervraag of schrijfopdracht is taal juist wat je beoordeelt, en dan hoort dat in de criteria.
Beoordeel alleen de eerste elementen die de leerling noemt, tot het gevraagde aantal. Spel- en formuleerfouten tellen niet mee zolang het antwoord eenduidig te begrijpen is. Een antwoord boven de woordgrens kost 1 punt.
Voorbeeld van AI-context bij een leesvaardigheidstoets
Wat de tekstherkenning met taal doet
Bij Nederlands is het belangrijk dat de herkenning het werk van de leerling niet verbetert. In ToetsChecker gebeurt dat ook niet:
- Spelling blijft staan. Schrijft een leerling "eigelijk" of "hun hebben", dan staat dat er ook zo. Een taalfout wordt niet stilzwijgend hersteld.
- Interpunctie en hoofdletters blijven staan. Er komt geen komma bij die de leerling niet zette, en een kleine letter wordt geen hoofdletter.
- De ij wordt geen y. In handschrift lijkt de ij vaak op een y. Bestaat het woord alleen met ij, dan wordt het ook zo gelezen: "schrijver", niet "schryver". Dat is een leesfout van de herkenning, geen spelfout van de leerling.
- Doorgestreept telt niet. Wat de leerling heeft doorgehaald, wordt niet meegelezen.
Schrijfopdrachten: criteria met niveaus
Een betoog, beschouwing of zakelijke brief is geen reeks losse vragen. Daarvoor heeft ToetsChecker een aparte modus voor verslagen en schrijfopdrachten. Je beoordeelt op criteria met niveaus, zoals je dat met een rubric op papier ook doet. Het AI-model zet markeringen in de tekst van de leerling: sterke passages, verbeterpunten en fouten, elk met een korte toelichting. Die markeringen ziet de leerling terug bij zijn feedback.
| Criterium | Onvoldoende | Voldoende | Goed |
|---|---|---|---|
| Standpunt en argumentatie | Geen duidelijk standpunt | Standpunt met twee argumenten | Standpunt, drie argumenten en een weerlegd tegenargument |
| Opbouw | Geen herkenbare inleiding of slot | Inleiding, kern en slot | Alinea's met duidelijke signaalwoorden en verbanden |
| Taalverzorging | Veel fouten die het lezen hinderen | Enkele fouten | Vrijwel foutloos |
Veelgestelde vragen
Kan een AI-model tekstbegrip nakijken?
Ja, als het correctiemodel per vraag de kernelementen en de toegestane omschrijvingen noemt. Dan herkent het AI-model eigen formuleringen en ziet het ook welke antwoorden half goed zijn. De docent controleert en keurt goed.
Worden spelfouten van leerlingen verbeterd bij het inlezen?
Nee. Spelling, interpunctie en hoofdletters worden overgenomen zoals ze op papier staan. Alleen een leesfout van de herkenning zelf, zoals een ij die als y wordt gelezen, wordt hersteld.
Kan ik een betoog laten beoordelen?
Ja, met de modus voor verslagen en schrijfopdrachten. Je legt criteria met niveaus vast, en het AI-model beoordeelt per criterium en zet markeringen in de tekst met een korte toelichting.
Hoe voorkom ik dat leerlingen alles opsommen?
Zet in de AI-context dat alleen de eerste elementen tot het gevraagde aantal worden beoordeeld, zoals bij het centraal examen. Vermeld dat ook op de toets zelf, zodat leerlingen het weten.