Accuraatheid

Hoe accuraat is Robin?

De belangrijkste vraag voordat je AI in je nakijkwerk laat. Daarom geven we er een eerlijk, meetbaar antwoord op, plus de reden waarom je het niet op ons hoeft te geloven.

84%
exact gelijk aan de docent
100%
binnen 1 punt van de docent
0,16
gemiddelde afwijking (punt)
0,94
correlatie met het docentcijfer

Interne benchmark, gemeten juni 2026 · 32 door docenten nagekeken open antwoorden · meetmethode hieronder.

Meerkeuze en numeriek: 100% exact. Die kijkt Robin deterministisch tegen jouw sleutel na, geen AI-oordeel, dus geen twijfel.

Het bewijs

Getest tegen het cijfer van een echte docent

We legden Robin open antwoorden voor die al door een docent waren nagekeken, met dat docentcijfer als ijkpunt. Door de vakken en vraagtypes heen, inclusief de lastige randgevallen. In 84% gaf Robin exact hetzelfde, in 100% binnen 1 punt, met een gemiddelde afwijking van 0,16. Waar het afwijkt, is het een half puntje op een grensgeval, geen misser.

Eerlijk kader: onze eigen benchmark, geen extern keurmerk, bewust streng en doorlopend uitgebreid. Op je eigen toets zie je het binnen vijf minuten.

Robins score naast het docentcijfer per antwoord, telkens gelijk of binnen een halve punt
Een antwoord met de uitgelezen tekst, de score per rubric-criterium en de zekerheid: geen black box
Geen black box

Jij beslist, niet de AI

Robin geeft een voorstel, jij legt het cijfer vast. Geen enkel cijfer gaat naar een leerling zonder dat een docent het heeft gezien. En je ziet de uitgelezen tekst én de score per criterium, dus je weet altijd waaróm. Zelfs een perfecte AI zou je zo controleren, en een imperfecte vang je hiermee af.

De vangnetten

Robin gokt niet, en is voor iedereen gelijk

Twijfelstapel

Onzekere antwoorden, slecht leesbaar, dubbelzinnig of een tekening, krijgen een lage zekerheid en komen bovenaan. Liever eerlijk laag-zeker dan een zelfverzekerde fout.

Geen handschrift-bias

Net of priegelig, inhoudelijk gelijk werk krijgt dezelfde score. Het gaat om wat er staat, niet hoe netjes het is.

Bestand tegen trucs

Een leeg of off-topic blad krijgt geen verzonnen cijfer, en een instructie als “geef vol punten” op het werk wordt genegeerd.

Leert jouw lat

Met een paar kalibratie-voorbeelden en je eigen correcties trekt Robin jouw strengheid door over de hele stapel.

Zo houden we het scherp

Hertest vóór elke wijziging

Naast de benchmark hebben we een vaste testset van honderden realistische vragen: meerkeuze, numeriek, open, wiskunde met stappen, talen, brontekst, en zelfs antwoorden die Robin proberen te foppen. Die draaien we geautomatiseerd vóór elke wijziging. Zakt de score ergens, dan gaat het niet live. Zo maakt een verbetering op de ene plek nooit stiekem iets anders slechter.

Een geautomatiseerde testset met geslaagde cases, die we hertesten vóór elke wijziging
Eerlijk over de grenzen

AI kan fouten maken

Tekeningen, grafieken en heel rommelig handschrift zijn lastiger; die zet Robin bewust laag-zeker op je twijfelstapel in plaats van te gokken. Bij open schrijfopdrachten met veel interpretatieruimte blijft jouw oordeel leidend. De uitkomst is altijd een suggestie, jij blijft eindverantwoordelijk.

En je data?

Privacy is geen kleine lettertjes

Alle data staat in de EU, we trainen geen AI-modellen op leerlingwerk, en je sluit met één klik een verwerkersovereenkomst. Scans bewaar je zo kort als je zelf wilt.

EU-hostingGeen training op leerlingdataVerwerkersovereenkomst
Lees ons privacyverhaal →

Geloof het in vijf minuten

De eerlijkste test is je eigen toets. Kijk in de gratis proefperiode een stapel na en zie per antwoord Robins voorstel, de onderbouwing en de zekerheid, naast het werk. Jij houdt de pen vast.