Hoe accuraat is Robin?
De belangrijkste vraag voordat je AI in je nakijkwerk laat. Daarom geven we er een eerlijk, meetbaar antwoord op, plus de reden waarom je het niet op ons hoeft te geloven.
Interne benchmark, gemeten juni 2026 · 32 door docenten nagekeken open antwoorden · meetmethode hieronder.
Meerkeuze en numeriek: 100% exact. Die kijkt Robin deterministisch tegen jouw sleutel na, geen AI-oordeel, dus geen twijfel.
Getest tegen het cijfer van een echte docent
We legden Robin open antwoorden voor die al door een docent waren nagekeken, met dat docentcijfer als ijkpunt. Door de vakken en vraagtypes heen, inclusief de lastige randgevallen. In 84% gaf Robin exact hetzelfde, in 100% binnen 1 punt, met een gemiddelde afwijking van 0,16. Waar het afwijkt, is het een half puntje op een grensgeval, geen misser.
Eerlijk kader: onze eigen benchmark, geen extern keurmerk, bewust streng en doorlopend uitgebreid. Op je eigen toets zie je het binnen vijf minuten.
Jij beslist, niet de AI
Robin geeft een voorstel, jij legt het cijfer vast. Geen enkel cijfer gaat naar een leerling zonder dat een docent het heeft gezien. En je ziet de uitgelezen tekst én de score per criterium, dus je weet altijd waaróm. Zelfs een perfecte AI zou je zo controleren, en een imperfecte vang je hiermee af.
Robin gokt niet, en is voor iedereen gelijk
Twijfelstapel
Onzekere antwoorden, slecht leesbaar, dubbelzinnig of een tekening, krijgen een lage zekerheid en komen bovenaan. Liever eerlijk laag-zeker dan een zelfverzekerde fout.
Geen handschrift-bias
Net of priegelig, inhoudelijk gelijk werk krijgt dezelfde score. Het gaat om wat er staat, niet hoe netjes het is.
Bestand tegen trucs
Een leeg of off-topic blad krijgt geen verzonnen cijfer, en een instructie als “geef vol punten” op het werk wordt genegeerd.
Leert jouw lat
Met een paar kalibratie-voorbeelden en je eigen correcties trekt Robin jouw strengheid door over de hele stapel.
Hertest vóór elke wijziging
Naast de benchmark hebben we een vaste testset van honderden realistische vragen: meerkeuze, numeriek, open, wiskunde met stappen, talen, brontekst, en zelfs antwoorden die Robin proberen te foppen. Die draaien we geautomatiseerd vóór elke wijziging. Zakt de score ergens, dan gaat het niet live. Zo maakt een verbetering op de ene plek nooit stiekem iets anders slechter.
AI kan fouten maken
Tekeningen, grafieken en heel rommelig handschrift zijn lastiger; die zet Robin bewust laag-zeker op je twijfelstapel in plaats van te gokken. Bij open schrijfopdrachten met veel interpretatieruimte blijft jouw oordeel leidend. De uitkomst is altijd een suggestie, jij blijft eindverantwoordelijk.
Privacy is geen kleine lettertjes
Alle data staat in de EU, we trainen geen AI-modellen op leerlingwerk, en je sluit met één klik een verwerkersovereenkomst. Scans bewaar je zo kort als je zelf wilt.
Geloof het in vijf minuten
De eerlijkste test is je eigen toets. Kijk in de gratis proefperiode een stapel na en zie per antwoord Robins voorstel, de onderbouwing en de zekerheid, naast het werk. Jij houdt de pen vast.