De vaste deuk/vervorming én kras blijven aanwezig onder tien afzonderlijke pixeltransformaties. Type, aantal en minimale 0,50 IoU moeten exact kloppen.
Eerste poging 7/10 bleef bewaardVaste POC · evaluator vooraf bevroren
Drie lokale poorten
Één echte AI-controle
De actuele suite gebruikt dertig aantoonbaar verschillende invoeren: tien schadevarianten, tien nulcontroles en tien registratieverstoringen. Daarna beoordeelt GPT-5.6 de twee labelvrij voorgestelde regio’s tien keer via de publieke endpoint. Criteria, ruwe uitvoer, hashes en ook mislukte eerdere pogingen blijven zichtbaar.
Bekijk het volledige proces →Vier bevroren poorten behaald
Evaluator niet aan de modellen meegegeven · exacte bestanden gehasht · ruwe inferentie vóór scoring opgeslagen
Tien verschillende fotometrische varianten van hetzelfde referentiebeeld leveren exact nul nieuwe schadebevindingen op.
Geen extra melding toegestaanSIFT-kenmerken en RANSAC-homografie halen voor alle tien geometrische verstoringen de vooraf vastgelegde match-, inlier- en foutgrenzen.
30/30 invoerbestanden hash- en pixeluniekDe publieke endpoint bevestigt per run exact M001 als deuk/vervorming en M002 als kras, met minimaal twee afzonderlijke GPT-5.6-passages en daarna menselijke controle.
Bewijst voorstelcontrole, niet zelfstandige detectieDit bewijst reproduceerbaarheid voor dit ene beeldpaar, deze modelversies en deze bevroren varianten. Het bewijst geen vlootbrede nauwkeurigheid en geen autonoom schade- of aansprakelijkheidsbesluit.
Open lokaal rapport ↗Vaste case · echte invoerfoto's
Dít beeldpaar
draagt het bewijs
De 40/40-suite gaat niet over een willekeurige marketingauto. Zij test precies deze uitgifte- en retourfoto, plus de twee zichtbare regio's die daaruit labelvrij zijn voorgesteld.


REGIO M001Contour verandert
De bumperlijn wijkt lokaal af. Dat is het eerste voorstel dat vervolgens tien varianten en de onafhankelijke verifier moet doorstaan.
REGIO M002Reflectie wordt onderbroken
De korte laklijn blijft los van de bredere lichtreflectie. Alleen deze smalle regio telt als tweede voorstel.
Bewijsgrens Deze foto's onderbouwen de vaste case. De nieuwe premium voertuigbeelden elders op de site zijn presentatiebeelden en tellen niet mee in de 40/40-score.
Oud regressiebewijs behouden
Twee sessies · drie scenario’s · twintig herhaalruns per scenario · nul verwachte schadecoördinaten tijdens inferentie
Iedere run vindt precies één vervorming en één kras. Geen extra melding; beide kaders halen minimaal 0,50 IoU met de pas na inferentie geopende evaluatiezones.
2/2 typen · minimale overlap behaald · 0 extra meldingenHet uitgiftebeeld wordt met zichzelf vergeleken. Alle herhaalruns eindigen zonder nieuwe schade.
0 nieuwe schade in twintig identieke vergelijkingenHetzelfde beeld met +6% gain en +7 helderheidswaarden. Geen enkele run verwart alleen het lichtverschil met nieuwe schade.
0 schade door uitsluitend helderheidsvariatieDit is sterk, reproduceerbaar bewijs voor dit ene beeldpaar, deze modelversie en deze twee nulcontroles. Het is uitdrukkelijk geen universele garantie voor ieder voertuig of iedere opnameconditie.
Download testboek ↓Twee bewijsniveaus
Geen ontbrekend spoor
wordt mooier gemaakt
Sessie A bevat alle afzonderlijke uitkomsten. Van sessie B is het live eindresultaat bewaard. Daarom noemen we de som 60/60, maar blijven de onderliggende bewijssoorten expliciet verschillend.
Volledig machineleesbaar
Alle dertig runtijden, voorspellingen, typen, scores en overlapmetingen staan in één onveranderlijk JSON-log.
Open ruwe gegevens ↗
Live eindscherm vastgelegd
Dezelfde publieke runner behaalde opnieuw drie keer 10/10. Er is geen tweede per-run JSON-log; het opgeschoonde screenshot toont uitsluitend het relevante REVYR-eindscherm.
Controleketen
Voorstel, verificatie
en menselijk besluit
De actuele route scheidt de labelvrije lokale detector van de onafhankelijke GPT-5.6-verifier en het uiteindelijke oordeel van de medewerker. De evaluator blijft buiten beide modellen.
Labelvrij voorstel
Het lokale ONNX-model ontvangt alleen beide beelden en produceert klasse, score en regio. Het kent geen evaluator, verwacht aantal of schadecoördinaten.
Onafhankelijke verifier
GPT-5.6 beoordeelt ieder voorstel op normale BEFORE/AFTER-beelden. Minimaal twee afzonderlijke passages moeten het aandachtspunt bevestigen.
Scoring achteraf
Pas nadat alle ruwe uitvoer is opgeslagen, opent de runner de vooraf bevroren evaluator en beoordeelt hij type, aantal, drempels en kwaliteit.
Mens houdt controle
Een bevestigde regio is een aandachtspunt, geen aansprakelijkheidsclaim. De medewerker bekijkt de plek en kan een detailfoto toevoegen of afwijzen.
De twee afwijkingen doorstaan tien lokale schadevarianten, tien nulcontroles, tien registratietests en tien live GPT-verificatieruns op deze vaste case.
Geen 100%-claim voor andere voertuigen, lichtsoorten, weersituaties, invalshoeken, sensoren, verborgen schade of zelfstandige GPT-detectie.
Lees eindrapport