Bewijs
De cijfers op deze site zijn alleen iets waard als u ze kunt narekenen. Daarom staat hier de methode, staan de uitkomsten per model naast elkaar en kan een partner dezelfde ronde in zijn eigen omgeving herhalen.
| Opzet | Controleerbare antwoorden | Beweringen zonder dekking | Aanvallen afgeslagen |
|---|---|---|---|
| Met de Innixa-laag | 96% | 0,8% | 8 van 8 |
| Zonder laag · Claude Opus 5 | 61% | 18,5% | 6 van 8 |
| Zonder laag · GPT-5.6-sol | 0% | 11,1% | 5 van 8 |
Zonder laag betekent hetzelfde model en dezelfde vragen, maar zonder de vier lagen ertussen. Een model zonder laag kan veel aanvallen afslaan en toch geen enkel antwoord geven dat naar het dossier verwijst. Lees de drie kolommen daarom samen.
Eigen meting op een echt dossier, augustus 2026. De laag verkleint het aantal ongegronde beweringen en sluit fouten niet uit. Innixa ondersteunt de zorgverlener en stelt geen diagnose.
Elke stap staat vast voordat er gemeten wordt. Wijzigt de laag of het model eronder, dan gaat de hele reeks opnieuw.
Een vaste set vragen over een echt dossier, opgesteld met zorgverleners. Erin zitten samenvattingen, terugzoekvragen, verloop over tijd en vragen die bewust buiten het dossier vallen.
Dezelfde set gaat meerdere keren door elke opzet, met de laag en zonder laag per model. We rapporteren het gemiddelde, zodat een uitschieter in één ronde de site niet haalt.
Elk antwoord wordt opgedeeld in losse beweringen. Per bewering kijken we of de verwijzing erbij staat en of de aangehaalde passage klopt. Een bewering telt alleen als beide het geval is.
Acht pogingen om de poortwachter te omzeilen, met vragen buiten het toegestane gebied, verhulde instructies en pogingen om bronnen te laten verzinnen. We tellen hoeveel daarvan worden afgeslagen.
Partners krijgen de vragenset, de beoordelingsregels en het meetscript, en draaien de ronde in hun eigen omgeving op hun eigen dossierstructuur. Pas een cijfer dat u zelf hebt overgedaan, is voor u bewijs.
Uitkomsten uit uw eigen ronde blijven bij u. Wij vragen er geen inzage in.
U krijgt de vragenset en de beoordelingsregels, in dezelfde vorm als wij ze gebruiken.
U kiest het model en de plek waar het draait, ook binnen uw eigen infrastructuur.
Het meetscript draait de rondes en levert per bewering één regel op, die uw eigen mensen kunnen nalopen.
Wijkt uw uitkomst af van de onze, dan is dat precies waar het gesprek over gaat.
We nemen de vragenset en de beoordelingsregels met u door, en spreken af welke ronde u zelf overdoet.