Verantwoording

Verantwoording & methodologie

Waar onze data vandaan komt, wat de cijfers precies tellen, hoe de citatiegraaf en de gezagsranking rekenen, wat de AI wel en niet mag — en wat wij niet weten.

Auteur: Ivo Donker, Alkmaar Bijgewerkt: 6 augustus 2026 Ruwe tekst (.md)

Dit document bestaat zodat u ons kunt controleren. Elke bewering die dit platform doet, komt ergens vandaan, en hier staat waarvandaan. Waar wij een keuze hebben gemaakt, staat de keuze erbij — inclusief de gevallen waarin die keuze aanvechtbaar is.

Peildatum van alle getallen in dit document: 6 augustus 2026.

1. De bron

Alle uitspraken komen van data.rechtspraak.nl, de open dataset van de Raad voor de rechtspraak. Wij voegen geen uitspraken toe, wij herschrijven geen tekst en wij verwijderen niets. De tekst die u op een detailpagina leest, is de tekst zoals de Rechtspraak die publiceert.

De Rechtspraak is de enige bron. Wij scrapen geen commerciële databanken, kopen geen bestanden bij en gebruiken geen tweedehands verzamelingen.

Actualiteit. Elke ochtend om 07:15 halen wij op wat er sinds de vorige run is gewijzigd, via het modified-venster van de Rechtspraak-API. Nieuwe uitspraken, correcties en intrekkingen komen zo binnen een dag binnen. Het venster wordt pas afgesloten als álles is gelukt; bij een fout pakt de volgende run de rest opnieuw op, zodat er niets stilletjes tussenuit valt.

2. Wat onze getallen precies tellen

Cijfers over jurisprudentie worden vaak zonder definitie genoemd, en dan lijken ze groter dan ze zijn. Hier staat exact wat wij tellen.

aantal
ECLI-records totaal 3.733.495
— waarvan uitspraken 3.658.100
— waarvan conclusies van de advocaat-generaal 75.395
Met volledige tekst doorzoekbaar 949.434
— uitspraken 915.538
— conclusies 33.896
Met inhoudsindicatie (samenvatting) 949.399
Met volledige tekst, vanaf 2020 430.197
Oudste uitspraak 28 januari 1841
Nieuwste uitspraak 5 augustus 2026

Het verschil dat u moet kennen. Een ECLI-record is niet hetzelfde als een gepubliceerde uitspraaktekst. Van de 3,7 miljoen records heeft ongeveer een kwart een volledige tekst; de rest bestaat alleen uit metadata (instantie, datum, zaaknummer, rechtsgebied) omdat de Rechtspraak van die zaken geen tekst publiceert. Als wij zeggen "3,7 miljoen ECLI's" bedoelen wij dus de metadata-laag, en als wij zeggen "949.000 doorzoekbaar" bedoelen wij de teksten. Zoeken op woorden werkt alleen in die 949.000.

En waarom staat dat naast de ~700.000 van de Rechtspraak? De Rechtspraak meldt ongeveer 700.000 gepubliceerde uitspraken sinds december 1999. Ons getal ligt hoger omdat wij ook de conclusies van het parket meetellen en omdat het metadatabestand ECLI's bevat die niet in die publicatietelling zitten. Beide getallen kloppen; ze tellen andere dingen. Wij zeggen dat liever hardop dan dat u het zelf moet ontdekken.

3. Zoeken

De zoekmachine draait op PostgreSQL 17 met een Nederlandse tsvector-index over de volledige tekst plus de inhoudsindicatie. Concreet:

  • Nederlandse stemmer. "Ontbinding", "ontbinden" en "ontbonden" vinden elkaar. Veel zoekmachines op Nederlandse tekst gebruiken een Engelse stemmer; dat scheelt merkbaar in wat u terugkrijgt.
  • Volledige tekst geïndexeerd, niet alleen titel en samenvatting.
  • Exacte telling. Er staat "2.028 resultaten", niet "2.000+". Dat kost soms een paar tienden van een seconde extra en dat vinden wij het waard: een afgerond getal dat de bovengrens van een instelling is, is geen informatie.
  • Metadata uit de bron. Instantie, uitspraakdatum en rechtsgebied zijn echte velden uit de XML, niet afgeleid uit de ECLI-string. Dat scheelt fouten bij gerechten die zijn opgeheven of hernoemd.

4. De citatiegraaf

Dit is het onderdeel dat u nergens anders gratis krijgt, en dus ook het onderdeel waar u het meest recht hebt op uitleg.

Wij lezen de volledige tekst van elke uitspraak en halen daar de verwijzingen naar andere uitspraken uit. Daarnaast lezen wij de formele relaties die de Rechtspraak zelf in de bron-XML zet.

aantal
Citaties tussen uitspraken (uit de tekst geparst) 1.063.217
Verwijzingen naar wetsartikelen 1.195.716
Formele relaties uit de bron-XML 268.350
Uitspraken met ten minste één inkomende citatie 162.886
Uitspraken met een bekende latere aanleg 131.596

Wat wij missen. De graaf is zo goed als de manier waarop rechters citeren. Een verwijzing als "HR 22 juni 2007, NJ 2008, 352" zonder ECLI herkennen wij minder betrouwbaar dan een expliciet ECLI-nummer. Verwijzingen in voetnoten van gescande oude uitspraken missen wij vaker. Onze citatietelling is daarom een ondergrens, geen exact getal.

5. De gezagsranking

Standaard sorteren wij zoekresultaten niet op tekstgelijkenis maar op gezag. Dit is de formule, letterlijk:

score = tekstrelevantie × gezagsfactor

gezagsfactor = (1 + ln(1 + aantal_citaties) / 3)
             × 0,65   als het document een conclusie van de A-G is
             × 1,60   Hoge Raad, Raad van State, CRvB, CBb
             × 1,25   gerechtshoven
             × 1,00   alle overige instanties

Drie dingen die u hierover moet weten:

Dit is onze keuze, geen wet. Er bestaat geen officiële maatstaf voor het gezag van een uitspraak. Wij hebben een model gekozen dat aansluit bij hoe juristen in de praktijk wegen, en de getallen zijn met de hand afgesteld. Een ander redelijk mens komt op andere gewichten uit.

De logaritme is opzettelijk. Een uitspraak met 100 citaties is belangrijker dan een met 10, maar geen tien keer zo belangrijk. Zonder de ln zouden een paar klassiekers de hele lijst overheersen.

De 0,65 voor conclusies lost een echt probleem op. Een conclusie van de advocaat-generaal is een advies aan de Hoge Raad, geen uitspraak. Ze zijn uitvoerig, goed geschreven en zitten vol trefwoorden, waardoor ze in een zoekmachine op tekstrelevantie bovenaan eindigen — vaak boven het arrest waar ze over gaan. Dat is de meest genoemde klacht over juridische AI-tools. Bij ons zakken ze, en ze dragen zichtbaar het label "Conclusie A-G".

U kunt de ranking altijd omzetten naar tekstrelevantie of datum. De knop staat boven de resultaten.

6. "Geldt dit nog?"

Boven elke uitspraak staat wat wij weten over een latere aanleg. Dat leiden wij af uit de formele relaties in de bron-XML, niet uit de tekst.

status aantal betekenis
Vernietigd 17.649 een latere rechter heeft deze uitspraak (deels) vernietigd
Bekrachtigd 29.618 een latere rechter heeft de uitspraak bevestigd
Latere aanleg 84.329 er is een vervolgprocedure; de uitkomst valt niet in één woord samen te vatten

Als een uitspraak meerdere latere aanleggen heeft, laten wij vernietiging zwaarder wegen dan bekrachtiging: een gebruiker moet als eerste zien dát er iets overhoop is gehaald.

Het belangrijkste geval is het geval zonder status. Van ruim 800.000 uitspraken vinden wij geen latere aanleg. Daar staat bij ons géén groen vinkje en geen woord "onherroepelijk", maar dit:

In de formele relaties van de Rechtspraak vinden wij geen hoger beroep of cassatie tegen deze uitspraak. Dat is geen bewijs dat de uitspraak onherroepelijk is: niet elke procedure wordt gepubliceerd.

Een tool die "onherroepelijk" zegt terwijl hij alleen "ik heb niets gevonden" bedoelt, is gevaarlijker dan een tool die niets zegt. Dit is het verschil tussen betrouwbaar zijn en betrouwbaar lijken, en wij kiezen bewust de eerste.

7. De AI

Op sommige plekken kunt u een vraag stellen of een samenvatting laten maken. Daarover het volgende, zonder marketing.

Welk model. De antwoorden worden gegenereerd door Mistral (mistral-large-latest), een Frans model dat op Europese infrastructuur draait. Wij hebben de keten bewust teruggebracht tot uitsluitend deze Europese aanbieder; eerder liepen er ook Amerikaanse en Chinese modellen in, en dat valt niet te rijmen met wat wij hier over privacy beloven.

Wat het model mag. Het krijgt uitspraken uit ónze database mee en moet daaruit antwoorden, met ECLI erbij. Het is een hulpmiddel om te begrijpen wat er staat.

Wat het model niet is. Geen advocaat, geen advies, geen voorspelling van uw zaak. Een taalmodel kan een vloeiende, overtuigende en volstrekt onjuiste alinea schrijven. Klik altijd de ECLI aan en lees de bron. Op 27 juli 2026 kreeg een Nederlandse advocaat een berisping omdat er acht verzonnen uitspraken in zijn processtukken stonden (ECLI:NL:TADRSHE:2026:93). Als een advocaat daarin trapt, kunt u het ook.

Transparantie. Conform artikel 50 van de AI-verordening staat bij elk AI-gegenereerd antwoord dat het door AI is gemaakt. Zie ook onze AI-transparantiepagina.

Uw gegevens. Wat u in een AI-vraag typt, gaat naar de modelaanbieder om het antwoord te maken. Zet er dus geen namen, adressen of dossiernummers in die u niet kwijt wilt. Wat wij bewaren en hoe lang, staat in de privacyverklaring.

8. Hoe deze site zelf gemaakt is

Dit platform is gebouwd door Ivo Donker in Alkmaar, samen met Claude van Anthropic als co-auteur van code en tekst. Elke regel code en elke bewering in deze documenten is door een mens beoordeeld voordat hij live ging.

Wij noemen dat niet uit bescheidenheid en niet als excuus. Het is relevant om dezelfde reden dat de rest van dit document relevant is: u hoort te weten hoe iets tot stand komt voordat u erop vertrouwt. Wat dat in de praktijk betekent, staat in Over dit platform.

9. Wat wij niet weten

Sluitstuk, en het eerlijkste deel van dit document.

  • Wij weten niet wat er niet gepubliceerd is. Ongeveer 71.300 van de circa 475.000 inhoudelijk gemotiveerde uitspraken per jaar worden gepubliceerd. Wat in de andere zaken is beslist, weet niemand buiten de rechtbank.
  • Wij weten niet of een uitspraak onherroepelijk is. Zie hoofdstuk 6.
  • Wij weten niet of onze gezagsformule "klopt". Er is geen goud-standaard om hem tegen af te zetten. Wij kunnen alleen laten zien hoe hij rekent.
  • Wij missen citaties. Zie hoofdstuk 4.
  • Wij dekken geen wetgeving, kamerstukken of literatuur. Alleen rechtspraak.
  • Recente uitspraken scoren laag op gezag, simpelweg omdat nog niemand ze heeft kunnen aanhalen. Zoekt u het nieuwste, zet de sortering op datum.

Een fout gevonden?

Graag. Stuur de ECLI en wat er misgaat naar [email protected]. Correcties in de brondata melden wij door aan de Rechtspraak; fouten in onze eigen afleidingen repareren wij zelf en vermelden wij hier.


Dit document is ook rauw op te vragen als verantwoording.md, zodat AI-assistenten en onderzoekers het ongefilterd kunnen lezen.

Vragen of een fout gevonden? [email protected] Verantwoording · Waarom · Handleiding · Over