---
titel: Verantwoording & methodologie
beschrijving: Waar onze data vandaan komt, wat de cijfers precies tellen, hoe de citatiegraaf en de gezagsranking rekenen, wat de AI wel en niet mag — en wat wij niet weten.
bijgewerkt: 2026-08-06
---

# Verantwoording & methodologie

Dit document bestaat zodat u ons kunt controleren. Elke bewering die dit
platform doet, komt ergens vandaan, en hier staat waarvandaan. Waar wij een
keuze hebben gemaakt, staat de keuze erbij — inclusief de gevallen waarin die
keuze aanvechtbaar is.

Peildatum van alle getallen in dit document: **6 augustus 2026**.

## 1. De bron

Alle uitspraken komen van **[data.rechtspraak.nl](https://data.rechtspraak.nl)**,
de open dataset van de Raad voor de rechtspraak. Wij voegen geen uitspraken toe,
wij herschrijven geen tekst en wij verwijderen niets. De tekst die u op een
detailpagina leest, is de tekst zoals de Rechtspraak die publiceert.

De Rechtspraak is de enige bron. Wij scrapen geen commerciële databanken, kopen
geen bestanden bij en gebruiken geen tweedehands verzamelingen.

**Actualiteit.** Elke ochtend om 07:15 halen wij op wat er sinds de vorige run
is gewijzigd, via het `modified`-venster van de Rechtspraak-API. Nieuwe
uitspraken, correcties en intrekkingen komen zo binnen een dag binnen. Het
venster wordt pas afgesloten als álles is gelukt; bij een fout pakt de volgende
run de rest opnieuw op, zodat er niets stilletjes tussenuit valt.

## 2. Wat onze getallen precies tellen

Cijfers over jurisprudentie worden vaak zonder definitie genoemd, en dan lijken
ze groter dan ze zijn. Hier staat exact wat wij tellen.

| | aantal |
|---|---|
| ECLI-records totaal | 3.733.495 |
| — waarvan uitspraken | 3.658.100 |
| — waarvan conclusies van de advocaat-generaal | 75.395 |
| **Met volledige tekst doorzoekbaar** | **949.434** |
| — uitspraken | 915.538 |
| — conclusies | 33.896 |
| Met inhoudsindicatie (samenvatting) | 949.399 |
| Met volledige tekst, vanaf 2020 | 430.197 |
| Oudste uitspraak | 28 januari 1841 |
| Nieuwste uitspraak | 5 augustus 2026 |

**Het verschil dat u moet kennen.** Een ECLI-record is niet hetzelfde als een
gepubliceerde uitspraaktekst. Van de 3,7 miljoen records heeft ongeveer een
kwart een volledige tekst; de rest bestaat alleen uit metadata (instantie,
datum, zaaknummer, rechtsgebied) omdat de Rechtspraak van die zaken geen tekst
publiceert. Als wij zeggen "3,7 miljoen ECLI's" bedoelen wij dus de
metadata-laag, en als wij zeggen "949.000 doorzoekbaar" bedoelen wij de teksten.
Zoeken op woorden werkt alleen in die 949.000.

**En waarom staat dat naast de ~700.000 van de Rechtspraak?** De Rechtspraak
meldt ongeveer 700.000 gepubliceerde uitspraken sinds december 1999. Ons getal
ligt hoger omdat wij ook de conclusies van het parket meetellen en omdat het
metadatabestand ECLI's bevat die niet in die publicatietelling zitten. Beide
getallen kloppen; ze tellen andere dingen. Wij zeggen dat liever hardop dan dat
u het zelf moet ontdekken.

## 3. Zoeken

De zoekmachine draait op PostgreSQL 17 met een Nederlandse `tsvector`-index over
de volledige tekst plus de inhoudsindicatie. Concreet:

- **Nederlandse stemmer.** "Ontbinding", "ontbinden" en "ontbonden" vinden
  elkaar. Veel zoekmachines op Nederlandse tekst gebruiken een Engelse stemmer;
  dat scheelt merkbaar in wat u terugkrijgt.
- **Volledige tekst geïndexeerd**, niet alleen titel en samenvatting.
- **Exacte telling.** Er staat "2.028 resultaten", niet "2.000+". Dat kost soms
  een paar tienden van een seconde extra en dat vinden wij het waard: een
  afgerond getal dat de bovengrens van een instelling is, is geen informatie.
- **Metadata uit de bron.** Instantie, uitspraakdatum en rechtsgebied zijn
  echte velden uit de XML, niet afgeleid uit de ECLI-string. Dat scheelt fouten
  bij gerechten die zijn opgeheven of hernoemd.

## 4. De citatiegraaf

Dit is het onderdeel dat u nergens anders gratis krijgt, en dus ook het
onderdeel waar u het meest recht hebt op uitleg.

Wij lezen de volledige tekst van elke uitspraak en halen daar de verwijzingen
naar andere uitspraken uit. Daarnaast lezen wij de formele relaties die de
Rechtspraak zelf in de bron-XML zet.

| | aantal |
|---|---|
| Citaties tussen uitspraken (uit de tekst geparst) | 1.063.217 |
| Verwijzingen naar wetsartikelen | 1.195.716 |
| Formele relaties uit de bron-XML | 268.350 |
| Uitspraken met ten minste één inkomende citatie | 162.886 |
| Uitspraken met een bekende latere aanleg | 131.596 |

**Wat wij missen.** De graaf is zo goed als de manier waarop rechters citeren.
Een verwijzing als "HR 22 juni 2007, NJ 2008, 352" zonder ECLI herkennen wij
minder betrouwbaar dan een expliciet ECLI-nummer. Verwijzingen in voetnoten van
gescande oude uitspraken missen wij vaker. Onze citatietelling is daarom een
**ondergrens**, geen exact getal.

## 5. De gezagsranking

Standaard sorteren wij zoekresultaten niet op tekstgelijkenis maar op gezag.
Dit is de formule, letterlijk:

```
score = tekstrelevantie × gezagsfactor

gezagsfactor = (1 + ln(1 + aantal_citaties) / 3)
             × 0,65   als het document een conclusie van de A-G is
             × 1,60   Hoge Raad, Raad van State, CRvB, CBb
             × 1,25   gerechtshoven
             × 1,00   alle overige instanties
```

Drie dingen die u hierover moet weten:

**Dit is onze keuze, geen wet.** Er bestaat geen officiële maatstaf voor het
gezag van een uitspraak. Wij hebben een model gekozen dat aansluit bij hoe
juristen in de praktijk wegen, en de getallen zijn met de hand afgesteld. Een
ander redelijk mens komt op andere gewichten uit.

**De logaritme is opzettelijk.** Een uitspraak met 100 citaties is belangrijker
dan een met 10, maar geen tien keer zo belangrijk. Zonder de `ln` zouden een
paar klassiekers de hele lijst overheersen.

**De 0,65 voor conclusies lost een echt probleem op.** Een conclusie van de
advocaat-generaal is een advies aan de Hoge Raad, geen uitspraak. Ze zijn
uitvoerig, goed geschreven en zitten vol trefwoorden, waardoor ze in een
zoekmachine op tekstrelevantie bovenaan eindigen — vaak boven het arrest waar
ze over gaan. Dat is de meest genoemde klacht over juridische AI-tools. Bij ons
zakken ze, en ze dragen zichtbaar het label "Conclusie A-G".

U kunt de ranking altijd omzetten naar **tekstrelevantie** of **datum**. De knop
staat boven de resultaten.

## 6. "Geldt dit nog?"

Boven elke uitspraak staat wat wij weten over een latere aanleg. Dat leiden wij
af uit de formele relaties in de bron-XML, niet uit de tekst.

| status | aantal | betekenis |
|---|---|---|
| Vernietigd | 17.649 | een latere rechter heeft deze uitspraak (deels) vernietigd |
| Bekrachtigd | 29.618 | een latere rechter heeft de uitspraak bevestigd |
| Latere aanleg | 84.329 | er is een vervolgprocedure; de uitkomst valt niet in één woord samen te vatten |

Als een uitspraak meerdere latere aanleggen heeft, laten wij vernietiging zwaarder
wegen dan bekrachtiging: een gebruiker moet als eerste zien dát er iets
overhoop is gehaald.

**Het belangrijkste geval is het geval zonder status.** Van ruim 800.000
uitspraken vinden wij geen latere aanleg. Daar staat bij ons géén groen vinkje
en geen woord "onherroepelijk", maar dit:

> In de formele relaties van de Rechtspraak vinden wij geen hoger beroep of
> cassatie tegen deze uitspraak. Dat is **geen bewijs** dat de uitspraak
> onherroepelijk is: niet elke procedure wordt gepubliceerd.

Een tool die "onherroepelijk" zegt terwijl hij alleen "ik heb niets gevonden"
bedoelt, is gevaarlijker dan een tool die niets zegt. Dit is het verschil tussen
betrouwbaar zijn en betrouwbaar lijken, en wij kiezen bewust de eerste.

## 7. De AI

Op sommige plekken kunt u een vraag stellen of een samenvatting laten maken.
Daarover het volgende, zonder marketing.

**Welk model.** De antwoorden worden gegenereerd door **Mistral**
(`mistral-large-latest`), een Frans model dat op Europese infrastructuur draait.
Wij hebben de keten bewust teruggebracht tot uitsluitend deze Europese
aanbieder; eerder liepen er ook Amerikaanse en Chinese modellen in, en dat valt
niet te rijmen met wat wij hier over privacy beloven.

**Wat het model mag.** Het krijgt uitspraken uit ónze database mee en moet
daaruit antwoorden, met ECLI erbij. Het is een hulpmiddel om te begrijpen wat er
staat.

**Wat het model niet is.** Geen advocaat, geen advies, geen voorspelling van uw
zaak. Een taalmodel kan een vloeiende, overtuigende en volstrekt onjuiste alinea
schrijven. **Klik altijd de ECLI aan en lees de bron.** Op 27 juli 2026 kreeg
een Nederlandse advocaat een berisping omdat er acht verzonnen uitspraken in
zijn processtukken stonden (ECLI:NL:TADRSHE:2026:93). Als een advocaat daarin
trapt, kunt u het ook.

**Transparantie.** Conform artikel 50 van de AI-verordening staat bij elk
AI-gegenereerd antwoord dat het door AI is gemaakt. Zie ook onze
[AI-transparantiepagina](/juridisch#ai).

**Uw gegevens.** Wat u in een AI-vraag typt, gaat naar de modelaanbieder om het
antwoord te maken. Zet er dus geen namen, adressen of dossiernummers in die u
niet kwijt wilt. Wat wij bewaren en hoe lang, staat in de
[privacyverklaring](/juridisch#gebruikers).

## 8. Hoe deze site zelf gemaakt is

Dit platform is gebouwd door **Ivo Donker** in Alkmaar, samen met **Claude**
van Anthropic als co-auteur van code en tekst. Elke regel code en elke bewering
in deze documenten is door een mens beoordeeld voordat hij live ging.

Wij noemen dat niet uit bescheidenheid en niet als excuus. Het is relevant om
dezelfde reden dat de rest van dit document relevant is: u hoort te weten hoe
iets tot stand komt voordat u erop vertrouwt. Wat dat in de praktijk betekent,
staat in [Over dit platform](/over).

## 9. Wat wij niet weten

Sluitstuk, en het eerlijkste deel van dit document.

- **Wij weten niet wat er niet gepubliceerd is.** Ongeveer 71.300 van de circa
  475.000 inhoudelijk gemotiveerde uitspraken per jaar worden gepubliceerd. Wat
  in de andere zaken is beslist, weet niemand buiten de rechtbank.
- **Wij weten niet of een uitspraak onherroepelijk is.** Zie hoofdstuk 6.
- **Wij weten niet of onze gezagsformule "klopt".** Er is geen goud-standaard om
  hem tegen af te zetten. Wij kunnen alleen laten zien hoe hij rekent.
- **Wij missen citaties.** Zie hoofdstuk 4.
- **Wij dekken geen wetgeving, kamerstukken of literatuur.** Alleen rechtspraak.
- **Recente uitspraken scoren laag op gezag**, simpelweg omdat nog niemand ze
  heeft kunnen aanhalen. Zoekt u het nieuwste, zet de sortering op datum.

## Een fout gevonden?

Graag. Stuur de ECLI en wat er misgaat naar
[info@neuralex.nl](mailto:info@neuralex.nl). Correcties in de brondata melden wij
door aan de Rechtspraak; fouten in onze eigen afleidingen repareren wij zelf en
vermelden wij hier.

---

*Dit document is ook rauw op te vragen als
[verantwoording.md](/docs/verantwoording.md), zodat AI-assistenten en
onderzoekers het ongefilterd kunnen lezen.*
