Uw 0,5% is waarschijnlijk geen voorouder

science 2026-07-06

Kleine afkomstpercentages worden gelezen als verre familieleden en omgebouwd tot familieverhalen. Meestal is het het algoritme dat twijfelt. Hoe u het verschil ziet — en twee instellingen in uw resultaten die vrijwel niemand opent.

Iemand plaatst zijn afkomstresultaten online. Helemaal onderaan, onder de grote getallen, staat 0,5% Filipijns en Austronesisch. Binnen een uur hebben de reacties er een verhaal omheen gebouwd: tot slaaf gemaakte Malagassiërs die naar Amerika werden gebracht, een Spaanse koloniale route via de Filipijnen, een betovergrootmoeder die niemand zich herinnert.

Het is een mooi verhaal. Het kan zelfs waar zijn. Maar die 0,5% is er geen bewijs voor — en dezelfde middag krijgt iemand anders te horen dat zijn 0,2% Canarische Eilanden wijst op één specifieke voorouder van één specifieke archipel.

Zo ziet u het verschil tussen een echt signaal en een algoritme dat twijfelt.

Twee instellingen die vrijwel niemand opent

Bij 23andMe opent u Ancestry Composition en schuift u de betrouwbaarheidsregelaar van de standaard 50% naar 90%. De meeste componenten onder ongeveer 1% verdwijnen dan.

Ze zijn niet uit uw genoom verwijderd. Ze zaten er nooit met zekerheid in. De standaardweergave is de optimistische, en de regelaar is het hulpmiddel dat u dat vertelt.

Bij AncestryDNA klikt u op een regio. Naast het hoofdgetal staat een geschat bereik, en voor kleine regio's loopt dat bereik vaak tot 0%. Het getal op het overzichtsscherm is het midden van een schatting, gepresenteerd als een feit.

Geen van beide is verborgen. Ze worden alleen nooit geopend.

Leer de twijfel herkennen

Een echte set resultaten, onlangs geplaatst:

Regio Schatting
Centraal-Italië 2%
Zuid-Italië 2%
Noordoost-Italië 2%

Drie regio's. Identieke waarden.

Dat zijn geen drie Italiaanse voorouderlijnen. Dat is een algoritme dat onzekerheid gelijkmatig verdeelt omdat het niet tussen buren kan kiezen. Wanneer een stuk van uw genoom in vergelijkbare mate op meerdere referentiegroepen lijkt, wordt het over de dichtstbijzijnde opties verdeeld — en identieke lage waarden over aangrenzende regio's zijn daarvan het kenmerk.

Dezelfde resultaten toonden Frankrijk 6% en Iberisch Schiereiland 4%, in een familie met gedocumenteerde Peruaanse afkomst waar de Europese inbreng overwegend Spaans was. Los gelezen zijn dat drie bevindingen. Goed gelezen is het er één — ongeveer 16% Zuidwest-Europees — opgeknipt in gelabelde vakjes.

Waarom de vakjes niet standhouden

Een afkomstschatting is een gelijkenismeting ten opzichte van referentiepopulaties die iemand heeft gekozen. Het is geen opzoeking van waar uw voorouders woonden.

Europa is het duidelijkste geval. Zet Europeanen uit op hun DNA en u krijgt in wezen de kaart van Europa terug: allelfrequenties veranderen geleidelijk met de afstand in plaats van te springen bij landsgrenzen (Novembre et al., Nature, 2008, PMID: 18758442). Een prachtig resultaat over geografie, en een slechte basis om iemand aan één land toe te wijzen. Frankrijk, Iberië en Italië lopen in uw resultaten in elkaar over omdat ze dat in werkelijkheid ook doen.

Er bestaat een artikel dat precies over het overinterpreteren van deze grafieken gaat, met een memorabele titel: "A tutorial on how not to over-interpret STRUCTURE and ADMIXTURE bar plots" (Lawson et al., Nature Communications, 2018). De kern van het betoog: zeer verschillende bevolkingsgeschiedenissen kunnen vrijwel identieke staafdiagrammen opleveren. Eén vermengingsgolf twee eeuwen geleden en een continue lage genenstroom over twee millennia kunnen er hetzelfde uitzien.

De grafiek toont een verhouding. Niet wanneer, niet hoe, niet in welke richting. Al het overige voegt de lezer toe.

Drie dingen die een klein getal kan zijn

Het probleem is dat alle drie er op het scherm identiek uitzien.

En afstand werkt tegen u. Tien generaties terug heeft u 1.024 voorouders, maar slechts enkele honderden droegen detecteerbaar DNA aan u over. Recombinatie is een loterij: een echte voorouder kan volledig uit uw genoom verdwijnen terwijl een statistisch artefact op 0,5% staat te schitteren als een ontdekking.

Waar u wel op kunt vertrouwen

Vertrouw de grote componenten. 82% inheems Amerikaans, of 75% West-Afrikaans, is een groot en stabiel signaal dat tussen updates nauwelijks beweegt.

Vertrouw het subregionale detail binnen die grote componenten. Een West-Afrikaans resultaat dat Nigeriaans onderscheidt van Ghanees, Liberiaans en Sierra Leoons en van Senegambiaans, vertelt u iets echts over waar in West-Afrika uw voorouders vandaan kwamen. Dat is veel informatiever dan welke spoorcomponent ook — en het krijgt een fractie van de aandacht.

Behandel alles onder een paar procent als een misschien. Geen feit, geen aanwijzing, geen familieverhaal.

En als de getallen bij de volgende update verschuiven — dat gebeurt — dan verbetert de methode. Het was altijd al een meting met foutmarges. De meeste interfaces tekenen ze alleen niet.

Uw eigen resultaten lezen

De Ancestry-app rapporteert uw geschatte verhoudingen ten opzichte van referentiepopulaties, en de admixture-calculators doen hetzelfde op verschillende resoluties.

De kanttekeningen op deze pagina gelden voor die resultaten precies zoals voor die van ieder ander. Zoals bij elke app op het platform geeft de uitkomst aan waar uw genoom terecht was gekomen binnen die referentieset als het in de analyse was opgenomen — een gelijkenismeting onder een gekozen model, en geen bewijs van afstamming.

Scores in GenePlaza apps tell you what your result would have been if you had participated in the original study, within that cohort. They are not a statement that your personal risk is raised or lowered, and they are not medical advice.