Pochodzenie

Procenty pochodzenia: co naprawdę mówi mapa etniczna

Najbardziej efektowna i najczęściej źle rozumiana część wyniku. Skąd biorą się procenty, dlaczego zmieniają się po aktualizacji i czego na ich podstawie orzekać nie wolno.

To zwykle pierwsza rzecz, którą ogląda się po otwarciu wyniku: kolorowa mapa i lista procentów. Trzydzieści osiem procent Europy Wschodniej, dwadzieścia jeden procent Bałtów, kilka procent czegoś zaskakującego. Ta część wyniku robi największe wrażenie i jest najczęściej opacznie rozumiana.

Skąd biorą się procenty

Firma dysponuje panelami referencyjnymi: zestawami próbek od osób, o których wiadomo, że ich przodkowie od kilku pokoleń pochodzą z określonego obszaru. Twój materiał genetyczny jest porównywany z tymi panelami, a wynik to odpowiedź na pytanie, do której grupy odniesienia poszczególne fragmenty Twojego genomu są najbardziej podobne.

Zwróć uwagę na trzy słowa w tym zdaniu: podobieństwo, panele, odniesienie. Nie mierzy się tu żadnej wewnętrznej właściwości, tylko podobieństwo do arbitralnie dobranego zbioru współczesnych ludzi. Zmień zbiór, a zmieni się wynik.

Dlaczego wynik się zmienia

Osoby badające się dłużej znają to z doświadczenia: po aktualizacji algorytmu procenty potrafią się przesunąć o kilkanaście punktów, a bywa że jakaś kategoria znika całkiem. Wywołuje to zrozumiałą konsternację, bo DNA przecież się nie zmieniło.

I rzeczywiście się nie zmieniło. Zmieniły się panele referencyjne i sposób liczenia. Firmy powiększają zbiory odniesienia, dzielą szerokie kategorie na węższe, zmieniają metody. Każda taka zmiana przesuwa wyniki wszystkich klientów. To nie jest awaria ani oszustwo — to konsekwencja tego, czym estymaty są: oszacowaniem podobieństwa względem ruchomego punktu odniesienia.

Z tego samego powodu ta sama osoba badana w trzech firmach dostanie trzy różne zestawy procentów. Każda firma ma własne panele, własne nazwy regionów i własne granice między nimi.

Dlaczego akurat w Europie Środkowej jest najtrudniej

Rozdzielczość estymat jest bardzo nierówna geograficznie. Odróżnienie przodków z Europy od przodków z Azji Wschodniej czy Afryki Zachodniej jest zadaniem stosunkowo prostym i takim wynikom można ufać. Odróżnienie przodków polskich od ukraińskich, białoruskich czy słowackich jest zadaniem, którego przy obecnych metodach po prostu nie da się wykonać wiarygodnie.

Powód jest historyczny. Populacje Europy Środkowej i Wschodniej przez stulecia sąsiadowały, mieszały się i przemieszczały, a granice państwowe wielokrotnie przesuwały się przez te same rodziny. Nie ma czegoś takiego jak polski genotyp. Kategoria „Europa Wschodnia” w wyniku testu to obszar rozciągający się od Bałtyku po Bałkany, a nie wskazanie kraju.

Dlatego kilka procent przypisanych do jakiegoś sąsiedniego regionu nie jest dowodem, że któryś przodek stamtąd pochodził. Równie dobrze może być efektem szumu statystycznego albo tego, że panel referencyjny dla tego regionu zawiera osoby o mieszanym pochodzeniu.

Do czego estymaty się nadają

Nadają się do wychwycenia wyraźnego, nieoczekiwanego udziału z odległego geograficznie obszaru. Jeśli osoba o udokumentowanych od pokoleń polskich przodkach otrzymuje kilkanaście procent pochodzenia spoza Europy, to sygnał wart sprawdzenia w dokumentach — choć nadal nie jest to dowód, tylko wskazówka.

Nadają się także jako punkt wyjścia rozmowy w rodzinie. Bywa, że pytanie postawione przy okazji wyniku otwiera temat, o którym nikt wcześniej nie mówił, i prowadzi do konkretnego wspomnienia albo dokumentu.

Do czego się nie nadają

Nie są dowodem pochodzenia konkretnego przodka. Nie ustalają narodowości ani obywatelstwa i nie mają znaczenia w postępowaniach o potwierdzenie obywatelstwa, w których liczą się wyłącznie dokumenty. Nie zastępują aktu i nie wskazują miejscowości.

Nie są też podstawą do orzekania o przynależności do jakiejkolwiek grupy etnicznej lub wyznaniowej. Tożsamość jest kategorią kulturową i prawną, nie wynikiem laboratoryjnym, a historia dwudziestego wieku dostarcza aż nadto powodów, żeby zachować w tej sprawie ostrożność.

Haplogrupa to nie to samo co procenty

Osobnego wyjaśnienia wymaga rzecz, którą łatwo pomylić z estymatami. Część serwisów podaje obok procentów tak zwaną haplogrupę — oznaczenie w rodzaju R1a albo H1b. To wynik zupełnie innego rodzaju i nie należy go czytać jak mapy pochodzenia.

Haplogrupa ojcowska opisuje wyłącznie linię idącą od ojca przez dziadka po mieczu, a matczyna wyłącznie linię idącą od matki przez babkę po kądzieli. Dwie linie spośród wszystkich, które składają się na Twoje pochodzenie. Prapradziadkowie z pozostałych sześciu linii nie mają z tym oznaczeniem nic wspólnego.

Haplogrupy sięgają przy tym znacznie głębiej w przeszłość niż genealogia — mówią o wędrówkach populacji sprzed tysięcy lat, nie o tym, skąd pochodził prapradziadek. Zdanie „moja haplogrupa jest słowiańska” nie ma sensu w takim znaczeniu, w jakim bywa używane: haplogrupy rozkładają się na współczesne narody i nie pokrywają się z nimi.

Jak czytać własny wynik

Przyjmij, że kategorie kontynentalne są wiarygodne, kategorie regionalne orientacyjne, a wszystko poniżej kilku procent mieści się w granicach szumu. Zajrzyj, czy serwis podaje przedział ufności — część firm to robi i bywa on zaskakująco szeroki. Zanotuj datę odczytu i wersję algorytmu, bo za dwa lata wynik będzie wyglądał inaczej.

A potem odłóż mapę i wróć do listy dopasowań. To tam, a nie w procentach, kryje się informacja genealogiczna: konkretni ludzie, z konkretnymi drzewami i konkretnymi nazwiskami do sprawdzenia w aktach.

Źródła i dalsza lektura

Opracowanie redakcyjne. Metodyka i panele referencyjne są własnością poszczególnych firm, bywają zmieniane i nie zawsze są w pełni opisane publicznie — dokumentację metody sprawdzaj u dostawcy testu.