O danych: źródła, metoda i ograniczenia (Polska)
Każda lista na tej stronie jest liczona z rejestrów publicznych, a nie z innych stron internetowych. Ta strona mówi, z jakich rejestrów, jak są używane i gdzie mają ograniczenia.
Źródła
| Dane | Wydawca | Lata | Licencja | Pobrano |
|---|---|---|---|---|
| Lista imion występujących w rejestrze PESEL (osoby żyjące), imię pierwsze | Ministerstwo Cyfryzacji | 2026-01-20 | CC0 1.0 | 2026-09-19 |
| Nazwiska występujące w rejestrze PESEL | Ministerstwo Cyfryzacji | 2026-01-20 | CC0 1.0 | 2026-09-19 |
| Imiona nadawane dzieciom w Polsce | Ministerstwo Cyfryzacji | 2000-2025 | CC0 1.0 | 2026-09-19 |
Licencje podano tak, jak deklaruje wydawca. Przed ponownym użyciem surowych plików sprawdź strony wydawców powyżej.
Jak losowane jest imię
- Imiona pochodzą z rejestru PESEL, z którego dane udostępnia Ministerstwo Cyfryzacji. Lista obejmuje 69 730 różnych par imię i płeć oraz 43 994 923 osób żyjących, stan na 20 stycznia 2026, i dotyczy pierwszego imienia. Imię jest losowane z prawdopodobieństwem proporcjonalnym do liczby osób, które je noszą. Strony dekad korzystają z osobnego zestawu: imion nadanych dzieciom urodzonym od 2000 roku.
- Nazwisko jest losowane niezależnie z listy nazwisk z rejestru PESEL, proporcjonalnie do liczby osób, które je noszą. Kobietom wybierana jest żeńska forma tam, gdzie nazwisko się odmienia. Imię i nazwisko nie wpływają na siebie, więc narzędzie nie wie, że niektóre połączenia są częstsze od innych.
- Suwak Realizm podnosi każdą wagę do potęgi. Przy 1 losowanie odpowiada prawdziwym częstościom, przy 0 każde imię jest równie prawdopodobne.
- Wszystkie losowe wybory pochodzą z jednego ziarna. To samo ziarno, te same opcje i ta sama strona zawsze dają tę samą listę, dlatego link pod generatorem odtwarza listę dokładnie.
Ile danych obejmuje każda lista
- Listy imion zachowują najczęstsze imiona, aż obejmą 95% osób każdej płci (najniżej 85%, jeśli plik byłby zbyt duży). Rzadsze imiona są pomijane, aby pobieranie każdej strony było małe.
- Lista nazwisk zawiera 9 354 najczęstszych z 258 569 nazwisk. To 65% osób z tabeli nazwisk, a sama tabela obejmuje 95,4% wszystkich osób w rejestrze. Pełne 95% wymagałoby pliku kilkukrotnie większego, niż dopuszczamy.
Czego dane nie mówią
- Rejestr PESEL obejmuje wszystkie osoby z numerem PESEL, także cudzoziemców. Do list trafiły tylko imiona i nazwiska zapisane literami polskiego alfabetu; pominięto 0,13% osób z imionami spoza niego (na przykład Nguyễn czy Müller), aby lista wyglądała jak polska. Ministerstwo publikuje statystyki tylko dla imion, które wystąpiły co najmniej 2 razy.
- To zestawienie osób żyjących na dzień 20 stycznia 2026, a nie urodzeń. Strona główna, strony imion żeńskich, męskich, nazwisk i liter opisują żyjących w różnym wieku. Strony dekad korzystają z imion nadawanych dzieciom od 2000 roku; do 2012 roku imiona z mniej niż 5 wystąpieniami nie były publikowane, od 2013 roku granicą jest 2.
- Żeńskie formy nazwisk są ustalane z danych: forma jest przyjmowana, gdy występuje w rejestrze i ma co najmniej 30% liczebności formy męskiej. Nazwiska bez potwierdzonej formy żeńskiej, głównie cudzoziemskie, są pomijane, aby nie wylosować kobiecie formy męskiej. Po tym tabela obejmuje 95,4% osób z rejestru, a nazwisko zmieniające formę nosi 32% z nich.
- Imię i nazwisko nie są ze sobą powiązane. Różnice regionalne i drugie imiona nie są jeszcze w danych. Strony liter obejmują litery A do Z bez Q, V, X, Y i liter z polskimi znakami (Ł, Ś, Ż): imiona na nie są w generatorze, ale nie mają osobnych stron.
Strony, które nie powstają
Strona powstaje tylko wtedy, gdy jej dane przechodzą kontrolę: wystarczająca liczba imion, zapisane źródło i tekst dostatecznie różny od stron siostrzanych. Wszystkie planowane strony przeszły kontrolę w ostatniej kompilacji.