Sobre los datos: fuentes, método y límites (España)
Cada lista de este sitio se calcula a partir de registros públicos, no de otras webs. Esta página explica cuáles, cómo se usan y dónde se quedan cortos.
Fuentes
| Datos | Editor | Fecha | Licencia | Obtenido el |
|---|---|---|---|---|
| Apellidos y nombres más frecuentes: nombres con frecuencia igual o mayor a 20 | Instituto Nacional de Estadística (INE) | 2025-01-01 | CC BY 4.0 | 2026-09-20 |
| Apellidos y nombres más frecuentes: apellidos con frecuencia igual o mayor a 20 | Instituto Nacional de Estadística (INE) | 2025-01-01 | CC BY 4.0 | 2026-09-20 |
Las licencias se indican tal como las declara el editor. Consulta las páginas de los editores antes de reutilizar los archivos originales.
Cómo se elige un nombre
- Los nombres proceden de la estadística «Apellidos y nombres más frecuentes» del INE, basada en los Censos de población anuales a fecha 1 de enero de 2025. La lista recoge 63.440 pares de nombre y sexo con frecuencia igual o superior a 20 personas, que suman 44.846.689 residentes en España. Un nombre se elige con probabilidad proporcional a cuántas personas lo llevan.
- Los apellidos se eligen de forma independiente en la lista de apellidos del INE. El primer apellido se elige según cuántas personas lo tienen como primer apellido y el segundo según cuántas lo tienen como segundo, y los dos apellidos de una misma persona nunca coinciden. Nombre y apellidos no se influyen entre sí, así que la herramienta no sabe que algunas combinaciones son más frecuentes que otras.
- El control Realismo eleva cada peso a una potencia. Con 1, el sorteo sigue las frecuencias reales; con 0, todos los nombres son igual de probables.
- Todas las elecciones al azar parten de una sola semilla. La misma semilla, las mismas opciones y la misma página dan siempre la misma lista, y por eso el enlace bajo el generador reproduce una lista exactamente.
Qué cubre cada lista
- Las listas de nombres conservan los nombres más frecuentes hasta cubrir el 95 % de las personas de cada sexo (el 85 % como mínimo si el archivo resultara demasiado grande). Los nombres menos frecuentes se dejan fuera para que la descarga de cada página sea pequeña.
- La lista de apellidos conserva los 7.726 más frecuentes de 86.511. Eso equivale al 87 % de las personas de la tabla de apellidos, formada por los apellidos con al menos 20 personas como primer apellido. Llegar al 95 % exigiría un archivo varias veces mayor de lo que permitimos.
Qué no dicen los datos
- El INE solo publica nombres y apellidos con al menos 20 personas, así que los más raros no aparecen. Los datos son de residentes en España a 1 de enero de 2025, extranjeros incluidos, y no de nacimientos.
- El INE publica nombres y apellidos en mayúsculas y sin tildes: José aparece como Jose, María como Maria y García como Garcia. La ñ y la ç sí se conservan (Muñoz, Begoña). No restituimos las tildes para no inventar datos.
- Los nombres compuestos, como María Carmen o José Antonio, son entradas propias del INE y se eligen como un solo nombre con su frecuencia real. Una persona que se llama María cuenta aparte de otra que se llama María Carmen.
- El INE no publica los nombres por año de nacimiento, solo las listas de los 50 más frecuentes por década, y por eso no hay páginas por década. Tampoco hay diferencias por provincia ni combinaciones de nombre y apellidos.
- La edad media que aparece es la de las personas que llevan cada nombre en esa fecha, no la edad a la que se puso el nombre.
Páginas que no se generan
Una página solo se genera si sus datos superan una comprobación: suficientes nombres, una fuente registrada y un texto lo bastante distinto del de las páginas hermanas. Todas las páginas previstas superaron la comprobación en la última generación.