Metodología
Cómo tratamos los datos y las fuentes
1. Regla base: no inventar
No se inventa ningún dato: origen, significado, etimología, historia, fechas, personajes, linajes, nobleza, escudos, distribución, estadísticas, número de personas, variantes, fuentes, relaciones familiares, precios ni datos de empresas. Si algo no está disponible o no está suficientemente respaldado, se dice.
2. Niveles de evidencia
Cada bloque de contenido cualitativo lleva una etiqueta:
- Dato verificado — respaldado por una fuente primaria o por estadística oficial citada.
- Información probable — coincidencia amplia entre fuentes secundarias fiables, sin confirmación primaria.
- Hipótesis histórica — explicación propuesta por la bibliografía pero discutida o no demostrada.
- Información no determinada — no hay evidencia suficiente; no se muestra ningún valor.
Una hipótesis nunca se presenta como un hecho. Cuando las fuentes discrepan, se indica.
3. Fuentes estadísticas
Para España se priorizan organismos oficiales, en particular el INE:
- Distribución de un apellido: explotación estadística de apellidos del INE (Estadística del Padrón Continuo). Distingue 1.º apellido, 2.º apellido y ambos. Se indica la fecha de referencia y se enlaza la fuente.
- Población provincial: cifras oficiales de población del INE, usadas como denominador de las frecuencias relativas. La fecha de la población se declara y se procura que sea coherente con la de los datos de apellidos.
4. Cálculo de frecuencias
El número de personas por provincia procede de la fuente. Las frecuencias relativas son un cálculo propio:
frecuencia_10k = personas_apellido ÷ poblacion_provincia × 10.000
frecuencia_100k = personas_apellido ÷ poblacion_provincia × 100.000
porcentaje = personas_apellido ÷ poblacion_provincia × 100
Mientras no se cargue la población de una provincia, esa provincia solo muestra el número absoluto y se avisa.
5. Secreto estadístico
El INE no publica frecuencias iguales o inferiores a un umbral (por confidencialidad). Cuando un dato está protegido, se muestra como «no disponible por secreto estadístico». No se estima, no se interpola y no se reconstruye a partir de otros valores.
6. Variantes
Se listan variantes gráficas u ortográficas documentadas. Que dos personas lleven la misma variante no implica parentesco. La corrección aproximada del buscador («¿quizás quisiste decir…?») compara cadenas de texto; no afirma ninguna relación entre apellidos parecidos.
7. Contenido cualitativo (origen, etimología, historia)
Se redacta con lenguaje propio a partir de bibliografía onomástica y lingüística, citando autor, obra, año y página. No se copian literalmente textos con derechos de autor. Un apellido puede tener varios orígenes y ninguna localización única.
8. Sistema de calidad y publicación selectiva
Que un apellido exista en nuestra base de datos no significa que tenga una página, ni que esa página aparezca en Google. La base de datos y la arquitectura SEO están separadas a propósito. Preferimos 100 páginas excelentes a 10.000 repetitivas.
Puntuación de calidad
Cada ficha recibe una puntuación (surname_page_quality_score, 0–100) que combina, con pesos:
cantidad de información real y no de relleno, calidad y número de fuentes, presencia de etimología e historia
con evidencia, estadísticas nacionales, cobertura provincial, variantes documentadas, contenido diferencial
(frente al resto de fichas) y utilidad. Una función central única decide el estado; ningún componente lo hace
por su cuenta.
Tres estados
- No publicado — el registro existe pero no hay página. Sin URL, sin sitemap, sin enlaces internos.
- Público, no indexable — hay página útil para quien la consulta, pero con
noindexy fuera del sitemap. No compite en buscadores hasta tener más sustancia. - Público, indexable — página con información diferencial, fuentes suficientes, estructura y una intención de búsqueda real. Entra en el sitemap.
Para ser indexable, además del umbral de puntuación
- un bloque de origen o etimología con evidencia, fuente y extensión mínima;
- un mínimo de fuentes distintas y de contenido propio (nada de thin content);
- distribución provincial del INE con fecha, o declaración expresa de que no está disponible;
- revisión editorial registrada (persona y fecha);
- no ser casi-idéntica a otra página (control de duplicados por similitud de texto);
- título y meta description únicos; sin frases de relleno.
La evaluación es dinámica: si una ficha mejora (más fuentes, más datos), sube de estado; si
empeora o aparece un duplicado, baja. No creamos subpáginas por apellido
(/apellido/x/origen, /historia…) salvo que haya una intención de búsqueda
diferenciada y contenido específico que lo justifique; por defecto, una sola página completa.
Las búsquedas internas, los filtros, las ordenaciones y los estados del mapa nunca generan
páginas indexables: llevan noindex y una URL canónica hacia la versión limpia.
9. Correcciones
Si detectas un error o una fuente mejor, escríbenos desde Contacto. Indica el apellido, el dato y la referencia.