Metodología

Cómo tratamos los datos y las fuentes

1. Regla base: no inventar

No se inventa ningún dato: origen, significado, etimología, historia, fechas, personajes, linajes, nobleza, escudos, distribución, estadísticas, número de personas, variantes, fuentes, relaciones familiares, precios ni datos de empresas. Si algo no está disponible o no está suficientemente respaldado, se dice.

2. Niveles de evidencia

Cada bloque de contenido cualitativo lleva una etiqueta:

Una hipótesis nunca se presenta como un hecho. Cuando las fuentes discrepan, se indica.

3. Fuentes estadísticas

Para España se priorizan organismos oficiales, en particular el INE:

4. Cálculo de frecuencias

El número de personas por provincia procede de la fuente. Las frecuencias relativas son un cálculo propio:

frecuencia_10k = personas_apellido ÷ poblacion_provincia × 10.000
frecuencia_100k = personas_apellido ÷ poblacion_provincia × 100.000
porcentaje = personas_apellido ÷ poblacion_provincia × 100

Mientras no se cargue la población de una provincia, esa provincia solo muestra el número absoluto y se avisa.

5. Secreto estadístico

El INE no publica frecuencias iguales o inferiores a un umbral (por confidencialidad). Cuando un dato está protegido, se muestra como «no disponible por secreto estadístico». No se estima, no se interpola y no se reconstruye a partir de otros valores.

6. Variantes

Se listan variantes gráficas u ortográficas documentadas. Que dos personas lleven la misma variante no implica parentesco. La corrección aproximada del buscador («¿quizás quisiste decir…?») compara cadenas de texto; no afirma ninguna relación entre apellidos parecidos.

7. Contenido cualitativo (origen, etimología, historia)

Se redacta con lenguaje propio a partir de bibliografía onomástica y lingüística, citando autor, obra, año y página. No se copian literalmente textos con derechos de autor. Un apellido puede tener varios orígenes y ninguna localización única.

8. Sistema de calidad y publicación selectiva

Que un apellido exista en nuestra base de datos no significa que tenga una página, ni que esa página aparezca en Google. La base de datos y la arquitectura SEO están separadas a propósito. Preferimos 100 páginas excelentes a 10.000 repetitivas.

Puntuación de calidad

Cada ficha recibe una puntuación (surname_page_quality_score, 0–100) que combina, con pesos: cantidad de información real y no de relleno, calidad y número de fuentes, presencia de etimología e historia con evidencia, estadísticas nacionales, cobertura provincial, variantes documentadas, contenido diferencial (frente al resto de fichas) y utilidad. Una función central única decide el estado; ningún componente lo hace por su cuenta.

Tres estados

Para ser indexable, además del umbral de puntuación

La evaluación es dinámica: si una ficha mejora (más fuentes, más datos), sube de estado; si empeora o aparece un duplicado, baja. No creamos subpáginas por apellido (/apellido/x/origen, /historia…) salvo que haya una intención de búsqueda diferenciada y contenido específico que lo justifique; por defecto, una sola página completa.

Las búsquedas internas, los filtros, las ordenaciones y los estados del mapa nunca generan páginas indexables: llevan noindex y una URL canónica hacia la versión limpia.

9. Correcciones

Si detectas un error o una fuente mejor, escríbenos desde Contacto. Indica el apellido, el dato y la referencia.