
Publicar datos abiertos puede parecer sencillo: seleccionar un conjunto de datos, ofrecerlo en uno o varios formatos, describirlo en un portal y ponerlo a disposición de ciudadanos, empresas, investigadores u otras administraciones. Pero publicar un dato no significa necesariamente que pueda encontrarse, entenderse y reutilizarse fácilmente.
Dos administraciones pueden publicar información equivalente y describirla de formas completamente distintas. Una puede utilizar categorías normalizadas, identificar claramente al organismo responsable y explicar correctamente cómo acceder al dato; otra puede utilizar campos de texto libre o dejar información relevante sin completar.
Una persona probablemente podrá interpretar estas diferencias. Para una máquina que intenta agregar automáticamente miles de conjuntos de datos procedentes de distintos portales, el problema es mucho mayor.
Aquí entra en juego DCAT-AP-ES: un modelo común para describir los catálogos y conjuntos de datos en España de forma interoperable y alineada con el ecosistema europeo.
¿Qué es DCAT-AP-ES?
DCAT-AP-ES puede entenderse como la adaptación española de un modelo europeo utilizado para describir catálogos de datos.

Dicho de una forma sencilla: DCAT-AP-ES ayuda a que los catálogos de datos hablen el mismo idioma.
Cuando consultamos un portal, además del propio dato necesitamos información que nos permita saber qué contiene, quién lo publica, cuándo se actualizó, cómo podemos acceder a él o en qué condiciones puede reutilizarse.
Esa información es la que permite que el conjunto de datos pueda ser descubierto y entendido por personas y sistemas.
De NTI-RISP a DCAT-AP-ES
En España, la Norma Técnica de Interoperabilidad de Reutilización de Recursos de Información (NTI-RISP) publicada en 2013 ha sido durante años una de las principales referencias para la publicación y reutilización de información del sector público.
Sin embargo, el ecosistema del dato ha cambiado significativamente desde entonces. Hoy hablamos de APIs, federación automática de catálogos, espacios de datos, acceso programático o Conjuntos de Datos de Alto Valor (High-Value Datasets, HVD).
La evolución hacia DCAT-AP-ES responde a este nuevo contexto y busca alinear los catálogos españoles con los estándares y obligaciones europeas actuales. Entre otras cosas, facilita la federación con datos.gob.es y con el ecosistema europeo de datos abiertos, mejora la interoperabilidad y permite representar nuevos requisitos, como los asociados a los HVD.
Aunque el nuevo modelo se integra en la nueva NTI-RISP todavía en proceso de tramitación, las organizaciones pueden comenzar ya a analizar sus catálogos y preparar la transición.
Pero esa transición no debería entenderse simplemente como un cambio técnico.
¿Qué cambia realmente con DCAT-AP-ES?
Una de las principales aportaciones de DCAT-AP-ES es que permite describir con mayor precisión los diferentes elementos que forman parte de un catálogo.
Por ejemplo, distingue entre el conjunto de datos, las distintas formas en las que puede descargarse y los servicios o APIs que permiten acceder a él.
Supongamos que una administración publica información sobre calidad del aire. Puede ofrecer un fichero con el histórico completo, otro formato actualizado diariamente y una API para consultar las mediciones de una estación concreta. Todo ello puede formar parte del mismo conjunto de datos, pero ofrece diferentes formas de acceso. DCAT-AP-ES ayuda a representar estas relaciones de manera homogénea.
Además, la interoperabilidad no depende únicamente de utilizar una estructura común. También es necesario utilizar criterios y vocabularios homogéneos.
Si un organismo clasifica unos datos como «Transporte», otro como «Movilidad» y otro utiliza una categoría distinta, una persona puede detectar fácilmente la relación entre ellos. Una máquina no tiene por qué hacerlo.
Por eso, no basta con compartir una estructura de metadatos: también debemos compartir su significado.
DCAT-AP-ES y los HVD
DCAT-AP-ES está además directamente relacionado con los High-Value Datasets (HVD) (lee más acerca de los HVD en este artículo).
La regulación europea identifica determinados conjuntos de datos públicos cuyo potencial de reutilización puede generar importantes beneficios económicos, sociales y ambientales.
Estos datos se agrupan en seis grandes categorías: geoespacial, observación de la Tierra y medio ambiente, meteorología, estadística, sociedades y propiedad de sociedades, y movilidad.
Para que estos datasets puedan identificarse y reutilizarse adecuadamente, sus catálogos deben ser capaces de indicar de forma estructurada que se trata de datos de alto valor y cómo puede accederse a ellos.
Por tanto, DCAT-AP-ES proporciona el marco necesario para describir estos recursos de forma interoperable dentro del ecosistema español y europeo.
Conformidad no es lo mismo que calidad de metadatos
Una organización puede disponer de metadatos técnicamente conformes con DCAT-AP-ES y seguir ofreciendo un catálogo de poca utilidad.
Por ejemplo, podemos tener una descripción cuyo contenido sea simplemente:
«Datos estadísticos».
Técnicamente existe una descripción.
Pero ¿permite realmente entender qué contiene el dataset?
Lo mismo ocurre si indicamos una frecuencia de actualización que después no cumplimos, utilizamos palabras clave demasiado genéricas, mantenemos contactos desactualizados o proporcionamos enlaces que ya no funcionan.
Por tanto, existen dos preguntas diferentes:
¿Nuestros metadatos cumplen el modelo?
y
¿Nuestros metadatos tienen suficiente calidad para facilitar realmente la localización, comprensión y reutilización de los datos?
La primera está relacionada con la conformidad.
La segunda nos lleva a la calidad de los metadatos.
Aquí entran metodologías como Metadata Quality Assessment (MQA), orientadas a evaluar aspectos como la facilidad de localización, accesibilidad, interoperabilidad o reutilización. Además, muchos problemas que aparecen durante una migración a DCAT-AP-ES no son tecnológicos. Si no sabemos quién es responsable de mantener un dataset, cambiar el modelo no solucionará el problema. Si no existe un proceso para actualizar los metadatos, tampoco conseguiremos que estén al día.
Un estándar puede ayudarnos a estructurar los metadatos, pero no puede crear por sí solo una buena gestión de metadatos.
¿Cómo preparar un catálogo para DCAT-AP-ES?
Antes de iniciar una migración conviene conocer bien la situación de partida.
Una primera evaluación debería permitir responder a preguntas como:
-
- ¿Tenemos inventariados correctamente los conjuntos de datos?
- ¿Sabemos quién es responsable de cada uno?
- ¿Los títulos y descripciones permiten entender su contenido?
- ¿Utilizamos criterios homogéneos para clasificarlos?
- ¿Las fechas, licencias y enlaces están actualizados?
- ¿Tenemos identificados nuestros High-Value Datasets?
- ¿Sabemos qué calidad tienen nuestros metadatos?
A partir de ahí, la transición puede abordarse de forma progresiva: analizar la correspondencia con DCAT-AP-ES, normalizar criterios, revisar los requisitos HVD, adaptar la plataforma e incorporar mecanismos de validación y mejora continua. Porque la migración no termina cuando el nuevo modelo se publica correctamente.
El verdadero objetivo debe ser conseguir que la calidad se mantenga en el tiempo.
El verdadero objetivo: publicar datos que puedan reutilizarse
Podríamos adoptar DCAT-AP-ES simplemente porque una norma lo exige, pero nos perderíamos buena parte de su valor.
El verdadero cambio aparece cuando dejamos de entender nuestro catálogo como una página web aislada y empezamos a verlo como un nodo dentro de una red de catálogos de datos.
Una administración publica sus datasets. Un catálogo nacional puede recolectar su información. Esa información puede federarse posteriormente con infraestructuras europeas y ser descubierta por reutilizadores que ni siquiera conocían el portal original. Ese es el objetivo de la interoperabilidad. No necesitamos que todos los portales sean iguales. Necesitamos que todos puedan entenderse.
DCAT-AP-ES proporciona un lenguaje común para conseguirlo. Porque el objetivo final no es simplemente publicar datos conformes con DCAT-AP-ES.
El objetivo es publicar datos que puedan encontrarse, entenderse y reutilizarse realmente.
¿Quieres mejorar tu catálogo de datos abiertos?
En DQTeam ayudamos a administraciones y organizaciones a evaluar, mejorar y evolucionar sus portales y catálogos de datos abiertos.
Analizamos tanto los procesos de gestión y publicación como la calidad de los metadatos, apoyándonos en estándares y buenas prácticas como DCAT-AP-ES, Metadata Quality Assessment (MQA), los requisitos europeos para High-Value Datasets y las Especificaciones UNE 0077, UNE 0078, UNE 0079 y UNE 0080.
El objetivo es aumentar la calidad, interoperabilidad, encontrabilidad y reutilización de los datos publicados, definiendo además una hoja de ruta concreta para su mejora.
