
No todos los datos públicos tienen el mismo potencial de reutilización.
Información como las direcciones, las parcelas catastrales, las observaciones meteorológicas, los datos ambientales, determinadas estadísticas o ciertos datos empresariales puede utilizarse para crear aplicaciones, investigaciones, servicios y productos muy diferentes. Son datos que, cuando se publican adecuadamente, pueden generar un impacto económico, social y ambiental especialmente elevado.
De esta idea nacen los High-Value Datasets (HVD), o Conjuntos de Datos de Alto Valor.
Pero hay un matiz importante: un HVD no es simplemente un conjunto de datos que una organización considere importante.
El concepto tiene un significado concreto dentro de la regulación europea de datos abiertos. La Unión Europea ha identificado determinados conjuntos de datos públicos cuyo potencial de reutilización justifica que deban ponerse a disposición bajo unas condiciones especialmente favorables.
Y esto cambia no solo qué datos debemos publicar, sino también cómo debemos publicarlos.
¿Qué son los High-Value Datasets?
La Directiva (UE) 2019/1024 sobre datos abiertos y reutilización de la información del sector público introdujo el concepto de High-Value Dataset.
Posteriormente, el Reglamento de Ejecución (UE) 2023/138 concretó qué conjuntos deben considerarse HVD y estableció las condiciones específicas para su publicación y reutilización.
La idea es sencilla: existen determinados datos públicos cuya reutilización puede generar beneficios importantes, favorecer nuevos servicios y resultar especialmente útiles para empresas, investigadores, administraciones y ciudadanía.
Por tanto, hablar de HVD implica responder a dos preguntas:
¿Qué datos son considerados de alto valor?
y
¿qué debemos hacer de forma diferente para publicarlos?
Las seis categorías de datos de alto valor

La variedad demuestra que los HVD no pertenecen a un único sector. Además, gran parte de su potencial aparece al combinar unos conjuntos con otros.
Datos meteorológicos y geoespaciales pueden utilizarse conjuntamente para evaluar riesgos. Información de movilidad puede combinarse con datos ambientales. Estadísticas económicas pueden enriquecerse con información empresarial.
Por eso, el valor no reside únicamente en el dataset individual, sino también en su capacidad para interoperar con otros datos.
¿Qué cambia al publicar un HVD?
Identificar que un dataset está incluido en la regulación no es suficiente.
Los HVD deben poder reutilizarse con las menores barreras técnicas y jurídicas posibles.
En términos generales, esto significa que deben ofrecerse:
-
- gratuitamente, salvo las excepciones previstas
- en formatos adecuados para su procesamiento
- mediante APIs cuando corresponda
- mediante descarga masiva cuando sea necesaria
- bajo condiciones abiertas de reutilización
- y con información suficiente para que puedan descubrirse e identificarse correctamente
Esto supone un cambio respecto a una concepción de los datos abiertos basada únicamente en colocar periódicamente un fichero en un portal.
Una API permite que otro sistema acceda directamente a los datos. La descarga masiva permite obtener el conjunto completo cuando un caso de uso lo necesita. Y unos buenos metadatos permiten saber qué contiene el recurso, cómo acceder a él y en qué condiciones reutilizarlo.
En definitiva, un HVD debe estar preparado para ser reutilizado, no únicamente para ser visualizado o descargado de forma manual.
HVD y DCAT-AP-ES: dos piezas que deben encajar
Para que un High-Value Dataset pueda descubrirse correctamente no basta con que la organización sepa internamente que lo es.
Esa condición debe poder ser interpretada también por otros sistemas. Aquí aparece la conexión directa con DCAT-AP-ES (lee más acerca de DCAT-AP-ES en este artículo).
DCAT-AP-ES permite describir de forma común los recursos publicados en los catálogos españoles y alinearlos con el ecosistema europeo. En el caso de los HVD, permite indicar de manera estructurada que un dataset es de alto valor, a qué categoría pertenece y cuáles son las distintas formas de acceder a él. De este modo, catálogos nacionales y europeos pueden identificar estos recursos y comprender cómo reutilizarlos.
Por tanto, DCAT-AP-ES es una pieza fundamental para describir correctamente los HVD dentro de los catálogos españoles.
Identificar un HVD es solo el primer paso
Llegados a este punto podría parecer suficiente revisar las seis categorías y marcar los datasets correspondientes, pero la realidad es algo más compleja.
El Reglamento no establece que cualquier dato relacionado con medio ambiente, estadística o movilidad sea automáticamente un HVD. La regulación concreta qué conjuntos están incluidos y, en algunos casos, también establece condiciones específicas sobre la información que deben contener o la forma en la que deben actualizarse y publicarse. Por tanto, la organización debe comprobar qué datasets posee y si encajan realmente dentro de las definiciones establecidas.
Y una vez identificado un HVD aparece una segunda pregunta:
¿lo estamos publicando realmente como un High-Value Dataset?
Podemos haberlo identificado correctamente y, sin embargo:
-
- no disponer de los mecanismos de acceso necesarios
- utilizar formatos poco adecuados
- mantener metadatos incompletos
- tener enlaces que no funcionan
- o no cumplir determinadas condiciones de actualización
Además, existe una diferencia importante entre cumplimiento y calidad. Podemos satisfacer formalmente los requisitos y seguir dificultando la reutilización si las descripciones son demasiado genéricas, los servicios son poco fiables o la información está desactualizada.
Por eso los HVD están directamente relacionados con tres dimensiones: cumplimiento, interoperabilidad y calidad.
¿Está tu organización preparada para publicar HVD?
Una primera evaluación puede comenzar respondiendo algunas preguntas:
-
- ¿Sabemos qué datasets pueden estar afectados por la regulación HVD?
- ¿Hemos comprobado que encajan en las definiciones establecidas?
- ¿Los datos están disponibles en formatos adecuados?
- ¿Disponemos de los mecanismos de acceso necesarios?
- ¿Las condiciones de reutilización son correctas?
- ¿Los metadatos identifican adecuadamente los HVD?
- ¿Estamos preparados para describirlos conforme a DCAT-AP-ES?
- ¿Se mantienen actualizados los datos y sus metadatos?
- ¿Existe un responsable claro de cada conjunto?
Si varias respuestas son negativas, probablemente el reto no esté únicamente en el portal. Afectará también a los datos, los metadatos, los servicios de acceso, los procesos y el gobierno que existe detrás de su publicación.
El objetivo: convertir datos de alto valor en datos realmente reutilizables
Los HVD representan, en el fondo, un cambio en la manera de entender los datos abiertos.
Estamos pasando de pensar:
«Tengo un fichero que puedo publicar»
a pensar:
«Tengo un activo de datos que otros necesitan reutilizar de forma fiable».
Ese cambio resulta especialmente relevante en un contexto en el que los datos públicos pueden alimentar aplicaciones, modelos analíticos, sistemas de inteligencia artificial, espacios de datos y servicios digitales.
La publicación deja de ser únicamente un ejercicio de transparencia. Pasa también a convertirse en una infraestructura para la reutilización.
La Unión Europea ha identificado determinados conjuntos de datos con un potencial especialmente elevado para generar beneficios económicos, sociales y ambientales. Pero ese potencial no se materializa simplemente porque el dato exista dentro de una administración o aparezca listado en un portal. Para generar valor, debe poder descubrirse, entenderse, accederse y reutilizarse con facilidad. Por eso los High-Value Datasets están estrechamente relacionados con DCAT-AP-ES, interoperabilidad, calidad de metadatos y gobierno del dato.
Porque un dato no genera valor por recibir la etiqueta de “alto valor”, sino cuando conseguimos que otros puedan reutilizarlo realmente.
¿Necesitas evaluar tus datos de alto valor?
En DQTeam ayudamos a administraciones y organizaciones a evaluar y mejorar sus portales y catálogos de datos abiertos, incluyendo la identificación y análisis de High-Value Datasets (HVD).
Revisamos los requisitos aplicables a cada conjunto, sus mecanismos de publicación y acceso y la calidad e interoperabilidad de sus metadatos y su adecuación a DCAT-AP-ES.
Todo ello se integra dentro de una evaluación más amplia de los procesos de gestión y publicación de datos abiertos, apoyándonos en DCAT-AP-ES, Metadata Quality Assessment (MQA), la regulación europea de HVD y las Especificaciones UNE 0077, UNE 0078, UNE 0079 y UNE 0080.
El objetivo es identificar brechas y definir una hoja de ruta concreta para mejorar la calidad, interoperabilidad, encontrabilidad y reutilización de los datos publicados.
