Nehos Groupe

L'essentiel sur le portail Open Data collectivité

Département d'Occitanie, 94 datasets identifiés comme devant être publiés en open data (obligations loi Lemaire + INSPIRE + données géographiques), zéro portail existant, données dispersées dans 12 applications métier distinctes. La direction des systèmes d'information avait tenté en 2023 une publication manuelle sur data.gouv.fr — abandonnée après 6 mois faute de processus de mise à jour.

Le portail Open Data Nehos est construit sur CKAN (le standard mondial des portails open data, utilisé par data.gouv.fr, le UK Government Data Service, l'Union Européenne), déployé sur OVHcloud, avec synchronisation automatique vers data.gouv.fr via l'API Harvest. Chaque dataset est décrit selon GeoDCAT-AP (conformité INSPIRE), mis à jour automatiquement depuis les systèmes sources via des pipelines ETL.

Cas client département Occitanie : 82 datasets publiés en 10 semaines (sur 94 identifiés, 12 exclus pour anonymisation complémentaire nécessaire), API REST publique disponible, 1 400 téléchargements uniques le premier mois. Budget mise en place : à partir de 29 k€ HT, maintenance annuelle à partir de 48 k€.

Les données géographiques (cadastre, zonage PLU, réseaux de transport) représentent 60 à 70 % de la valeur réutilisable d'un portail open data collectivité. Leur publication au format GeoJSON et Shapefile, avec métadonnées INSPIRE complètes, conditionne la conformité légale et l'intérêt pour les réutilisateurs professionnels (urbanistes, startups mobilité, journalistes de données).

Portail Open Data collectivité : publiez vos données, respectez la loi, créez de la valeur territoriale

La loi pour une République Numérique (2016) et la directive INSPIRE (2007) imposent aux collectivités de plus de 3 500 habitants de publier leurs données en open data. En 2026, une part significative des collectivités concernées n'a toujours pas de portail. Nehos vous accompagne de l'inventaire des données à la mise en ligne du portail conforme, en 12 semaines.

Adapté à toute taille de structure

Artisan
Startup
PME / TPE
ETI
Grand Groupe
Problématique

L'obligation d'open data pour les collectivités territoriales est désormais bien établie juridiquement, mais son application reste très inégale sur le terrain. La loi n°2016-1321 pour une République Numérique (dite loi Lemaire), complétée par les ordonnances de transposition des directives européennes PSI (Public Sector Information) et INSPIRE, impose aux collectivités de plus de 3 500 habitants et de 50 agents de publier leurs données produites ou reçues dans le cadre de leur mission de service public. En pratique, trois obstacles freinent la mise en conformité. Premier obstacle : l'absence d'inventaire. La plupart des collectivités ne savent pas précisément quelles données elles produisent, dans quels systèmes, à quelle fréquence de mise à jour, et avec quel statut juridique (données publiques ouvertes, données soumises à RGPD, données couvertes par un secret légal). Construire cet inventaire manuellement est fastidieux et nécessite une compétence juridique et technique combinée que les équipes DSI ne maîtrisent pas toujours. Deuxième obstacle : la qualité et le formatage des données. Les données publiques des collectivités sont rarement dans un état directement publiable. Les données SIG existent en de multiples projections (Lambert 93, WGS84, CC46, CC47 selon l'historique des outils), les données financières contiennent des lignes de commentaires et des formatages non standards, les délibérations sont scannées en PDF non océrisé. Publier des données de mauvaise qualité nuit à la réputation de la collectivité et génère des retours critiques de la communauté open data. Troisième obstacle : la pérennité de la publication. Un portail open data n'est utile que si ses données sont à jour. Or la mise à jour manuelle est incompatible avec la réalité des services : les agents qui ont publié les données initiales changent de poste, les systèmes sources évoluent, les formats changent. Sans pipeline de mise à jour automatique connectant les systèmes sources au portail, le portail devient rapidement une vitrine de données périmées — ce qui est pire que l'absence de portail du point de vue des réutilisateurs professionnels. La directive INSPIRE (2007/2/CE, transposée en droit français par l'ordonnance de 2010) ajoute des obligations spécifiques pour les données géographiques : les métadonnées doivent respecter le profil GeoDCAT-AP, les données doivent être accessibles via des services réseaux standardisés (WMS, WFS, API JSON), et les données des 34 thèmes INSPIRE doivent être publiées selon des spécifications techniques précises. Le non-respect de INSPIRE expose la collectivité à des mises en demeure de la Commission Européenne relayées par l'État français.

Notre solution

Le portail Open Data Nehos est construit sur CKAN (Comprehensive Knowledge Archive Network), la plateforme open source qui propulse data.gouv.fr, le data.gov américain, le UK Government Data Service et les portails open data de l'Union Européenne. Ce choix garantit la pérennité (code source auditable, communauté mondiale active), la compatibilité avec les standards (DCAT-AP, GeoDCAT-AP, JSON:API), et la synchronisation native avec data.gouv.fr via le protocole Harvest. L'inventaire des données est conduit en amont du déploiement technique. Nehos accompagne les équipes de la collectivité direction par direction pour identifier les données productrices, qualifier leur statut juridique (ouvertes, réservées, contenant des données personnelles nécessitant anonymisation ou exclusion), et définir la fréquence de mise à jour attendue. Le résultat est un catalogue documenté de tous les datasets de la collectivité, base de travail pour la publication et la conformité INSPIRE. Le nettoyage et la normalisation des données constituent le travail technique le plus important. Nehos réalise ce travail via des pipelines ETL (Extract-Transform-Load) développés sur mesure : reprojection des données SIG en WGS84 (standard INSPIRE), conversion des formats propriétaires (MIF/MID, DWG) vers les formats ouverts (GeoJSON, Shapefile, GML), océarisation des PDF scannés via OCR (Tesseract), normalisation des données tabulaires (CSV conformes RFC 4180). Les pipelines sont versionnés et documentés pour être maintenables par les équipes de la collectivité. L'API REST publique est déployée sur le même serveur CKAN, exposant tous les datasets au format JSON:API. Pour les données géographiques, des services réseaux INSPIRE sont déployés : WMS (Web Map Service) pour la visualisation, WFS (Web Feature Service) pour le téléchargement partiel, et WMTS pour les fonds de carte tuilés. Ces services sont référencés dans le Géoportail national de l'IGN et dans la géoplateforme nationale. La synchronisation avec data.gouv.fr est automatique via l'API Harvest de la plateforme : chaque nouveau dataset publié sur le portail de la collectivité est automatiquement moissonnné et référencé sur data.gouv.fr dans les 24 heures. Les mises à jour de données sont synchronisées selon le même mécanisme. Les métadonnées (titre, description, mots-clés, organisation productrice, licence, fréquence de mise à jour) sont saisies une seule fois dans CKAN et propagées automatiquement. Les pipelines de mise à jour automatique sont la condition de la pérennité du portail. Pour chaque dataset ayant une fréquence de mise à jour définie (mensuelle, trimestrielle, annuelle), un job cron est configuré pour extraire les données du système source (requête SQL vers la base de données SIG, export API depuis le logiciel métier, scraping structuré pour les délibérations), les transformer selon les mêmes règles ETL que pour la publication initiale, et les charger dans CKAN en remplaçant la version précédente. Les erreurs de pipeline sont notifiées au référent data de la collectivité par email. Le tableau de bord des usages est accessible aux agents référents data : nombre de téléchargements par dataset, API calls par jour, origine géographique des réutilisateurs, datasets les plus consultés, évolution mensuelle. Ces données alimentent le rapport annuel open data de la collectivité et la communication vers les élus.

82 datasets

publiés en 10 semaines sur le portail open data département Occitanie (sur 94 identifiés, 12 exclus pour anonymisation complémentaire), couvrant SIG, finances, urbanisme, transport et environnement

1 400

téléchargements uniques de datasets le premier mois de mise en ligne, dont 38 % via l'API REST (développeurs et startups), 62 % en téléchargement direct (chercheurs, associations, presse)

100 %

de conformité INSPIRE sur les 47 datasets géographiques publiés : métadonnées GeoDCAT-AP complètes, services WMS et WFS opérationnels, référencement géoplateforme nationale IGN

12 semaines

de mise en production du portail (inventaire + nettoyage ETL + déploiement CKAN + API REST + synchronisation data.gouv.fr + formation agents)

Cas concret

Résultats à 3 mois post-go-live : 82 datasets publiés (100 % des 82 prêts à publier), 1 400 téléchargements uniques en premier mois, 100 % de conformité INSPIRE sur les datasets géographiques (certifié par audit externe AFNOR), 3 startups locales ayant déclaré utiliser les données API pour des projets mobilité et environnement. Budget final : à partir de 29 k€ HT mise en place +à partir de 48 k€ HT/an maintenance. Les 12 datasets exclus initialement ont été publiés 6 semaines après, après anonymisation conduite par le DPO.

#Le problème : pourquoi portail Open Data collectivité est un enjeu critique

L'obligation d'open data pour les collectivités territoriales est désormais bien établie juridiquement, mais son application reste très inégale sur le terrain. La loi n°2016-1321 pour une République Numérique (dite loi Lemaire), complétée par les ordonnances de transposition des directives européennes PSI (Public Sector Information) et INSPIRE, impose aux collectivités de plus de 3 500 habitants et de 50 agents de publier leurs données produites ou reçues dans le cadre de leur mission de service public.

En pratique, trois obstacles freinent la mise en conformité. Premier obstacle : l'absence d'inventaire. La plupart des collectivités ne savent pas précisément quelles données elles produisent, dans quels systèmes, à quelle fréquence de mise à jour, et avec quel statut juridique (données publiques ouvertes, données soumises à RGPD, données couvertes par un secret légal). Construire cet inventaire manuellement est fastidieux et nécessite une compétence juridique et technique combinée que les équipes DSI ne maîtrisent pas toujours.

Deuxième obstacle : la qualité et le formatage des données. Les données publiques des collectivités sont rarement dans un état directement publiable. Les données SIG existent en de multiples projections (Lambert 93, WGS84, CC46, CC47 selon l'historique des outils), les données financières contiennent des lignes de commentaires et des formatages non standards, les délibérations sont scannées en PDF non océrisé. Publier des données de mauvaise qualité nuit à la réputation de la collectivité et génère des retours critiques de la communauté open data.

Troisième obstacle : la pérennité de la publication. Un portail open data n'est utile que si ses données sont à jour. Or la mise à jour manuelle est incompatible avec la réalité des services : les agents qui ont publié les données initiales changent de poste, les systèmes sources évoluent, les formats changent. Sans pipeline de mise à jour automatique connectant les systèmes sources au portail, le portail devient rapidement une vitrine de données périmées — ce qui est pire que l'absence de portail du point de vue des réutilisateurs professionnels.

La directive INSPIRE (2007/2/CE, transposée en droit français par l'ordonnance de 2010) ajoute des obligations spécifiques pour les données géographiques : les métadonnées doivent respecter le profil GeoDCAT-AP, les données doivent être accessibles via des services réseaux standardisés (WMS, WFS, API JSON), et les données des 34 thèmes INSPIRE doivent être publiées selon des spécifications techniques précises. Le non-respect de INSPIRE expose la collectivité à des mises en demeure de la Commission Européenne relayées par l'État français.

#Notre approche en 4 phases

#Phase 1 : Inventaire des données et qualification juridique (semaines 1-3)

Identification des données productrices (SIG, finances, urbanisme, déchets, RH anonymisées, délibérations), qualification juridique de chaque dataset (données ouvertes obligatoires loi Lemaire, données publiques facultatives, données personnelles à exclure ou anonymiser), définition des licences (Licence Ouverte 2.0, ODbL).

Voir notre expertise : portail open data collectivité souverain.

#Phase 2 : Configuration du portail et des métadonnées INSPIRE (semaines 4-7)

Déploiement de CKAN ou data.gouv.fr portal sur OVHcloud, paramétrage des catégories thématiques (géographie, environnement, urbanisme, finances, transport), saisie des métadonnées selon le profil GeoDCAT-AP (conformité INSPIRE directive 2007/2/CE), création des fiches de description pour chaque dataset.

Voir notre expertise : open data collectivité.

#Phase 3 : Publication des datasets et API REST (semaines 8-10)

Nettoyage et formatage des données dans les formats standards (CSV, GeoJSON, Shapefile, GML pour les données géographiques), déploiement de l'API REST publique (format JSON:API conforme INSPIRE), synchronisation automatique avec data.gouv.fr via l'API Harvest, mise en place des pipelines de mise à jour automatique depuis les systèmes sources.

Voir notre expertise : conformité RGPD open data.

#Phase 4 : Communication, formation agents et tableau de bord (semaines 11-12)

Formation des agents producteurs de données (saisie des métadonnées, procédures de mise à jour), communication auprès des réutilisateurs potentiels (startup, associations, presse, chercheurs), publication d'un annuaire des API sur le portail, tableau de bord des téléchargements et usages.

Voir notre expertise : SIG cartographie collectivité.

#Résultats mesurés

Les résultats ci-dessous sont issus de mesures opérationnelles en production — pas de projections théoriques, pas de moyennes sectorielles gonflées.

KPIRésultatContexte
publiés en 10 semaines sur le portail open data département Occitanie82 datasets(sur 94 identifiés, 12 exclus pour anonymisation complémentaire), couvrant SIG, finances, urbanisme, transport et environnement (Rapport publication Nehos 2025 — Département Occitanie, 2025)
téléchargements uniques de datasets le premier mois de mise en ligne, dont 38 % via l'API REST1 400(développeurs et startups), 62 % en téléchargement direct (chercheurs, associations, presse) (Analytics portail Nehos 2025 — Département Occitanie, 2025)
de conformité INSPIRE sur les 47 datasets géographiques publiés : métadonnées Ge100 %(Audit conformité INSPIRE Nehos 2025 — Département Occitanie, 2025)
de mise en production du portail12 semaines(inventaire + nettoyage ETL + déploiement CKAN + API REST + synchronisation data.gouv.fr + formation agents) (Planning projet Nehos 2025 — Département Occitanie, 2025)

82 datasets : publiés en 10 semaines sur le portail open data département Occitanie (sur 94 identifiés, 12 exclus pour anonymisation complémentaire), couvrant SIG, finances, urbanisme, transport et environnement.

1 400 : téléchargements uniques de datasets le premier mois de mise en ligne, dont 38 % via l'API REST (développeurs et startups), 62 % en téléchargement direct (chercheurs, associations, presse).

100 % : de conformité INSPIRE sur les 47 datasets géographiques publiés : métadonnées GeoDCAT-AP complètes, services WMS et WFS opérationnels, référencement géoplateforme nationale IGN.

#Cas client : Département d'Occitanie, direction des systèmes d'information

#Contexte

Département d'Occitanie, direction des systèmes d'information. 94 datasets identifiés comme obligatoirement publiables (loi Lemaire + INSPIRE + décisions CADA), zéro portail open data existant, données dispersées dans 12 applications métier (SIG ArcGIS, base financière Hélios, logiciel urbanisme Géovariances, déchets, transport). Tentative de publication manuelle sur data.gouv.fr en 2023 abandonnée. Budget disponible : à partir de 32 k€.

#Défi

Publier 94 datasets en conformité totale avec la loi Lemaire et INSPIRE, automatiser les mises à jour pour garantir la fraîcheur des données dans le temps, créer une API publique utilisable par des développeurs tiers, et former les agents des 12 directions productrices de données pour assurer l'autonomie post-déploiement — le tout en moins de 4 mois.

#Solution déployée

Inventaire juridique et technique des 94 datasets en 3 semaines (12 exclus pour anonymisation RH complémentaire nécessaire). Déploiement CKAN sur OVHcloud. Développement de 12 pipelines ETL Python (un par système source), avec reprojection SIG automatique, OCR pour délibérations PDF, normalisation CSV. Saisie des métadonnées GeoDCAT-AP pour les 47 datasets géographiques. Déploiement serveur MapServer pour WMS/WFS INSPIRE. Synchronisation data.gouv.fr via Harvest configurée. Formation : 1 atelier de 2 heures par direction productrice (12 ateliers en distanciel). Tableau de bord Grafana pour le suivi des usages.

#Résultats obtenus

Résultats à 3 mois post-go-live : 82 datasets publiés (100 % des 82 prêts à publier), 1 400 téléchargements uniques en premier mois, 100 % de conformité INSPIRE sur les datasets géographiques (certifié par audit externe AFNOR), 3 startups locales ayant déclaré utiliser les données API pour des projets mobilité et environnement. Budget final : à partir de 29 k€ HT mise en place +à partir de 48 k€ HT/an maintenance. Les 12 datasets exclus initialement ont été publiés 6 semaines après, après anonymisation conduite par le DPO.

#Pourquoi Nehos pour portail Open Data collectivité

Nehos Groupe n'est pas un intégrateur généraliste qui adapte une solution standard à votre contexte. On conçoit des architectures sur mesure, calibrées sur vos contraintes métier, réglementaires et techniques. Chaque projet démarre par un audit de faisabilité qui pose les limites avant les promesses — si le ROI ne tient pas, on le dit avant de signer quoi que ce soit.

Notre méthode ROI-First impose un cadrage chiffré dès la phase d'audit : coût actuel documenté, gains projetés avec hypothèses conservatrices, critères de go/no-go factuels. En production, on mesure les résultats réels et on les compare aux projections — transparence totale, y compris quand les chiffres sont en dessous des attentes. Nos expertises connexes : conformité RGPD open data, SIG cartographie collectivité, transformation numérique EPCI.

Stack technique souverain : hébergement OVHcloud (datacenters France), modèles IA open source (Mistral) quand la performance le permet, code propriétaire intégralement détenu par le client à la livraison. Pas de vendor lock-in, pas de dépendance à un fournisseur cloud américain pour vos données critiques.

#Pour aller plus loin

Cas d'usage connexes :

Questions & Réponses

Questions fréquentes sur le portail Open Data collectivité

Depuis la loi Lemaire (2016) et les ordonnances de transposition européenne, les collectivités de plus de 3 500 habitants et de plus de 50 agents ETP ont l'obligation de publier proactivement leurs données publiques en open data. Cette obligation concerne les données produites dans le cadre de leur mission de service public, dans les formats et conditions définis par la CADA et Etalab. La directive INSPIRE impose des obligations supplémentaires sur les données géographiques (34 thèmes couverts) pour toutes les collectivités, sans seuil de taille. Voir notre check-list détaillée sur [open data collectivité](/outils/checklist-open-data-collectivite) pour identifier vos datasets obligatoires.
data.gouv.fr est la plateforme nationale, gérée par Etalab, qui agrège les données de toutes les collectivités françaises. Publier directement dessus est possible mais présente des limites : interface de publication peu adaptée aux volumes importants, pas de personnalisation aux couleurs de la collectivité, pas d'API propre, pas de WMS/WFS INSPIRE, pas de pipeline de mise à jour automatisé. Un portail propre (CKAN) offre une meilleure expérience réutilisateur, des services INSPIRE complets, et une autonomie de gestion. La synchronisation automatique vers data.gouv.fr garantit que vos données sont référencées nationalement depuis votre portail — les deux approches sont complémentaires.
C'est la question la plus importante de la phase d'inventaire. Toute donnée contenant des informations personnelles identifiantes (noms, adresses, numéros de sécurité sociale, données de santé) ne peut être publiée en open data sans anonymisation préalable. L'anonymisation doit être irréversible — la pseudonymisation ne suffit pas. Nehos réalise l'analyse de chaque dataset au regard du RGPD lors de la phase d'inventaire, en lien avec le DPO de la collectivité. Les datasets non anonymisables dans les délais du projet sont exclus temporairement et traités séparément. Les données de fréquentation anonymisées (comptages piétons, statistiques transport sans identifiant) sont publiables sans restriction.
INSPIRE (Infrastructure for Spatial Information in Europe) est une directive européenne de 2007, transposée en droit français, qui impose la publication des données géographiques publiques selon des standards d'interopérabilité précis. Pour une collectivité, cela concerne notamment : le cadastre, les zonages PLU et SCOT, les réseaux de transport, les zones à risque (inondation, PPR), les équipements publics géolocalisés, les données hydrographiques. La conformité INSPIRE exige des métadonnées au format GeoDCAT-AP, des services réseau WMS et WFS opérationnels, et une référence dans le catalogue national (géoplateforme IGN). Le non-respect expose la collectivité à des rappels à l'ordre de l'État français relayant la Commission Européenne.
C'est le défi principal de tout portail open data — et la raison pour laquelle beaucoup de portails abandonnés contiennent des données périmées. La solution Nehos repose sur des pipelines ETL automatisés : pour chaque dataset ayant une fréquence de mise à jour définie, un job automatique extrait les données du système source (requête SQL, export API, scraping structuré), les transforme et les charge dans CKAN selon un calendrier configuré (quotidien, hebdomadaire, mensuel, annuel). Les agents n'ont à intervenir manuellement que pour les datasets exceptionnels (publication de données nouvelles, correction d'erreurs signalées). Un rapport d'exécution des pipelines est envoyé hebdomadairement au référent data.
Pour une commune de 20 000 habitants avec 15 à 25 datasets à publier, l'enveloppe typique se situe entre 12 000 et à partir de 873 € HT pour la mise en place complète (inventaire, déploiement CKAN, pipelines ETL, formation), et à partir de 1 746 € HT/an pour la maintenance. Pour un département avec 82 datasets et des obligations INSPIRE complètes sur les données géographiques, le coût constaté est de à partir de 29 k€ HT mise en place +à partir de 48 k€ HT/an. Les collectivités membres de la coopérative Open Data des Territoires (opendatafrance.net) bénéficient d'un accompagnement méthodologique gratuit qui peut réduire la phase d'inventaire. Contactez-nous pour un chiffrage personnalisé.
Réserver un audit