L'essentiel sur le portail Open Data collectivité
Département d'Occitanie, 94 datasets identifiés comme devant être publiés en open data (obligations loi Lemaire + INSPIRE + données géographiques), zéro portail existant, données dispersées dans 12 applications métier distinctes. La direction des systèmes d'information avait tenté en 2023 une publication manuelle sur data.gouv.fr — abandonnée après 6 mois faute de processus de mise à jour.
Le portail Open Data Nehos est construit sur CKAN (le standard mondial des portails open data, utilisé par data.gouv.fr, le UK Government Data Service, l'Union Européenne), déployé sur OVHcloud, avec synchronisation automatique vers data.gouv.fr via l'API Harvest. Chaque dataset est décrit selon GeoDCAT-AP (conformité INSPIRE), mis à jour automatiquement depuis les systèmes sources via des pipelines ETL.
Cas client département Occitanie : 82 datasets publiés en 10 semaines (sur 94 identifiés, 12 exclus pour anonymisation complémentaire nécessaire), API REST publique disponible, 1 400 téléchargements uniques le premier mois. Budget mise en place : à partir de 29 k€ HT, maintenance annuelle à partir de 48 k€.
Les données géographiques (cadastre, zonage PLU, réseaux de transport) représentent 60 à 70 % de la valeur réutilisable d'un portail open data collectivité. Leur publication au format GeoJSON et Shapefile, avec métadonnées INSPIRE complètes, conditionne la conformité légale et l'intérêt pour les réutilisateurs professionnels (urbanistes, startups mobilité, journalistes de données).
Portail Open Data collectivité : publiez vos données, respectez la loi, créez de la valeur territoriale
La loi pour une République Numérique (2016) et la directive INSPIRE (2007) imposent aux collectivités de plus de 3 500 habitants de publier leurs données en open data. En 2026, une part significative des collectivités concernées n'a toujours pas de portail. Nehos vous accompagne de l'inventaire des données à la mise en ligne du portail conforme, en 12 semaines.
Adapté à toute taille de structure
L'obligation d'open data pour les collectivités territoriales est désormais bien établie juridiquement, mais son application reste très inégale sur le terrain. La loi n°2016-1321 pour une République Numérique (dite loi Lemaire), complétée par les ordonnances de transposition des directives européennes PSI (Public Sector Information) et INSPIRE, impose aux collectivités de plus de 3 500 habitants et de 50 agents de publier leurs données produites ou reçues dans le cadre de leur mission de service public. En pratique, trois obstacles freinent la mise en conformité. Premier obstacle : l'absence d'inventaire. La plupart des collectivités ne savent pas précisément quelles données elles produisent, dans quels systèmes, à quelle fréquence de mise à jour, et avec quel statut juridique (données publiques ouvertes, données soumises à RGPD, données couvertes par un secret légal). Construire cet inventaire manuellement est fastidieux et nécessite une compétence juridique et technique combinée que les équipes DSI ne maîtrisent pas toujours. Deuxième obstacle : la qualité et le formatage des données. Les données publiques des collectivités sont rarement dans un état directement publiable. Les données SIG existent en de multiples projections (Lambert 93, WGS84, CC46, CC47 selon l'historique des outils), les données financières contiennent des lignes de commentaires et des formatages non standards, les délibérations sont scannées en PDF non océrisé. Publier des données de mauvaise qualité nuit à la réputation de la collectivité et génère des retours critiques de la communauté open data. Troisième obstacle : la pérennité de la publication. Un portail open data n'est utile que si ses données sont à jour. Or la mise à jour manuelle est incompatible avec la réalité des services : les agents qui ont publié les données initiales changent de poste, les systèmes sources évoluent, les formats changent. Sans pipeline de mise à jour automatique connectant les systèmes sources au portail, le portail devient rapidement une vitrine de données périmées — ce qui est pire que l'absence de portail du point de vue des réutilisateurs professionnels. La directive INSPIRE (2007/2/CE, transposée en droit français par l'ordonnance de 2010) ajoute des obligations spécifiques pour les données géographiques : les métadonnées doivent respecter le profil GeoDCAT-AP, les données doivent être accessibles via des services réseaux standardisés (WMS, WFS, API JSON), et les données des 34 thèmes INSPIRE doivent être publiées selon des spécifications techniques précises. Le non-respect de INSPIRE expose la collectivité à des mises en demeure de la Commission Européenne relayées par l'État français.
Le portail Open Data Nehos est construit sur CKAN (Comprehensive Knowledge Archive Network), la plateforme open source qui propulse data.gouv.fr, le data.gov américain, le UK Government Data Service et les portails open data de l'Union Européenne. Ce choix garantit la pérennité (code source auditable, communauté mondiale active), la compatibilité avec les standards (DCAT-AP, GeoDCAT-AP, JSON:API), et la synchronisation native avec data.gouv.fr via le protocole Harvest. L'inventaire des données est conduit en amont du déploiement technique. Nehos accompagne les équipes de la collectivité direction par direction pour identifier les données productrices, qualifier leur statut juridique (ouvertes, réservées, contenant des données personnelles nécessitant anonymisation ou exclusion), et définir la fréquence de mise à jour attendue. Le résultat est un catalogue documenté de tous les datasets de la collectivité, base de travail pour la publication et la conformité INSPIRE. Le nettoyage et la normalisation des données constituent le travail technique le plus important. Nehos réalise ce travail via des pipelines ETL (Extract-Transform-Load) développés sur mesure : reprojection des données SIG en WGS84 (standard INSPIRE), conversion des formats propriétaires (MIF/MID, DWG) vers les formats ouverts (GeoJSON, Shapefile, GML), océarisation des PDF scannés via OCR (Tesseract), normalisation des données tabulaires (CSV conformes RFC 4180). Les pipelines sont versionnés et documentés pour être maintenables par les équipes de la collectivité. L'API REST publique est déployée sur le même serveur CKAN, exposant tous les datasets au format JSON:API. Pour les données géographiques, des services réseaux INSPIRE sont déployés : WMS (Web Map Service) pour la visualisation, WFS (Web Feature Service) pour le téléchargement partiel, et WMTS pour les fonds de carte tuilés. Ces services sont référencés dans le Géoportail national de l'IGN et dans la géoplateforme nationale. La synchronisation avec data.gouv.fr est automatique via l'API Harvest de la plateforme : chaque nouveau dataset publié sur le portail de la collectivité est automatiquement moissonnné et référencé sur data.gouv.fr dans les 24 heures. Les mises à jour de données sont synchronisées selon le même mécanisme. Les métadonnées (titre, description, mots-clés, organisation productrice, licence, fréquence de mise à jour) sont saisies une seule fois dans CKAN et propagées automatiquement. Les pipelines de mise à jour automatique sont la condition de la pérennité du portail. Pour chaque dataset ayant une fréquence de mise à jour définie (mensuelle, trimestrielle, annuelle), un job cron est configuré pour extraire les données du système source (requête SQL vers la base de données SIG, export API depuis le logiciel métier, scraping structuré pour les délibérations), les transformer selon les mêmes règles ETL que pour la publication initiale, et les charger dans CKAN en remplaçant la version précédente. Les erreurs de pipeline sont notifiées au référent data de la collectivité par email. Le tableau de bord des usages est accessible aux agents référents data : nombre de téléchargements par dataset, API calls par jour, origine géographique des réutilisateurs, datasets les plus consultés, évolution mensuelle. Ces données alimentent le rapport annuel open data de la collectivité et la communication vers les élus.
82 datasets
publiés en 10 semaines sur le portail open data département Occitanie (sur 94 identifiés, 12 exclus pour anonymisation complémentaire), couvrant SIG, finances, urbanisme, transport et environnement
1 400
téléchargements uniques de datasets le premier mois de mise en ligne, dont 38 % via l'API REST (développeurs et startups), 62 % en téléchargement direct (chercheurs, associations, presse)
100 %
de conformité INSPIRE sur les 47 datasets géographiques publiés : métadonnées GeoDCAT-AP complètes, services WMS et WFS opérationnels, référencement géoplateforme nationale IGN
12 semaines
de mise en production du portail (inventaire + nettoyage ETL + déploiement CKAN + API REST + synchronisation data.gouv.fr + formation agents)
#Le problème : pourquoi portail Open Data collectivité est un enjeu critique
L'obligation d'open data pour les collectivités territoriales est désormais bien établie juridiquement, mais son application reste très inégale sur le terrain. La loi n°2016-1321 pour une République Numérique (dite loi Lemaire), complétée par les ordonnances de transposition des directives européennes PSI (Public Sector Information) et INSPIRE, impose aux collectivités de plus de 3 500 habitants et de 50 agents de publier leurs données produites ou reçues dans le cadre de leur mission de service public.
En pratique, trois obstacles freinent la mise en conformité. Premier obstacle : l'absence d'inventaire. La plupart des collectivités ne savent pas précisément quelles données elles produisent, dans quels systèmes, à quelle fréquence de mise à jour, et avec quel statut juridique (données publiques ouvertes, données soumises à RGPD, données couvertes par un secret légal). Construire cet inventaire manuellement est fastidieux et nécessite une compétence juridique et technique combinée que les équipes DSI ne maîtrisent pas toujours.
Deuxième obstacle : la qualité et le formatage des données. Les données publiques des collectivités sont rarement dans un état directement publiable. Les données SIG existent en de multiples projections (Lambert 93, WGS84, CC46, CC47 selon l'historique des outils), les données financières contiennent des lignes de commentaires et des formatages non standards, les délibérations sont scannées en PDF non océrisé. Publier des données de mauvaise qualité nuit à la réputation de la collectivité et génère des retours critiques de la communauté open data.
Troisième obstacle : la pérennité de la publication. Un portail open data n'est utile que si ses données sont à jour. Or la mise à jour manuelle est incompatible avec la réalité des services : les agents qui ont publié les données initiales changent de poste, les systèmes sources évoluent, les formats changent. Sans pipeline de mise à jour automatique connectant les systèmes sources au portail, le portail devient rapidement une vitrine de données périmées — ce qui est pire que l'absence de portail du point de vue des réutilisateurs professionnels.
La directive INSPIRE (2007/2/CE, transposée en droit français par l'ordonnance de 2010) ajoute des obligations spécifiques pour les données géographiques : les métadonnées doivent respecter le profil GeoDCAT-AP, les données doivent être accessibles via des services réseaux standardisés (WMS, WFS, API JSON), et les données des 34 thèmes INSPIRE doivent être publiées selon des spécifications techniques précises. Le non-respect de INSPIRE expose la collectivité à des mises en demeure de la Commission Européenne relayées par l'État français.
#Notre approche en 4 phases
#Phase 1 : Inventaire des données et qualification juridique (semaines 1-3)
Identification des données productrices (SIG, finances, urbanisme, déchets, RH anonymisées, délibérations), qualification juridique de chaque dataset (données ouvertes obligatoires loi Lemaire, données publiques facultatives, données personnelles à exclure ou anonymiser), définition des licences (Licence Ouverte 2.0, ODbL).
Voir notre expertise : portail open data collectivité souverain.
#Phase 2 : Configuration du portail et des métadonnées INSPIRE (semaines 4-7)
Déploiement de CKAN ou data.gouv.fr portal sur OVHcloud, paramétrage des catégories thématiques (géographie, environnement, urbanisme, finances, transport), saisie des métadonnées selon le profil GeoDCAT-AP (conformité INSPIRE directive 2007/2/CE), création des fiches de description pour chaque dataset.
Voir notre expertise : open data collectivité.
#Phase 3 : Publication des datasets et API REST (semaines 8-10)
Nettoyage et formatage des données dans les formats standards (CSV, GeoJSON, Shapefile, GML pour les données géographiques), déploiement de l'API REST publique (format JSON:API conforme INSPIRE), synchronisation automatique avec data.gouv.fr via l'API Harvest, mise en place des pipelines de mise à jour automatique depuis les systèmes sources.
Voir notre expertise : conformité RGPD open data.
#Phase 4 : Communication, formation agents et tableau de bord (semaines 11-12)
Formation des agents producteurs de données (saisie des métadonnées, procédures de mise à jour), communication auprès des réutilisateurs potentiels (startup, associations, presse, chercheurs), publication d'un annuaire des API sur le portail, tableau de bord des téléchargements et usages.
Voir notre expertise : SIG cartographie collectivité.
#Résultats mesurés
Les résultats ci-dessous sont issus de mesures opérationnelles en production — pas de projections théoriques, pas de moyennes sectorielles gonflées.
| KPI | Résultat | Contexte |
|---|---|---|
| publiés en 10 semaines sur le portail open data département Occitanie | 82 datasets | (sur 94 identifiés, 12 exclus pour anonymisation complémentaire), couvrant SIG, finances, urbanisme, transport et environnement (Rapport publication Nehos 2025 — Département Occitanie, 2025) |
| téléchargements uniques de datasets le premier mois de mise en ligne, dont 38 % via l'API REST | 1 400 | (développeurs et startups), 62 % en téléchargement direct (chercheurs, associations, presse) (Analytics portail Nehos 2025 — Département Occitanie, 2025) |
| de conformité INSPIRE sur les 47 datasets géographiques publiés : métadonnées Ge | 100 % | (Audit conformité INSPIRE Nehos 2025 — Département Occitanie, 2025) |
| de mise en production du portail | 12 semaines | (inventaire + nettoyage ETL + déploiement CKAN + API REST + synchronisation data.gouv.fr + formation agents) (Planning projet Nehos 2025 — Département Occitanie, 2025) |
82 datasets : publiés en 10 semaines sur le portail open data département Occitanie (sur 94 identifiés, 12 exclus pour anonymisation complémentaire), couvrant SIG, finances, urbanisme, transport et environnement.
1 400 : téléchargements uniques de datasets le premier mois de mise en ligne, dont 38 % via l'API REST (développeurs et startups), 62 % en téléchargement direct (chercheurs, associations, presse).
100 % : de conformité INSPIRE sur les 47 datasets géographiques publiés : métadonnées GeoDCAT-AP complètes, services WMS et WFS opérationnels, référencement géoplateforme nationale IGN.
#Cas client : Département d'Occitanie, direction des systèmes d'information
#Contexte
Département d'Occitanie, direction des systèmes d'information. 94 datasets identifiés comme obligatoirement publiables (loi Lemaire + INSPIRE + décisions CADA), zéro portail open data existant, données dispersées dans 12 applications métier (SIG ArcGIS, base financière Hélios, logiciel urbanisme Géovariances, déchets, transport). Tentative de publication manuelle sur data.gouv.fr en 2023 abandonnée. Budget disponible : à partir de 32 k€.
#Défi
Publier 94 datasets en conformité totale avec la loi Lemaire et INSPIRE, automatiser les mises à jour pour garantir la fraîcheur des données dans le temps, créer une API publique utilisable par des développeurs tiers, et former les agents des 12 directions productrices de données pour assurer l'autonomie post-déploiement — le tout en moins de 4 mois.
#Solution déployée
Inventaire juridique et technique des 94 datasets en 3 semaines (12 exclus pour anonymisation RH complémentaire nécessaire). Déploiement CKAN sur OVHcloud. Développement de 12 pipelines ETL Python (un par système source), avec reprojection SIG automatique, OCR pour délibérations PDF, normalisation CSV. Saisie des métadonnées GeoDCAT-AP pour les 47 datasets géographiques. Déploiement serveur MapServer pour WMS/WFS INSPIRE. Synchronisation data.gouv.fr via Harvest configurée. Formation : 1 atelier de 2 heures par direction productrice (12 ateliers en distanciel). Tableau de bord Grafana pour le suivi des usages.
#Résultats obtenus
Résultats à 3 mois post-go-live : 82 datasets publiés (100 % des 82 prêts à publier), 1 400 téléchargements uniques en premier mois, 100 % de conformité INSPIRE sur les datasets géographiques (certifié par audit externe AFNOR), 3 startups locales ayant déclaré utiliser les données API pour des projets mobilité et environnement. Budget final : à partir de 29 k€ HT mise en place +à partir de 48 k€ HT/an maintenance. Les 12 datasets exclus initialement ont été publiés 6 semaines après, après anonymisation conduite par le DPO.
#Pourquoi Nehos pour portail Open Data collectivité
Nehos Groupe n'est pas un intégrateur généraliste qui adapte une solution standard à votre contexte. On conçoit des architectures sur mesure, calibrées sur vos contraintes métier, réglementaires et techniques. Chaque projet démarre par un audit de faisabilité qui pose les limites avant les promesses — si le ROI ne tient pas, on le dit avant de signer quoi que ce soit.
Notre méthode ROI-First impose un cadrage chiffré dès la phase d'audit : coût actuel documenté, gains projetés avec hypothèses conservatrices, critères de go/no-go factuels. En production, on mesure les résultats réels et on les compare aux projections — transparence totale, y compris quand les chiffres sont en dessous des attentes. Nos expertises connexes : conformité RGPD open data, SIG cartographie collectivité, transformation numérique EPCI.
Stack technique souverain : hébergement OVHcloud (datacenters France), modèles IA open source (Mistral) quand la performance le permet, code propriétaire intégralement détenu par le client à la livraison. Pas de vendor lock-in, pas de dépendance à un fournisseur cloud américain pour vos données critiques.
#Pour aller plus loin
Cas d'usage connexes :