DR
DataRepublic
Mode avancé — aperçu, ouverture à venir
🧪

Data Lab — explorez les données publiques en mode avancé

Le Data Lab est l'atelier d'exploration avancée de DataRepublic : champs autorisés, filtres visuels et croisements prédéfinis pour aller plus loin que les fiches, dans un cadre maîtrisé, explicable et traçable jusqu'à la source.

Cette page présente le périmètre et les garde-fous du Mode avancé avant son ouverture. Ce n'est ni une console SQL, ni un explorateur actif : les fonctionnalités décrites ici sont en préparation et signalées comme telles. Les outils déjà disponibles (entreprises, communes, Décider) restent accessibles dès maintenant.

🚧
Le Data Lab n'est pas encore ouvert. Cette page est un aperçu public de ce que sera le Mode avancé et des règles qui l'encadreront. Aucune exploration avancée, aucun export et aucun accès API ne sont actifs à ce jour. En attendant, les croisements guidés comme Décider sont déjà utilisables.

Ce qu'est le Data Lab — et ce qu'il n'est pas

✓ Ce que c'est
  • Un atelier d'exploration guidée des données publiques déjà présentes dans DataRepublic (entreprises, communes, indicateurs territoriaux).
  • Un environnement où les champs explorables, les filtres et les croisements sont prédéfinis et documentés, jamais une saisie libre.
  • Une couche d'analyse avancée pour les utilisateurs qui veulent aller plus loin que les fiches, dans un cadre maîtrisé et traçable.
✗ Ce que ce n'est pas
  • Un accès SQL ou une console de requêtes libres sur la base de données.
  • Un moyen d'extraire des données personnelles, nominatives ou des coordonnées de contact à grande échelle.
  • Un export en masse sans limite : volumes, fréquence et contenu seront encadrés par des quotas et des crédits.

Comment fonctionnera le Mode avancé

🧭
Exploration guidée
Un parcours pas à pas : choisir un domaine (entreprises, communes, croisements), puis affiner avec des filtres visuels. Aucune syntaxe à connaître, aucune requête à écrire — l'outil propose, l'utilisateur sélectionne.
🗂️
Champs autorisés
Seul un sous-ensemble de champs explicitement autorisés et documentés est explorable. Chaque champ indique sa source officielle, sa date et sa méthode. Les champs sensibles ou non publiables sont exclus en amont, pas masqués après coup.
🎚️
Filtres visuels
Des filtres par menus, curseurs et cases à cocher (secteur d'activité NAF, territoire, tranche de population, statut actif / radié…). Les combinaisons restent bornées pour éviter toute reconstruction indirecte d'informations sensibles.
🔗
Croisements prédéfinis
Des croisements préparés et validés (entreprises × territoire, secteur × démographie, tissu économique × dynamique locale) plutôt que des jointures arbitraires. Chaque croisement répond à une question métier et reste explicable.
🎫
Quotas & crédits
L'usage du Mode avancé sera encadré par des quotas (nombre d'explorations, volume de résultats) et un système de crédits selon la formule. Objectif : un accès équitable, des coûts maîtrisés et une protection contre l'aspiration massive.
📤
Exports contrôlés
Les exports (CSV, tableaux) seront plafonnés en volume, horodatés et limités aux champs autorisés. Un export n'est jamais un dump brut de la base : c'est le résultat d'une exploration cadrée, traçable jusqu'à ses sources.
📝
Journalisation
Chaque exploration et chaque export seront journalisés (qui, quoi, quand) pour la traçabilité, la sécurité et le respect des licences Open Data. La journalisation protège les données autant que la plateforme.
🛡️
Masquage des données sensibles
Le secret statistique est appliqué par conception : seuils de k-anonymat, agrégats plutôt que valeurs individuelles, exclusion des champs personnels. Une cellule trop fine pour préserver l'anonymat n'est pas affichée.
🔌
API & MCP (à venir)
À terme, les mêmes explorations cadrées seront accessibles via une API et un serveur MCP pour brancher des assistants IA. Le même cadre s'appliquera : champs autorisés, quotas, journalisation et masquage — pas un accès privilégié.

Toutes ces briques sont en préparation. Elles définissent le cadre du Mode avancé, pas un état livré.

Aperçu des champs explorables

Le Data Lab n'ouvrira qu'un sous-ensemble de champs publics, explicitement autorisés et documentés. Voici un aperçu illustratif et non exhaustif — il ne s'agit pas encore d'un explorateur actif.

Entreprises & établissements
SIRENE
Activité (NAF)Commune / départementDate de créationStatut actif / radiéTranche d'effectif (publique)
Identité publique d'entreprise. Aucune donnée personnelle de dirigeant, aucun contact privé.
Communes & territoires
INSEE / Observatoire
PopulationRevenus médians (agrégés)Dynamique économiqueDensité du tissu d'entreprises
Indicateurs territoriaux agrégés, déjà publiés sur les fiches communes.
Croisements prédéfinis
Indicateurs
Secteur × territoireDensité sectorielle par habitantSous-dotation d'un secteur
Indicateurs calculés et explicables, jamais une jointure libre sur la base.

Chaque champ restera traçable jusqu'à sa source officielle. Voir le détail sur les sources de données.

Feuille de route du Data Lab

  1. 1
    Entrée publique & spécification
    EN COURS
    Cette page et sa documentation : présenter le périmètre, les garde-fous et la doctrine du Mode avancé avant toute ouverture technique. C'est l'étape actuelle.
  2. 2
    Exploration guidée en lecture
    À VENIR
    Premiers parcours d'exploration sur champs autorisés et filtres visuels, en lecture seule, sur le tissu d'entreprises et les indicateurs communes déjà disponibles.
  3. 3
    Croisements & exports contrôlés
    À VENIR
    Croisements prédéfinis, exports plafonnés et journalisés, quotas et crédits par formule. Application systématique du masquage et du secret statistique.
  4. 4
    Accès API & MCP
    À VENIR
    Ouverture des mêmes explorations via API et serveur MCP pour les usages programmatiques et les assistants IA, dans le même cadre de gouvernance.

Garde-fous & gouvernance des données

  • Le Data Lab n'expose jamais de console SQL ni de requêtes libres : seuls des champs autorisés, des filtres bornés et des croisements prédéfinis sont accessibles.
  • Aucune donnée n'est inventée. Chaque champ, chaque indicateur et chaque export reste traçable jusqu'à sa source officielle, avec sa date et sa méthode d'obtention.
  • Le secret statistique (k-anonymat) et le masquage des données sensibles sont appliqués par conception : pas de cellule individuelle identifiante, pas de coordonnée personnelle, pas de donnée de santé ou patrimoniale privée.
  • Les quotas, les crédits et la journalisation protègent contre l'aspiration massive et garantissent un usage conforme aux licences Open Data et à une finalité strictement économique.
  • Le Mode avancé n'est pas encore ouvert : tout le périmètre décrit ici est en préparation. Aucune fonctionnalité avancée n'est active à ce jour.

En attendant l'ouverture

Vous avez un usage avancé en tête (étude, analyse, intégration API) ? Contactez-nous pour suivre l'ouverture du Mode avancé et nous décrire votre besoin.

← Retour à l'accueil