Data Lab — explorez les données publiques en mode avancé
Le Data Lab est l'atelier d'exploration avancée de DataRepublic : champs autorisés, filtres visuels et croisements prédéfinis pour aller plus loin que les fiches, dans un cadre maîtrisé, explicable et traçable jusqu'à la source.
Cette page présente le périmètre et les garde-fous du Mode avancé avant son ouverture. Ce n'est ni une console SQL, ni un explorateur actif : les fonctionnalités décrites ici sont en préparation et signalées comme telles. Les outils déjà disponibles (entreprises, communes, Décider) restent accessibles dès maintenant.
Ce qu'est le Data Lab — et ce qu'il n'est pas
- •Un atelier d'exploration guidée des données publiques déjà présentes dans DataRepublic (entreprises, communes, indicateurs territoriaux).
- •Un environnement où les champs explorables, les filtres et les croisements sont prédéfinis et documentés, jamais une saisie libre.
- •Une couche d'analyse avancée pour les utilisateurs qui veulent aller plus loin que les fiches, dans un cadre maîtrisé et traçable.
- •Un accès SQL ou une console de requêtes libres sur la base de données.
- •Un moyen d'extraire des données personnelles, nominatives ou des coordonnées de contact à grande échelle.
- •Un export en masse sans limite : volumes, fréquence et contenu seront encadrés par des quotas et des crédits.
Comment fonctionnera le Mode avancé
Toutes ces briques sont en préparation. Elles définissent le cadre du Mode avancé, pas un état livré.
Aperçu des champs explorables
Le Data Lab n'ouvrira qu'un sous-ensemble de champs publics, explicitement autorisés et documentés. Voici un aperçu illustratif et non exhaustif — il ne s'agit pas encore d'un explorateur actif.
Chaque champ restera traçable jusqu'à sa source officielle. Voir le détail sur les sources de données.
Feuille de route du Data Lab
- 1Entrée publique & spécificationEN COURSCette page et sa documentation : présenter le périmètre, les garde-fous et la doctrine du Mode avancé avant toute ouverture technique. C'est l'étape actuelle.
- 2Exploration guidée en lectureÀ VENIRPremiers parcours d'exploration sur champs autorisés et filtres visuels, en lecture seule, sur le tissu d'entreprises et les indicateurs communes déjà disponibles.
- 3Croisements & exports contrôlésÀ VENIRCroisements prédéfinis, exports plafonnés et journalisés, quotas et crédits par formule. Application systématique du masquage et du secret statistique.
- 4Accès API & MCPÀ VENIROuverture des mêmes explorations via API et serveur MCP pour les usages programmatiques et les assistants IA, dans le même cadre de gouvernance.
Garde-fous & gouvernance des données
- •Le Data Lab n'expose jamais de console SQL ni de requêtes libres : seuls des champs autorisés, des filtres bornés et des croisements prédéfinis sont accessibles.
- •Aucune donnée n'est inventée. Chaque champ, chaque indicateur et chaque export reste traçable jusqu'à sa source officielle, avec sa date et sa méthode d'obtention.
- •Le secret statistique (k-anonymat) et le masquage des données sensibles sont appliqués par conception : pas de cellule individuelle identifiante, pas de coordonnée personnelle, pas de donnée de santé ou patrimoniale privée.
- •Les quotas, les crédits et la journalisation protègent contre l'aspiration massive et garantissent un usage conforme aux licences Open Data et à une finalité strictement économique.
- •Le Mode avancé n'est pas encore ouvert : tout le périmètre décrit ici est en préparation. Aucune fonctionnalité avancée n'est active à ce jour.
En attendant l'ouverture
Vous avez un usage avancé en tête (étude, analyse, intégration API) ? Contactez-nous pour suivre l'ouverture du Mode avancé et nous décrire votre besoin.