Données
Cette étude mobilise quatre principales sources de données au niveau communal :
- les bases de recensement complémentaires mises à disposition via Saphir (INSEE), couvrant huit vagues de recensement (1968, 1975, 1982, 1990, 1999, 2006,2011 et 2016). Cela permet de mesurer la part de l’emploi industriel parmi les résidents ainsi que les caractéristiques socio-économiques locales, notamment la composition des ménages, l’âge et le niveau d’éducation.
- Des variables économiques supplémentaires issues de Piketty et Cagé (2023) afin d’évaluer l’impact économique de la désindustrialisation au-delà de l’emploi : revenu par habitant, PIB local et prix de l’immobilier. Les variables politiques proviennent également de Piketty et Cagé (2023).
- Les résultats communaux des élections présidentielles et législatives de 1967 à 2017.
- La Base Permanente des Équipement (BPE) de 2018 pour mesurer le nombre d’équipements de proximité disponibles dans chaque commune.
- Le Répertoire National des Associations (RNA) pour calculons le nombre d’associations créées dans chaque commune entre 2018 et 2024
Échantillon d’analyse
Pour chaque recensement complémentaire, un échantillon aléatoire de 20 % à 25 % des individus est interrogé dans chaque commune. Afin d’assurer la fiabilité statistique et la représentativité des données, les auteurs excluent les communes de moins de 500 habitants. Ils excluent également les communes ayant connu des modifications de périmètre au cours de la période étudiée.L’échantillon final est un panel de 10 258 communes que nous suivons sur les huit vagues de recensement, de 1968 à 2016.
Méthodologie
Les auteurs utilisent deux stratégies empiriques complémentaires
(1) Régressions en premières différences (panel). Cette stratégie exploite les variations de la part des résidents employés dans l’industrie entre chacune des huit vagues de recensement et les relie aux évolutions de nos indicateurs économiques, sociaux et démographiques sur la même période. Elle contrôle pour des effets fixes communaux et des effets fixes propres à chaque période de recensement, exploitant ainsi les variations intra-communales au fil du temps. Le coefficient estimé mesure l’association moyenne, au sein d’une commune, entre les variations de l’emploi industriel et les évolutions contemporaines des indicateurs économiques ou sociaux, tout en tenant compte des caractéristiques communales constantes dans le temps et des évolutions nationales touchant toutes les communes simultanément.
(2) Régressions en longue différence. Cette stratégie met en relation les variations globales des indicateurs entre 1968 et 2016 avec la variation correspondante de long terme de l’emploi industriel. Les effets fixes communaux absorberaient toute la variation dans cette spécification ; les auteurs incluent donc des effets fixes départementaux afin de tenir compte des différentes trajectoires régionales. Cette approche poursuit deux objectifs. Premièrement, en se concentrant sur les effets cumulés de long terme plutôt que sur les ajustements de court terme, elle capture l’ampleur complète de la transformation structurelle observée sur cinq décennies. Deuxièmement, en condensant le panel en une seule période, elle limite les biais potentiels liés à des effets de traitement hétérogènes dans les modèles à effets fixes.
Toutes les régressions sont pondérées par la population.