Une estimation nationale crédible ne peut naître d'une surface moyenne multipliée par le nombre de biens immobiliers. Le modèle Heiwit utilise un cadre géolocalisé, un échantillon stratifié et des estimations solaires relatives aux éléments individuels. C'est précisément pour cette raison que les étapes qui ne sont pas encore réplicables doivent être déclarées.
Le chapitre en 8 diapositive
Parcourez le carrousel d'origine réalisé pour ce chapitre. Les images ont été optimisées pour le web et téléchargées dans la médiathèque de WordPress.
Sur smartphone, faites glisser vers la gauche ou la droite. Sur le clavier, utilisez les flèches droite et gauche.
1. Le cadre OpenStreetMap
L'univers de départ a été extrait d'OpenStreetMap via l'API Overpass en utilisant des tags fonctionnels liés aux écoles, aux hôpitaux, aux mairies et à d'autres services publics. L'attribution correcte est : © contributeurs d'OpenStreetMap, données disponibles selon ODbL 1.0, extraction déclarée en avril 2026.
Le terme « frame » est important. Un élément OSM ne démontre pas la propriété publique et peut représenter un point, un bâtiment, un périmètre ou une relation. Les écoles privées, les cliniques et les structures conventionnées peuvent entrer dans le cadre des balises fonctionnelles. La requête Overpass, les règles de déduplication et le mapping POI-bâtiment devront donc être publiés.
2. L'échantillon stratifié
Afin de limiter les coûts liés aux interrogations, l'étude déclare un échantillon de 10 000 éléments, soit 24,21 TP3T de la population. L'échantillon est divisé en 20 strates obtenues en croisant cinq macro-zones et quatre typologies fonctionnelles. Le total national est estimé à l'aide de l'estimateur stratifié classique, en multipliant la moyenne de chaque strate par la taille de cette strate dans la population.
Cependant, les matériaux font état de 9 318 enregistrements avec des données valides. Les 682 manquants doivent être classés : échecs d'API, doublons, éléments non associables à un toit ou autres exclusions. Sans cette classification, un biais de non-réponse ne peut être exclu.
3. Google Solar API et PVGIS
Pour les éléments échantillonnés, l'utilisation de l'endpoint Building Insights de l'API Google Solar a été déclarée. L'attribution à conserver à proximité des résultats est la suivante : « Source : inclut des données solaires de Google. Traitements agrégés par Heiwit S.p.A. ; Google n'est ni l'auteur ni le validateur de l'étude ».
La procédure définitive devra documenter la qualité requise et restituée, la date des images, la capacité des panneaux utilisée par le service, la distance entre la coordonnée demandée et le bâtiment identifié ainsi que les contrôles sur les campus multi-bâtiments.
Pour les éléments traités avec PVGIS, les hypothèses concernant la surface, le coefficient d'utilisation du toit, l'orientation et les pertes doivent être publiées. Attribution : PVGIS © Union européenne / Commission européenne, Centre commun de recherche (JRC), version 5.2 ; traitements Heiwit S.p.A. Les résultats ne reflètent pas nécessairement la position de la Commission européenne.
4. Bootstrap et intervalles de confiance
L'étude indique un bootstrap non paramétrique de 1 000 itérations. Même si le calcul était correct, l'intervalle représenterait l'incertitude d'échantillonnage conditionnée au cadre et au modèle. Il ne comprend pas les erreurs de classification OSM, l'association au toit, la couverture des images, le repli, les données manquantes ou les hypothèses économiques.
5. Comparaison avec GSE Atlaimpianti
Une correspondance a été déclarée dans un rayon de 80 mètres avec Atlaimpianti. La comparaison peut être utile, mais une distance inférieure à 80 mètres ne prouve pas que l'installation appartient au bâtiment. Il faut analyser la distribution des distances, effectuer des contrôles manuels, identifier les faux positifs et les valeurs aberrantes. De plus, Atlaimpianti est un vaste ensemble d'installations gérées ou subventionnées par le GSE, et non le recensement complet du photovoltaïque italien.
Que manque-t-il pour une réplique complète
- requête Overpass et règles de déduplication;
- jeu de données de 10 000 enregistrements et liste des 9 318 valides ;
- journaux Google/PVGIS et motifs d'exclusion ;
- code de l'échantillonnage, de l'expansion et du bootstrap;
- suppression du fichier de correspondance Atlaimpianti et des contrôles manuels;
- jeu de données régional et modèle économique.








