Durabilité de l'IA : rapport SCI
Cette page estime la Software Carbon Intensity (SCI) des appels d'IA de ShoppingPartnerLab, selon la méthode de la Green Software Foundation normalisée sous ISO/IEC 21031:2024 : SCI = (E × I + M) par R. Les chiffres sont des estimations et une auto-évaluation ; ils ne sont pas vérifiés par un tiers.
Unité fonctionnelle
R = un appel d'API d'IA. Le score est exprimé en grammes de CO₂eq par appel.
La couverture est incomplète
Il ne s'agit pas de l'empreinte complète de l'AI Factory. L'estimation couvre uniquement les appels enregistrés dans le journal carbone de la couche de routage. Les réponses de Julia et les embeddings ne sont pas inclus. Les appels directs à la Gateway et les exécutions d'agents enregistrées séparément, notamment le travail de Victor, d'Alexandra, des chaînes de contenu et du voice shopping, peuvent en être exclus. Les sources se recoupent et n'ont pas d'identifiant de requête commun ; leurs totaux ne doivent donc pas être additionnés.
Durant la semaine du 20 au 27 septembre 2026, l'AI Gateway a enregistré 8 341 requêtes (8 310 réussies, 30 erreurs client et 1 avec un autre statut), tandis que le journal carbone a enregistré 2 appels et 466 tokens. Le dernier appel du journal de la couche de routage date du 24 septembre.
Données d'utilisation de l'AI Factory
Le journal carbone de la couche de routage contient 11 417 appels et 9 178 511 tokens du 28 décembre 2025 au 24 septembre 2026. Selon la formule actuelle publiée, cet échantillon représente environ 1 611,26 g de CO₂eq : 1 606,64 g pour l'énergie et 4,62 g pour le matériel.
Les réunions d'équipe sont incluses lorsqu'elles figurent dans le journal carbone : 50 appels entre le 28 décembre 2025 et le 27 février 2026, avec 948 378 tokens et environ 87,65 g de CO₂eq selon la formule actuelle. Le journal opérationnel contient en outre 92 réunions d'équipe terminées, mais sans tokens ni modèle ; aucune estimation fiable n'est donc possible pour les 92.
Sur l'ensemble de l'AI Factory, le journal opérationnel contient 16 872 exécutions et 2 311 993 tokens enregistrés ; seules 351 exécutions ont un nombre de tokens supérieur à zéro. Il s'agit d'exécutions opérationnelles, pas de requêtes de modèle, et elles ne sont pas ajoutées aux totaux de la Gateway ou du journal carbone.
Méthode et hypothèses
Les fournisseurs d'IA ne publient pas la consommation d'énergie par requête. Toutes les valeurs sont des estimations par classe de modèle, pas des mesures, et aucune marge d'incertitude n'est encore calculée.
- Énergie par token (E) : 0,03 (lite), 0,10 (flash), 0,30 (standard), 0,80 (pro) et 2,0 (frontier) mWh par token, multipliée par un facteur de centre de données (PUE) de 1,10. Le code les stocke sous la forme 0,000000030 à 0,000002000 kWh par token.
- Intensité du réseau (I) : 280 gCO₂eq/kWh (mix Pays-Bas/Irlande, Ember 2024) pour chaque appel. Les fournisseurs peuvent opérer dans d'autres régions.
- Part du matériel (M) : 150 000 g de CO₂eq divisés par (4 × 365 × 24 × 3 600) = 0,001189 g par seconde GPU (Gupta et al. 2022). Nous supposons un équivalent GPU et 0,05 (lite), 0,15 (flash), 0,40 (standard), 1,00 (pro) ou 2,50 (frontier) seconde GPU par appel non mis en cache. Un appel servi par le cache compte 0,000001 g.
- Aucune compensation carbone achetée n'est déduite.
Émissions évitées estimées
Le rapport indique aussi les émissions évitées estimées grâce au choix du modèle et au cache, par rapport à un scénario hypothétique où chaque appel passe par un grand modèle de classe « pro ». Il s'agit d'une comparaison avec un scénario supposé, pas d'une réduction mesurée, et elle n'est jamais déduite du score SCI.
Tendance
Les grammes de CO₂eq par appel sont présentés par mois depuis décembre 2025, répartis selon les types de tâches réellement enregistrés : chat_response, content_generation, fact_checking, strategic_analysis, seo, translation et other. Ces catégories décrivent l'échantillon mesuré, pas des agents individuels. Les réponses de Julia et les embeddings ne sont pas inclus ; les requêtes directes à la Gateway peuvent échapper au journal.
Les chiffres sont recalculés une fois par heure et se chargent dans la version interactive de cette page.
Voir aussi : Notre méthode de mesure · Transparence de l'IA