Quoi de neuf dans le Cloud FinOps : juillet 2026

Les trois actualités Cloud FinOps à retenir en juillet 2026, puis l’ensemble des annonces discutées par Steve et Frank.

Connections

Why is this article in French? Most articles on frankcontrepois.com are written in English. This monthly series is intentionally published in French to make cloud and FinOps news, together with our commentary, more accessible to French-speaking practitioners. It is adapted from the English episode of What’s New in Cloud FinOps, hosted by Steve Old and me.

En bref

Juillet parle surtout de flexibilité, ou de sa disparition. Voici les trois actualités que nous avons retenues :

  1. Azure limite les échanges de réservations : un changement qui devrait toucher beaucoup d’organisations à partir de février 2027.
  2. Qoder réduit le coût en crédits de deux modèles Qwen pendant les heures creuses : une nouvelle manière de déplacer la consommation IA dans le temps.
  3. S3 autorise les transitions vers Standard-IA et One Zone-IA dès le jour zéro : une économie concrète pour les données qui deviennent froides immédiatement.

Nous avons confirmé cet ordre après l’enregistrement. Azure arrive en premier pour l’étendue de son impact, Alibaba ensuite pour l’originalité de la tarification selon l’heure, puis S3 pour son effet concret et immédiat.

Les 3 actualités à retenir

1. Azure va réduire la flexibilité des réservations

Ce qui est annoncé. Microsoft indique qu’à partir du 1er février 2027, les réservations achetées après cette date ne pourront plus être échangées si le service correspondant est couvert par Azure Savings Plans. Les réservations achetées avant la date conservent un dernier échange. Certains services non couverts par Savings Plans restent exclus de la restriction. Documentation Microsoft

Pourquoi c’est important. La possibilité de changer de région, de série ou de durée rendait l’engagement Azure plus tolérant à l’erreur. La réservation reste adaptée à une charge stable, mais son risque augmente quand l’architecture ou le volume peuvent changer.

Notre commentaire. C’est le sujet qui touchera probablement le plus d’organisations. Steve recommande depuis longtemps de mélanger les durées et les instruments plutôt que de concentrer toute la stratégie sur un seul mécanisme. Cette annonce renforce ce besoin.

À faire. Inventorier les réservations, leurs dates et la stabilité des workloads. Préparer les derniers échanges bien avant février 2027 et comparer réservations et Savings Plans sur la flexibilité réellement nécessaire.

2. Qoder propose des heures creuses pour deux modèles Qwen

Ce qui est annoncé. Alibaba indique que, dans les produits Qoder éligibles, Qwen3.7-Max bénéficie d’une remise sur les crédits allant jusqu’à 80 % et Qwen3.7-Plus de 60 % entre 22 h et 8 h, heure de Pékin. L’application est automatique pour les formules Pro Trial, Pro et Teams. L’offre est entrée en vigueur le 23 juin 2026, sans date de fin annoncée. Ce n’est pas une baisse générale du tarif de tous les appels Qwen ou Model Studio. Documentation Alibaba Cloud

Pourquoi c’est important. Pour ces usages Qoder, le coût en crédits ne dépend plus seulement du modèle choisi. Il dépend aussi du moment où le traitement s’exécute.

Notre commentaire. Je compare naturellement cela aux heures creuses de l’électricité : lancer la machine à laver la nuit coûte moins cher. Pour Steve, c’est le sujet le plus intéressant du mois. Il montre aussi que les fournisseurs cherchent à déplacer la demande vers leurs périodes de capacité libre.

À faire. Séparer les tâches IA urgentes des évaluations, générations et traitements batch qui peuvent attendre. Mesurer ensuite l’économie nette, fuseau horaire et orchestration compris.

3. S3 autorise des transitions Infrequent Access dès le jour zéro

Ce qui est annoncé. AWS indique qu’une règle Lifecycle peut maintenant transférer un objet vers S3 Standard-IA ou S3 One Zone-IA dès sa création, sans attendre les 30 jours auparavant imposés dans S3 Standard. Annonce AWS

Pourquoi c’est important. Certains logs, résultats de tests et sauvegardes deviennent froids presque immédiatement. Les garder 30 jours dans Standard ajoutait un coût sans apporter de valeur.

Notre commentaire. Je l’ai choisi parce que l’effet est concret, et Steve a immédiatement approuvé. Il faut quand même regarder les frais de lecture, la durée minimale propre aux classes IA et la moindre redondance de One Zone.

À faire. Identifier les objets dont le profil d’accès est connu dès la création, puis tester une règle jour zéro sur un préfixe limité.

Toutes les actualités du mois

Calcul et conteneurs

EKS Provisioned Control Plane accélère le HPA

Ce qui est annoncé. AWS augmente jusqu’à 40 fois la concurrence de synchronisation du Horizontal Pod Autoscaler par rapport à Kubernetes par défaut. Le changement est automatique. Annonce AWS

Pourquoi c’est important. Cela concerne surtout les très grands clusters avec beaucoup d’objets HPA. Une capacité qui monte plus vite peut absorber un pic plus rapidement, mais aussi accélérer la hausse du coût.

Notre commentaire. Notre réaction est moins « économie » que « attention ». Une amélioration de vitesse n’est pas automatiquement une amélioration d’efficacité.

À faire. Revoir les limites de scaling, les alertes de coût et la vitesse à laquelle un workload peut consommer sa capacité maximale.

EKS et ECS réduisent leurs frais de gestion GPU

Ce qui est annoncé. À compter du 1er juillet, les frais de gestion EKS Auto Mode et ECS Managed Instances baissent de 35 % pour la série G, et de 60 % pour la série P et AWS Trainium. Le changement est automatique. EKS et ECS

Pourquoi c’est important. Le mode managé devient plus compétitif pour les charges GPU et Trainium, surtout quand le coût opérationnel d’une gestion maison est déjà élevé.

Notre commentaire. La nuance compte : c’est la prime du service managé qui baisse, pas le prix de l’instance accélérée elle-même.

À faire. Recalculer le coût complet du mode managé face à l’exploitation actuelle, en séparant clairement calcul, GPU et frais de gestion.

Lambda Managed Instances publie les événements de capacité

Ce qui est annoncé. Les capacity providers Lambda Managed Instances envoient maintenant dans CloudWatch Logs des événements JSON sur le lancement, l’arrêt, la santé et les erreurs de provisionnement. C’est activé par défaut et les frais CloudWatch habituels s’appliquent. Annonce AWS

Pourquoi c’est important. Cette visibilité aide à comprendre le calcul EC2 qui se cache derrière l’expérience serverless et à expliquer les échecs de capacité.

Notre commentaire. Davantage de logs aide au diagnostic, mais crée aussi un nouveau petit poste de coût d’observabilité.

À faire. Contrôler le volume généré et définir une rétention adaptée au lieu de conserver ces événements indéfiniment.

Instance Refresh rejoint CloudFormation

Ce qui est annoncé. CloudFormation peut déclencher un Instance Refresh lors d’un changement nécessitant le remplacement d’instances. Le mécanisme conserve scaling, contrôles de santé, checkpoints et rollback. Annonce AWS

Pourquoi c’est important. Les migrations de taille, d’AMI ou de génération deviennent plus faciles à industrialiser. Ce sont souvent ces changements qui matérialisent une recommandation FinOps.

Notre commentaire. C’est d’abord une amélioration opérationnelle, mais elle réduit le risque qui bloque souvent une économie pourtant identifiée.

À faire. Tester Instance Refresh sur un groupe non critique, avec checkpoints et rollback, avant de l’utiliser pour une migration d’optimisation.

IA et nouveaux modèles économiques

FC Agent Sandbox sépare ses états de facturation

Ce qui est annoncé. Alibaba déploie pour FC Agent Sandbox un modèle avec trois éditions : Eco, Std et Pro. La documentation plus récente décrit aussi des états actif, hibernation légère, hibernation profonde et détruit, avec des ressources facturées différemment. Annonce Alibaba

Pourquoi c’est important. Un agent peut coûter pendant son exécution, son attente ou la conservation de son état. Ces phases ne sont pas toujours visibles dans un simple coût par requête.

Notre commentaire. Steve résume bien le risque : le sandbox d’agent peut devenir le nouveau serveur de développement oublié.

À faire. Cartographier les états facturés, définir une politique d’hibernation et alerter sur les sandboxes qui restent actifs sans usage.

Gemini entre dans les applications Oracle

Ce qui est annoncé. Oracle et Google étendent leur partenariat. Gemini est déjà accessible via OCI Enterprise AI et doit rejoindre AI Agent Studio for Fusion Applications, Fusion et NetSuite. Oracle met notamment en avant les variantes Flash pour leur rapport prix/performance. Annonce Oracle

Pourquoi c’est important. Le coût IA se glisse dans les applications d’entreprise. Une organisation peut donc payer l’usage d’un modèle dans un contrat SaaS sans acheter directement son API.

Notre commentaire. Pour nous, c’est une nouvelle difficulté d’allocation : le modèle est visible techniquement, mais pas forcément séparé sur la facture métier.

À faire. Demander comment l’usage Gemini sera mesuré, inclus ou refacturé dans OCI, Fusion et NetSuite avant son activation à grande échelle.

OpenAI baisse fortement le prix de Luna

Ce qui est annoncé. OpenAI réduit le prix de GPT-5.6 Luna de 80 % et celui de Terra de 20 %. Sol ne change pas. AWS répercute les mêmes baisses dans Bedrock. OpenAI et AWS

Pourquoi c’est important. L’écart entre modèles change les arbitrages de routage et peut réduire fortement le coût des tâches qui n’ont pas besoin du modèle le plus puissant.

Notre commentaire. La bonne optimisation ne consiste pas à choisir le moins cher partout, mais à mesurer le coût par tâche correctement terminée.

À faire. Rejouer un échantillon représentatif sur Luna, Terra et Sol, puis comparer qualité, reprises nécessaires, latence et coût final.

Alibaba propose une architecture de routage multi-modèles

Ce qui est publié. Un guide Alibaba combine AI Gateway et Model Studio pour envoyer les tâches complexes vers un modèle premium et les tâches ordinaires vers une option moins chère, avec fallback et monitoring. Ressource Alibaba

Pourquoi c’est important. Le routage par complexité peut réduire le coût moyen sans imposer un seul modèle à tous les usages.

Notre commentaire. Steve pense qu’il faut déjà raisonner ainsi, même sur un autre cloud. J’ajoute une réserve de sécurité : le routeur centralise prompts, cache et décisions. C’est un point de contrôle, mais aussi un point d’attaque.

À faire. Définir des règles de routage mesurables et auditer les données que le routeur journalise ou met en cache.

AWS rappelle comment analyser les coûts Bedrock

Ce qui est publié. Ce billet du 29 juin, repris dans l’épisode de juillet, relie attribution, télémétrie opérationnelle et observabilité applicative. Guide AWS

Pourquoi c’est important. Il propose une méthode pour passer du simple nombre de tokens à un coût par application ou usage métier.

Notre commentaire. Ce n’est pas un lancement produit. On le garde parce que le cadre est plus utile que beaucoup de tableaux de prix isolés.

À faire. Vérifier si les tags, métadonnées de modèle et métriques applicatives permettent déjà de relier une dépense Bedrock à un produit et à un résultat.

Données, bases et logs

CloudWatch Logs automatise ses niveaux de stockage

Ce qui est annoncé. Intelligent-Tiering place les logs non consultés depuis 30 jours en Infrequent Access, puis après 90 jours en Archive Instant Access. Une consultation les remet en Standard pour 30 jours. La fonction s’active au niveau du compte et de la région. Annonce AWS

Pourquoi c’est important. La rétention des logs coûte facilement cher, alors que beaucoup de données ne servent plus après quelques jours. L’automatisation évite de construire un pipeline d’archivage séparé.

Notre commentaire. Steve en ferait presque une règle par défaut. Notre réserve concerne les outils qui relisent régulièrement les données : un scanner trop curieux peut maintenir les logs dans le niveau le plus cher.

À faire. Mesurer les accès réels, repérer les lectures automatiques et tester la politique dans une région avant de l’activer largement.

Datastream offre 100 Gio de CDC par mois

Ce qui est annoncé. Google propose un niveau gratuit permanent pour les 100 premiers Gio de capture de changements, par compte de facturation et par mois, sur des flux éligibles AlloyDB ou Spanner vers BigQuery. BigQuery et les autres ressources restent facturés séparément. Tarification Datastream

Pourquoi c’est important. Le niveau gratuit facilite les prototypes et les petits pipelines de capture de changements sans supprimer le coût de la chaîne complète.

Notre commentaire. Cette annonce date en réalité de juin. On la garde parce qu’elle a été discutée dans l’épisode de juillet, mais on ne la présente pas comme une nouveauté de juillet.

À faire. Vérifier que la source, la destination et le compte de facturation sont éligibles, puis inclure BigQuery et le réseau dans le calcul total.

Redshift Serverless ajoute le paiement trois ans All Upfront

Ce qui est annoncé. AWS propose désormais de payer au départ l’intégralité d’une réservation Redshift Serverless de trois ans, avec jusqu’à 50 % de réduction face à l’on-demand. Annonce AWS

Pourquoi c’est important. L’option augmente la remise affichée, mais immobilise davantage de trésorerie et concentre le risque sur trois ans.

Notre commentaire. Steve et moi trouvons serré le gain supplémentaire face à l’option sans avance. « Remise maximale » ne signifie pas forcément « meilleur choix financier ».

À faire. Comparer les options avec le coût du capital, le risque d’usage et la valeur de la flexibilité, pas seulement avec le pourcentage face à l’on-demand.

BigQuery route une réservation selon l’identité

Ce qui est annoncé. En preview, une affectation de réservation BigQuery peut inclure une identité principale. Les requêtes sont alors orientées selon l’utilisateur, le compte de service ou l’identité externe qui exécute le job. Documentation Google

Pourquoi c’est important. Le contrôle devient plus fin qu’un simple projet. Il peut isoler les charges, protéger une capacité partagée et améliorer les unités économiques par équipe ou produit.

Notre commentaire. On aime la précision supplémentaire, mais le statut preview impose encore de la prudence pour un mécanisme de gouvernance critique.

À faire. Tester une affectation sur quelques identités, vérifier les priorités en cas de règles concurrentes et documenter le comportement de repli.

RDS for Oracle ouvre les RI aux M8i et R8i

Ce qui est annoncé. AWS ajoute des Reserved Instances un et trois ans pour RDS for Oracle sur M8i et R8i, avec jusqu’à 53 % d’économie face à l’on-demand. Les bénéfices s’appliquent aux configurations Single- et Multi-AZ ; le modèle BYOL bénéficie aussi de la flexibilité de taille. Annonce AWS

Pourquoi c’est important. L’engagement peut réduire le coût d’infrastructure, mais l’économie globale dépend fortement du modèle de licence Oracle.

Notre commentaire. Notre discussion montre surtout combien il reste difficile d’isoler coût machine et coût licence. Un beau pourcentage AWS ne raconte qu’une partie de l’histoire.

À faire. Modéliser séparément infrastructure, édition Oracle, Single- ou Multi-AZ et mode License Included ou BYOL avant tout engagement.

OpenSearch reçoit un moteur optimisé pour les logs

Ce qui est annoncé. Sur OpenSearch 3.5 ou plus, un nouveau mode combine stockage colonnaire et recherche plein texte. AWS annonce jusqu’à quatre fois le prix/performance, 70 % de stockage en moins, deux fois plus de débit d’ingestion et des requêtes analytiques deux fois plus rapides sur ses benchmarks internes. Le lancement couvre 12 régions. Annonce AWS

Pourquoi c’est important. Le stockage et l’analyse des logs représentent souvent une dépense majeure. Un moteur plus dense peut changer l’architecture et la durée de rétention économiquement acceptable.

Notre commentaire. Les chiffres sont attirants, mais ils viennent d’AWS. Ils ne deviennent pas automatiquement vrais pour la combinaison de recherche et d’agrégation d’un environnement réel.

À faire. Créer un nouveau domaine, rejouer des requêtes représentatives et comparer coût, ingestion, latence et rétention avant migration.

Des Capacity Blocks GPU environ 20 % plus chers, selon la presse

Ce qui est rapporté. Business Insider fait état d’une hausse d’environ 20 % des EC2 Capacity Blocks for ML à partir de juillet, après une hausse en janvier. AWS n’a pas publié d’annonce autonome retrouvée pendant notre vérification. Source secondaire

Pourquoi c’est important. La capacité GPU réservée ressemble de plus en plus à un approvisionnement rare qu’à une ressource élastique banale. Le prix peut donc changer rapidement.

Notre commentaire. On garde la prudence amusée de l’épisode : cette information est à prendre avec une pincée de sel tant qu’elle n’est pas confirmée directement par AWS.

À faire. Capturer et dater le prix proposé au moment de chaque décision, puis conserver cette preuve dans le dossier d’achat.

Amazon SES groupe ses options en trois plans

Ce qui est annoncé. Essentials, Pro et Enterprise regroupent des fonctions de délivrabilité, IP dédiées, validation et résilience, avec une remise annoncée face à l’achat à la carte. Annonce AWS

Pourquoi c’est important. Pour une plateforme marketing ou un gros expéditeur, un plan peut simplifier le coût et réduire le prix de plusieurs options utilisées ensemble.

Notre commentaire. Pour nos petits usages, le sujet reste modeste. Un bundle moins cher à la liste peut quand même coûter plus si la moitié des fonctions reste inutilisée.

À faire. Reconstituer le panier réellement consommé et le comparer au prix du plan, fonction par fonction.

Oracle fait réapparaître le quantique dans notre liste

Ce qui est publié. Oracle présente une simulation de tarification d’option de 28 à 32 qubits avec Classiq, CUDA-Q et un GPU A100 80 Go sur OCI. Oracle précise qu’il s’agit d’une démonstration technique, pas d’une preuve d’avantage quantique en production. Billet Oracle

Pourquoi c’est important. Pour FinOps, c’est surtout un cas très spécialisé de comparaison CPU/GPU et de coût d’expérimentation.

Notre commentaire. J’ai surtout aimé voir le quantique refaire surface après avoir été éclipsé par l’IA. Cela ne crée pas encore un nouveau poste de facture courant.

À faire. Garder les coûts de simulation séparés des promesses quantiques et ne généraliser aucun résultat sans benchmark reproductible.

Visibilité, facturation et gouvernance

Le score Cost Efficiency arrive dans les dashboards AWS

Ce qui est annoncé. Un nouveau widget affiche l’évolution du score Cost Efficiency par compte, région ou environnement global. Il peut être exporté, partagé et renvoie vers Cost Optimization Hub. AWS ne facture pas le widget. Annonce AWS

Pourquoi c’est important. La tendance devient visible dans le workflow quotidien, sans devoir retourner au rapport ponctuel présenté le mois précédent.

Notre commentaire. Toujours la même réserve : un score doit ouvrir une question, pas devenir une note scolaire ou une mesure de la valeur créée.

À faire. Suivre la tendance et choisir une dimension à examiner quand elle baisse, plutôt que de fixer un objectif abstrait de points.

Data Exports normalise les métadonnées Bedrock

Ce qui est annoncé. CUR 2.0 expose désormais de façon structurée le fournisseur, le modèle, l’unité de prix, le type d’inférence et le mode de service Bedrock. Les champs sont disponibles par défaut sans surcoût. Annonce AWS

Pourquoi c’est important. Il faut moins de logique maison pour distinguer modèles, tokens d’entrée et de sortie, batch et on-demand.

Notre commentaire. C’est une amélioration très FinOps, mais la nouvelle colonne n’associe pas magiquement une dépense à un produit ou à une équipe.

À faire. Mettre à jour les transformations CUR et compléter les métadonnées AWS avec le contexte métier nécessaire à l’allocation.

AWS adapte enfin l’application des avoirs

Ce qui est annoncé. Les clients payant par transfert électronique peuvent choisir comment appliquer automatiquement un avoir : facture d’origine, prochaine facture éligible ou plus ancienne facture impayée. Annonce AWS

Pourquoi c’est important. L’application des avoirs peut enfin mieux correspondre aux règles de trésorerie et de rapprochement comptable de l’entreprise.

Notre commentaire. J’aime le renversement : ce n’est plus l’équipe finance qui doit contourner la logique du fournisseur, c’est le fournisseur qui accepte plusieurs processus clients.

À faire. Faire choisir l’option par la finance, la documenter et vérifier son effet sur le prochain cycle de facturation.

CloudWatch crée des alarmes directement depuis une requête de logs

Ce qui est annoncé. Une requête Logs Insights peut maintenant alimenter directement un seuil et les actions d’alarme habituelles, sans créer d’abord une métrique intermédiaire. Annonce AWS

Pourquoi c’est important. Un signal d’usage ou d’anomalie contenu dans les logs peut déclencher une alerte sans pipeline de métriques supplémentaire.

Notre commentaire. C’est pratique pour le FinOps, mais une requête planifiée n’est pas gratuite et une portée trop large peut devenir son propre problème de coût.

À faire. Limiter la période et les groupes de logs interrogés, puis suivre le coût d’exécution de l’alarme elle-même.

AWS Systems Manager gère maintenant les VM Azure

Ce qui est annoncé. Un Cloud Connector déploie l’agent Systems Manager et fait apparaître les VM Azure avec les nœuds AWS. AWS supprime l’ancien tarif Advanced Instances ; à partir du 30 septembre 2026, certaines sessions et commandes sur les nœuds non-EC2 seront facturées à l’usage. Annonce AWS

Pourquoi c’est important. Un workflow multi-cloud commun peut réduire l’outillage et le travail opérationnel, mais introduit de nouvelles unités de facturation.

Notre commentaire. Le nom « simplification » ne suffit pas pour conclure à une économie. Tout dépend de l’outil remplacé et de la fréquence des actions.

À faire. Estimer sessions, commandes et nœuds concernés, puis comparer le coût complet au processus Azure ou tiers existant.

Acheter une offre SaaS dans Azure devient plus simple, peut-être trop

Ce qui est annoncé. Microsoft documente une page unique pour choisir plan, facturation, groupe de ressources, contacts et conditions. La documentation actuelle parle d’un déploiement progressif en août 2026, plutôt que d’une disponibilité générale en juillet comme dit dans l’épisode. Documentation Microsoft

Pourquoi c’est important. Une expérience d’achat plus simple réduit les frictions, mais facilite aussi les achats logiciels hors des processus habituels.

Notre commentaire. Steve voit immédiatement le risque de shadow purchasing en dehors du SAM, de l’ITAM et du procurement. Un clic de moins pour acheter devient parfois plusieurs semaines de plus pour gouverner.

À faire. Revoir les permissions Marketplace, les politiques de groupe de ressources et le circuit d’approbation avant le déploiement de l’expérience.

Pratiques FinOps et valeur

Une organisation SaaS réduit sa facture AWS de 39 % en douze semaines

Ce qui est publié. Le cas AWS décrit sept optimisations séquencées, dont le passage de plus de 150 Network Load Balancers à cinq Application Load Balancers, tout en préparant une croissance dix fois supérieure. Étude de cas AWS

Pourquoi c’est important. Le cas montre comment ordonner les changements pour que les premiers gains financent et sécurisent les suivants.

Notre commentaire. Le chiffre de 39 % appartient à cette organisation. Ce qui se réutilise, c’est la méthode, pas la promesse d’obtenir le même résultat partout.

À faire. Noter chaque optimisation selon l’effort et l’impact, commencer par les gains rapides et ajouter un contrôle pour empêcher le gaspillage de revenir.

AWS compare cinq outils IA pour le FinOps

Ce qui est publié. Un guide de Steph Gooch et Jenny Shen compare AWS FinOps Agent, Amazon Quick, Kiro, Amazon Q dans la console et AWS DevOps Agent. Guide AWS

Pourquoi c’est important. Tous les outils IA ne répondent pas au même besoin, et le niveau d’autonomie acceptable dépend de la tâche FinOps.

Notre commentaire. Je le vois comme le complément de ma propre matrice : elle part de la tâche et du niveau de confiance acceptable ; ce guide aide ensuite à choisir l’outil AWS. Il faut simplement garder à l’esprit que le comparatif vient du fournisseur de ces outils.

À faire. Choisir d’abord le cas d’usage et le niveau de contrôle humain, puis comparer les outils sur une question dont la réponse est déjà connue.

Microsoft met un chiffre sur la valeur d’Azure Databricks

Ce qui est publié. Une étude Forrester commandée par Microsoft modélise une organisation composite de 6 milliards de dollars et 10 pétaoctets. Elle calcule sur trois ans 331 % de retour sur investissement, 58,1 millions de dollars de valeur actualisée nette et moins de six mois de retour. Les résultats peuvent ne pas être typiques. Billet Microsoft

Pourquoi c’est important. L’étude utilise la valeur actualisée nette, ou VAN, pour relier une plateforme de données à un raisonnement financier connu des directions financières.

Notre commentaire. J’apprécie surtout l’usage de la VAN. La conversation part ensuite dans un bon détour : l’IT doit-elle créer directement de la valeur, ou rester le socle qui permet aux projets d’en créer ? Nous n’avons pas tranché, ce qui est probablement la partie intéressante.

À faire. Reprendre la méthode avec des flux de trésorerie propres à l’organisation, sans copier les pourcentages du modèle composite.

Un checkpoint hebdomadaire pour mieux expliquer le mois

Ce qui est publié. AWS propose une revue hebdomadaire des écarts, manuelle ou assistée par FinOps Agent, pour collecter le contexte avant la clôture mensuelle. Guide AWS

Pourquoi c’est important. Le contexte est plus facile à recueillir pendant le mois qu’au moment de reconstruire les causes après la clôture.

Notre commentaire. J’y vois le compromis classique : une fréquence élevée améliore la réactivité, mais ajoute de la maintenance. La bonne cadence produit des réponses sans devenir une réunion permanente.

À faire. Tester un checkpoint court sur quatre semaines, puis conserver seulement les questions qui améliorent réellement l’analyse mensuelle.

Google étend son partage des coûts de ressources

Ce qui a été dit dans l’épisode. Google étend le déploiement d’un changement de partage des coûts de ressources déjà traité le mois précédent. La conversation de juillet n’ajoute pas assez de détails ni de nouvelle source pour le présenter comme un lancement autonome.

Pourquoi c’est important. Un mécanisme de partage des coûts peut modifier l’allocation entre équipes et les comparaisons avec les périodes précédentes.

Notre commentaire. On le conserve comme suivi, sans inventer une nouveauté qui n’est pas présente dans la conversation.

À faire. Reprendre l’analyse et la source de juin avant toute modification des règles d’allocation.

Certaines anciennes RI Azure ne se renouvellent plus

Ce qui est annoncé. Depuis le 1er juillet 2026, Microsoft ne permet plus l’achat ou le renouvellement de certaines Reserved VM Instances anciennes. Les RI existantes continuent d’appliquer leur remise jusqu’à leur échéance. Guide de transition Microsoft

Pourquoi c’est important. Sans préparation, un workload encore couvert peut revenir au tarif pay-as-you-go à l’expiration de sa réservation.

Notre commentaire. Ce n’est pas la fin immédiate des VM concernées. C’est d’abord la fin d’un mécanisme d’engagement pour certaines séries, avec une décision à prendre entre migration et Savings Plan.

À faire. Comparer l’inventaire aux séries listées par Microsoft, repérer les échéances et commencer la décision six à douze mois avant la fin de chaque RI.

Durabilité

AWS ajoute les prélèvements d’eau à son service Sustainability

Ce qui est annoncé. AWS publie des estimations annuelles de prélèvement d’eau par région, service et compte, dans la console et l’API, sans surcoût. Annonce AWS

Pourquoi c’est important. Le reporting environnemental gagne une dimension supplémentaire, exploitable par compte et par région.

Notre commentaire. Steve demande si les chiffres sont mesurés directement pour chaque workload. La réponse documentée est non : AWS part des données de ses opérations et alloue les prélèvements aux comptes selon leur part d’usage. Méthode AWS

À faire. Utiliser ces données pour le reporting et les tendances régionales, pas pour prétendre mesurer au litre près une application particulière.

Ce qu’il faut surveiller

  • La confirmation de l’ordre des trois actualités vidéo.
  • Les derniers échanges possibles avant février 2027 et la future répartition entre réservations Azure et Savings Plans.
  • L’apparition d’autres tarifs IA variables selon l’heure ou la capacité disponible.
  • Le statut réel du modèle de facturation FC Agent Sandbox, encore en déploiement et en preview selon les régions.
  • La hausse des Capacity Blocks for ML, faute d’annonce AWS autonome.
  • Le statut de l’achat SaaS simplifié Microsoft Marketplace au jour de publication.
  • La qualité et la granularité des données de prélèvement d’eau AWS.