404media.co détecté sur le web

Microsoft impose un budget tokens IA à ses ingénieurs Copilot

3 médias qui couvrent ce sujet

TL;DR

  • EVP Jay Parikh linked token budgets to 'outcomes that move the needle for customers and business,' the first explicit productivity-versus-cost threshold Microsoft has set internally.
  • Per-token prices fell 98% since late 2022, yet enterprise AI bills tripled because agentic workflows consume far more tokens than autocomplete tools, per The Next Web.
  • Microsoft canceled Claude Code licenses and switched its internal default to the cheaper GPT-5.6, consolidating engineers onto its own Copilot CLI tool.

Il y a une ironie qui saute aux yeux dans le mémo interne que 404 Media a obtenu : Microsoft, qui vend l'infra IA au reste de la planète, demande à ses propres ingénieurs de moins consommer. Jay Parikh, executive vice president chez Microsoft, écrit à ses équipes que « le tokenmaxxing n'est pas ce que nous optimisons » et que l'entreprise va désormais « gérer la dépense en tokens avec la même discipline que celle appliquée à toute autre ressource critique ».

Concrètement, à partir de juillet 2026, chaque division Microsoft recevra un « objectif de budget tokens IA », et chaque salarié pourra suivre sa propre consommation. Le mémo rappelle que « beaucoup d'ingénieurs dépensent entre plusieurs centaines de dollars et quelques milliers de dollars par mois en tokens ». Pour tirer plus de valeur de l'investissement, GPT-5.6 d'OpenAI devient le modèle par défaut en interne, parce qu'il coûte moins cher que les autres. Parikh insiste sur le cadrage : « Nous n'optimisons pas pour moins de tokens. Nous optimisons pour plus d'impact par token. »

Ce qui rend l'histoire intéressante n'est pas seulement le plafond, c'est que Microsoft rejoint Amazon, Adobe, Atlassian et Citi, qui ont pris des mesures similaires selon 404 Media. Le message envoyé au marché est difficile à ignorer : si l'entreprise qui héberge une partie de l'infra IA mondiale doit contraindre l'usage interne de GitHub Copilot, la promesse « déployez partout, la productivité paiera la facture » mérite d'être regardée de plus près par tout DSI en train de signer un contrat volume.

La nuance honnête est que le mémo ne dit pas que Copilot coûte plus qu'il ne rapporte : il dit que la dépense doit être disciplinée. Et 404 Media ne donne pas le montant exact des budgets, ni la méthode retenue pour mesurer « l'impact par token », ni la place laissée aux modèles concurrents. Un salarié anonyme cité par le média résume plus crûment le sentiment interne : « l'aveu ultime que nous, en tant qu'hébergeurs de l'infra IA, ne pouvons pas nous payer nos propres produits IA. » Pour les éditeurs de FinOps IA et pour les fournisseurs de modèles plus légers, c'est le signal d'ouverture qu'ils attendaient.

Ce qu'en disent les autres médias

Couverture consolidée 24h après publication

  1. The Next Web Lire →

    Frames the move as a market inflection from experimental adoption to procurement discipline, anchored by the data point that per-token prices fell 98% yet bills tripled.

    Per-token prices have dropped 98% since late 2022, yet enterprise AI bills have tripled because agentic tools consume far more tokens than autocomplete interactions.
  2. The Register Lire →

    Surfaces an inside-Microsoft concern that public cost rationing damages the affordability pitch Microsoft makes to enterprise customers evaluating Copilot contracts.

    Tokenmaxxing is not what we are optimizing for. I want all of us focused on maximizing outcomes that move the needle for our customers and our business.

Shared on Bluesky by 5 AI experts