Microsoft impose un budget tokens IA à ses ingénieurs Copilot
TL;DR
- EVP Jay Parikh linked token budgets to 'outcomes that move the needle for customers and business,' the first explicit productivity-versus-cost threshold Microsoft has set internally.
- Per-token prices fell 98% since late 2022, yet enterprise AI bills tripled because agentic workflows consume far more tokens than autocomplete tools, per The Next Web.
- Microsoft canceled Claude Code licenses and switched its internal default to the cheaper GPT-5.6, consolidating engineers onto its own Copilot CLI tool.
Il y a une ironie qui saute aux yeux dans le mémo interne que 404 Media a obtenu : Microsoft, qui vend l'infra IA au reste de la planète, demande à ses propres ingénieurs de moins consommer. Jay Parikh, executive vice president chez Microsoft, écrit à ses équipes que « le tokenmaxxing n'est pas ce que nous optimisons » et que l'entreprise va désormais « gérer la dépense en tokens avec la même discipline que celle appliquée à toute autre ressource critique ».
Concrètement, à partir de juillet 2026, chaque division Microsoft recevra un « objectif de budget tokens IA », et chaque salarié pourra suivre sa propre consommation. Le mémo rappelle que « beaucoup d'ingénieurs dépensent entre plusieurs centaines de dollars et quelques milliers de dollars par mois en tokens ». Pour tirer plus de valeur de l'investissement, GPT-5.6 d'OpenAI devient le modèle par défaut en interne, parce qu'il coûte moins cher que les autres. Parikh insiste sur le cadrage : « Nous n'optimisons pas pour moins de tokens. Nous optimisons pour plus d'impact par token. »
Ce qui rend l'histoire intéressante n'est pas seulement le plafond, c'est que Microsoft rejoint Amazon, Adobe, Atlassian et Citi, qui ont pris des mesures similaires selon 404 Media. Le message envoyé au marché est difficile à ignorer : si l'entreprise qui héberge une partie de l'infra IA mondiale doit contraindre l'usage interne de GitHub Copilot, la promesse « déployez partout, la productivité paiera la facture » mérite d'être regardée de plus près par tout DSI en train de signer un contrat volume.
La nuance honnête est que le mémo ne dit pas que Copilot coûte plus qu'il ne rapporte : il dit que la dépense doit être disciplinée. Et 404 Media ne donne pas le montant exact des budgets, ni la méthode retenue pour mesurer « l'impact par token », ni la place laissée aux modèles concurrents. Un salarié anonyme cité par le média résume plus crûment le sentiment interne : « l'aveu ultime que nous, en tant qu'hébergeurs de l'infra IA, ne pouvons pas nous payer nos propres produits IA. » Pour les éditeurs de FinOps IA et pour les fournisseurs de modèles plus légers, c'est le signal d'ouverture qu'ils attendaient.
Ce qu'en disent les autres médias
-
The Next Web Lire →
Frames the move as a market inflection from experimental adoption to procurement discipline, anchored by the data point that per-token prices fell 98% yet bills tripled.
Per-token prices have dropped 98% since late 2022, yet enterprise AI bills have tripled because agentic tools consume far more tokens than autocomplete interactions.
-
The Register Lire →
Surfaces an inside-Microsoft concern that public cost rationing damages the affordability pitch Microsoft makes to enterprise customers evaluating Copilot contracts.
Tokenmaxxing is not what we are optimizing for. I want all of us focused on maximizing outcomes that move the needle for our customers and our business.
Shared on Bluesky by 5 AI experts
-
“Tokenmaxxing is not what we are optimizing for. I want all of us focused on maximizing outcomes that move the needle for our customers and our business.” www.404media.co/microsoft-te...
View on Bluesky → -
New: Microsoft has introduced new limits to how much its engineers can spend on AI tools at work and told employees that maximizing AI use internally is not the company’s goal, according to an internal Microsoft email ob…
View on Bluesky →
Article original publié par 404media.co
Lire l'article original →Titre original : Microsoft impose un plafond de tokens IA à ses ingénieurs : « le tokenmaxxing n'est pas notre objectif »