Microsoft impose un budget tokens IA à ses ingénieurs Copilot
TL;DR
- Jay Parikh, EVP de Microsoft, prévient dans un mémo interne que « le tokenmaxxing n'est pas ce que nous optimisons ».
- À partir de juillet 2026, chaque division Microsoft aura un « objectif de budget tokens IA » et chaque salarié pourra suivre sa consommation.
- GPT-5.6 d'OpenAI devient le modèle par défaut en interne parce qu'il coûte moins cher que les autres.
Il y a une ironie qui saute aux yeux dans le mémo interne que 404 Media a obtenu : Microsoft, qui vend l'infra IA au reste de la planète, demande à ses propres ingénieurs de moins consommer. Jay Parikh, executive vice president chez Microsoft, écrit à ses équipes que « le tokenmaxxing n'est pas ce que nous optimisons » et que l'entreprise va désormais « gérer la dépense en tokens avec la même discipline que celle appliquée à toute autre ressource critique ».
Concrètement, à partir de juillet 2026, chaque division Microsoft recevra un « objectif de budget tokens IA », et chaque salarié pourra suivre sa propre consommation. Le mémo rappelle que « beaucoup d'ingénieurs dépensent entre plusieurs centaines de dollars et quelques milliers de dollars par mois en tokens ». Pour tirer plus de valeur de l'investissement, GPT-5.6 d'OpenAI devient le modèle par défaut en interne, parce qu'il coûte moins cher que les autres. Parikh insiste sur le cadrage : « Nous n'optimisons pas pour moins de tokens. Nous optimisons pour plus d'impact par token. »
Ce qui rend l'histoire intéressante n'est pas seulement le plafond, c'est que Microsoft rejoint Amazon, Adobe, Atlassian et Citi, qui ont pris des mesures similaires selon 404 Media. Le message envoyé au marché est difficile à ignorer : si l'entreprise qui héberge une partie de l'infra IA mondiale doit contraindre l'usage interne de GitHub Copilot, la promesse « déployez partout, la productivité paiera la facture » mérite d'être regardée de plus près par tout DSI en train de signer un contrat volume.
La nuance honnête est que le mémo ne dit pas que Copilot coûte plus qu'il ne rapporte : il dit que la dépense doit être disciplinée. Et 404 Media ne donne pas le montant exact des budgets, ni la méthode retenue pour mesurer « l'impact par token », ni la place laissée aux modèles concurrents. Un salarié anonyme cité par le média résume plus crûment le sentiment interne : « l'aveu ultime que nous, en tant qu'hébergeurs de l'infra IA, ne pouvons pas nous payer nos propres produits IA. » Pour les éditeurs de FinOps IA et pour les fournisseurs de modèles plus légers, c'est le signal d'ouverture qu'ils attendaient.
Shared on Bluesky by 3 AI experts
Article original publié par 404media.co
Lire l'article original →Titre original : Microsoft impose un plafond de tokens IA à ses ingénieurs : « le tokenmaxxing n'est pas notre objectif »