Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

404mediaindianexpressindianexpressMicrosoft a demandé à ses ingénieurs d'arrêter le « tokenmaxxing », cette pratique consistant à consommer massivement de coûteux jetons d'IA sans se soucier des coûts ou des résultats. Le groupe instaure des budgets par division et passe à un modèle par défaut plus économique pour son usage interne.
Cette directive provient d'un courriel interne de Jay Parikh, le vice-président exécutif qui dirige l'organisation CoreAI de Microsoft, révélé pour la première fois par 404 Media le 4 août. « Le tokenmaxxing n'est pas ce que nous cherchons à optimiser », a écrit Parikh. « Je veux que chacun de nous se concentre sur la maximisation des résultats qui font véritablement progresser nos clients et notre entreprise. »404media
Dans le cadre de cette réorientation, Microsoft adopte GPT-5.6 d'OpenAI, décrit en interne comme moins coûteux à faire tourner, comme modèle par défaut pour ses employés. Auparavant, la configuration interne de GitHub Copilot redirigeait de nombreuses requêtes vers les modèles Claude d'Anthropic, entraînant des factures de jetons très élevées. Les directives internes mises à jour, applicables à partir de juillet 2026, fixent des objectifs budgétaires de jetons IA pour chaque division et permettent aux ingénieurs de suivre leurs propres dépenses, qui varieraient de quelques centaines à plusieurs milliers de dollars par mois.indianexpress+2
Jay Parikh a souligné qu'il ne s'agit pas de revoir à la baisse les ambitions du groupe dans l'IA. « Nous ne cherchons pas à utiliser moins de jetons. Nous cherchons à obtenir plus d'impact par jeton », a-t-il écrit. Les derniers résultats financiers de l'entreprise ont affiché une hausse du chiffre d'affaires, du résultat d'exploitation et du bénéfice net, dépassant les attentes de Wall Street.404media+1
Microsoft n'est pas un cas isolé. ABC News rapportait fin juillet que l'enthousiasme des entreprises pour le tokenmaxxing s'essoufflait déjà, alors que les directions s'interrogent sur les gains réels de productivité face à cette forte consommation d'IA. Meta a récemment imposé ses propres budgets de jetons et fermé un classement interne appelé « Claudeonomics », où les employés rivalisaient pour consommer le plus de jetons. Amazon Amazon.com, Inc. , Adobe , Atlassian et Citi Citigroup Inc. ont adopté des mesures de contrôle des coûts similaires.gadgetreview+2
Lors d'une intervention en juin dans le podcast « Hard Fork » du New York Times, le PDG Satya Nadella a directement abordé le sujet du tokenmaxxing, rappelant aux auditeurs que chaque problème ne nécessite pas le modèle d'IA le plus puissant.businessinsider
L'ironie est évidente: l'entreprise qui a investi des dizaines de milliards de dollars dans l'infrastructure IA et vend des abonnements Copilot aux entreprises du monde entier rationne désormais son propre produit en interne. Comme l'a confié anonymement un employé de Microsoft à Fortune, c'est « l'aveu ultime que nous, en tant qu'hébergeurs d'infrastructures d'IA, n'avons pas les moyens de nous offrir nos propres produits d'IA ». De son côté, le président d'Uber , Andrew Macdonald, s'est également demandé pourquoi l'utilisation accrue de jetons par ses ingénieurs n'avait pas généré une hausse proportionnelle des fonctionnalités utiles.gadgetreview+1
Ce tournant suggère que l'indicateur de succès initial de l'industrie de l'IA, le simple volume d'utilisation, cède la place à une question plus complexe: qu'est-ce que toute cette puissance de calcul produit réellement?