KI-Praxis

Microsoft deckelt KI-Token-Verbrauch der eigenen Mitarbeitenden

3 Min. Lesezeit

TL;DR Too Long; Didn’t read

Microsoft begrenzt seit Juli 2026 den KI-Token-Verbrauch seiner Geschäftsbereiche und macht das günstigere Modell GPT-5.6 zum internen Standard. Ausgelöst wurde die Maßnahme laut einem internen Memo von CoreAI-Chef Jay Parikh durch stark gestiegene Kosten seit dem Einsatz agentischer Coding-Werkzeuge. Einzelne Entwickler gaben laut dem Memo zuvor monatlich mehrere Tausend Dollar für Tokens aus.

Eine Hand mit Microsoft-Logo-Sticker auf dem Ärmel presst einen Deckel auf einen überquellenden Topf voller leuchtender digitaler Münzen. Generiertes Bild mit GPT Image 2

Das Wichtigste in Kürze

  • CoreAI-Chef Jay Parikh verschickte das Memo laut 404 Media in dieser Woche an Microsofts Entwicklerteams.
  • Jede Konzerndivision erhält künftig ein eigenes Token-Budget als Zielgröße, überwacht per internem Dashboard.
  • OpenAIs günstigeres Modell GPT-5.6 wird neuer Standard für interne KI-Anfragen bei Microsoft.
  • Vor allem agentische Coding-Werkzeuge wie GitHub Copilot trieben laut Memo die Tokenkosten pro Kopf in die Höhe.
  • Tesla, Uber, Amazon und Walmart führten zuvor bereits ähnliche Ausgabenlimits für KI-Nutzung ein.
  • Microsoft bewirbt Copilot extern weiter uneingeschränkt als Werkzeug für jede Belegschaft.

Microsoft hat seinen Geschäftsbereichen ab Juli 2026 feste Obergrenzen für den KI-Token-Verbrauch vorgegeben und macht das günstigere Modell GPT-5.6 zum internen Standard. Grund ist laut einem internen Memo von CoreAI-Chef Jay Parikh ein starker Kostenanstieg, seit Entwicklerteams verstärkt agentische Werkzeuge wie GitHub Copilot einsetzen. Einzelne Ingenieure gaben demnach zuvor monatlich mehrere Tausend Dollar für Tokens aus.

Microsoft richtet Token-Budgets je Geschäftsbereich ein

Parikh leitet als Executive Vice President die Sparte CoreAI, die Microsofts Werkzeuge für Entwickler – darunter Copilot und GitHub – sowie einen Großteil der internen KI-Infrastruktur verantwortet. Laut 404 Media, das die E-Mail zuerst veröffentlichte, verschickte er sie in dieser Woche an Ingenieurteams im Konzern. Jede Division erhalte demnach künftig ein eigenes Token-Budget als Zielgröße, einzelne Beschäftigte könnten ihren Verbrauch zudem über ein internes Dashboard nachverfolgen.

Parikh schreibt wörtlich, „Tokenmaxxing is not what we are optimizing for” – möglichst viele Tokens zu verbrauchen, sei nicht das Ziel. Die Belegschaft solle sich stattdessen auf Ergebnisse konzentrieren, die für Kunden und das Geschäft zählten.

Als weitere Sparmaßnahme wird OpenAIs GPT-5.6 zur Standardvoreinstellung für interne Anfragen, weil es laut Microsoft günstiger ist als bislang genutzte Alternativen. Bereits im Juli hatte der Konzern begonnen, einen Teil der Anfragen in Excel und Outlook auf eigene MAI-Modelle umzuleiten, um Kosten für Modelle von OpenAI und Anthropic zu senken. Beide Schritte laufen auf dasselbe Ziel hinaus: weniger Geld pro erledigter Aufgabe auszugeben, ohne den KI-Einsatz insgesamt zurückzufahren.

Kosten explodierten trotz günstigerer Tokenpreise

Einzelne Entwickler gaben laut dem Memo zuvor monatlich zwischen mehreren Hundert und einigen Tausend Dollar für Tokens aus – unabhängig nicht verifiziert. Ursache ist demnach vor allem der Umstieg von einfachen Autovervollständigungs-Vorschlägen auf agentische Werkzeuge, die selbstständig mehrere Arbeitsschritte hintereinander ausführen und dabei ein Vielfaches an Tokens verbrauchen. Nach Angaben des Magazins TheNextWeb fielen die Preise pro Token seit Ende 2022 um rund 98 Prozent, während sich die KI-Rechnungen vieler Unternehmen im selben Zeitraum verdreifachten – mehr Volumen frisst demnach die Ersparnis pro Anfrage vollständig auf.

Parikh betont laut Memo, es gehe nicht darum, weniger Tokens zu nutzen, sondern mehr Wirkung pro Token zu erzielen. Ein anonymer Microsoft-Beschäftigter kommentierte gegenüber 404 Media, der Schritt wirke wie ein Eingeständnis, man könne sich die eigenen KI-Produkte intern kaum noch leisten. Für Belegschaften außerhalb von Microsoft liefert der Fall eine nüchterne Rechengröße: Wer agentische Coding-Werkzeuge im Team einführt, sollte Kosten pro gelöster Aufgabe verfolgen statt nur den Tokenpreis – sonst drohen ähnliche Überraschungen wie bei Microsofts eigenen Ingenieuren. Microsoft-Chef Satya Nadella hatte bereits im Juli vor einer solchen Kostenfalle bei der KI-Nutzung gewarnt.

Weitere Konzerne kappen KI-Ausgaben ihrer Teams

Microsoft ist nicht der erste Konzern, der die KI-Nutzung seiner Beschäftigten begrenzt. Tesla deckelte die KI-Ausgaben seiner Mitarbeitenden bereits im Juli 2026 auf 200 US-Dollar pro Woche, nachdem interne Ranglisten den Verbrauch zuvor noch angefeuert hatten. Nach Angaben desselben Berichts führten auch Uber, Meta, Amazon und Walmart bereits vergleichbare Ausgabenlimits ein. TheNextWeb berichtet zudem, dass Adobe, Atlassian und die Bank Citi ihre internen KI-Budgets ebenfalls gekappt hätten.

Nach außen bewirbt Microsoft Copilot weiterhin uneingeschränkt als Werkzeug, das jedes Unternehmen seiner gesamten Belegschaft zur Verfügung stellen solle – dieselbe Botschaft, mit der der Konzern seit Monaten für die eigenen KI-Produkte wirbt. Intern gilt nun die gegenteilige Losung: nicht mehr Verbrauch, sondern mehr Wirkung je eingesetztem Token. An den Geschäftszahlen ändert der Sparkurs laut TheNextWeb bislang nichts: Microsofts KI-Geschäft wächst weiter deutlich, das Memo richtet sich ausschließlich auf die interne Kostenkontrolle.

Entscheidend wird, ob sich der interne Sparkurs mit Microsofts externer Botschaft verträgt, jedes Unternehmen solle möglichst viele Copilot-Lizenzen einsetzen. Setzt sich die Kennzahl „Wirkung pro Token” als interner Maßstab durch, könnte sie zum Vorbild für andere Konzerne werden, die ihre KI-Budgets ebenfalls kaum noch im Griff haben. Offen bleibt zudem, wie Microsoft seine Entwicklerteams intern davon überzeugen will, sparsamer mit einem Werkzeug umzugehen, das der Konzern gleichzeitig als unverzichtbar bewirbt.

Häufige Fragen

Was bedeutet der intern verwendete Begriff „Tokenmaxxing“?

Der Begriff beschreibt exzessive KI-Nutzung, bei der Beschäftigte möglichst viele Tokens verbrauchen, ohne auf den Nutzen pro Anfrage zu achten.

Wie hoch waren die KI-Ausgaben einzelner Microsoft-Entwickler zuvor?

Laut dem internen Memo lagen die monatlichen Ausgaben einzelner Beschäftigter zwischen mehreren Hundert und einigen Tausend Dollar. Eine unabhängige Bestätigung dieser Zahlen liegt bislang nicht vor.

Welches KI-Modell nutzt Microsoft jetzt intern standardmäßig?

Für interne Anfragen ist inzwischen OpenAIs günstigeres Modell GPT-5.6 voreingestellt statt teurerer Alternativen.

Gilt die Budgetgrenze auch für zahlende Copilot-Kunden?

Nein, die Obergrenzen betreffen nur Microsofts eigene Beschäftigte. Das öffentliche Copilot-Angebot bewirbt der Konzern unverändert.

Welche anderen Unternehmen haben ihre KI-Ausgaben ähnlich begrenzt?

Tesla, Uber, Amazon, Walmart, Adobe, Atlassian und die Bank Citi führten laut Berichten bereits vergleichbare Verbrauchskontrollen ein.

Quellen (3)
  1. 404 Media: Microsoft Tells Engineers 'Tokenmaxxing Is Not What We Are Optimizing For'
  2. TheNextWeb: Microsoft tells employees to stop tokenmaxxing, sets division-level AI budgets
  3. TechRadar Pro: 'Tokenmaxxing is not what we are optimizing for' – Microsoft tells engineer to calm down on AI usage

Dein KI-Update für die Arbeitswoche

Einmal pro Woche das Wichtigste aus der KI-Welt – plus ein Praxis-Tipp zum direkt Ausprobieren. Kein Spam, jederzeit abbestellbar.

← Zurück zum Blog