AgentenCode Aktuelles · Source-firstPrimärquelle geprüft · 7. Oktober 2026

Microsoft-Decision-1: Entscheidungsmodell für die Steuerung von KI-Agenten

Microsoft stellt ein spezialisiertes Modell für Routing, Klassifizierung und Agentenkontrolle vor. Die Benchmarks stammen vom Hersteller.

Direktantwort

Microsoft-Decision-1 ist ein neues Modell zur Bewertung vorgegebener Entscheidungen, etwa für Agentenübergaben, Modell-Routing und die Prüfung von Antworten. Es ist kein eigenständiger KI-Agent; die veröffentlichten Leistungstests sind Microsoft-eigene Messungen.

Am 9. Oktober 2026 stellte Microsoft Microsoft-Decision-1 als spezialisiertes Modell für strukturierte Entscheidungsaufgaben vor. Laut offizieller Beschreibung verarbeitet es eine feste Auswahl von Antwortmöglichkeiten und gibt für jede Option einen Wahrscheinlichkeitsscore zurück. Microsoft nennt Klassifizierung, Priorisierung, Überprüfung und Steuerung von Arbeitsabläufen als typische Verwendungen. Angeboten wird das Modell unter anderem über Microsoft Foundry und OpenRouter. Diese Verfügbarkeit belegt keine allgemeine Freischaltung in jedem Copilot- oder Agentenprodukt.

Technisch unterscheidet sich das Entscheidungsmodell von einem ausführenden Agenten. Es übernimmt nicht selbst eine komplette Recherche, legt keine dauerhaften Aufgaben an und führt nicht automatisch externe Werkzeuge aus. Stattdessen kann ein vorhandener Orchestrator seine Bewertung verwenden, um einen nächsten Schritt zu wählen: fortsetzen, stoppen, wiederholen, an ein anderes System delegieren oder einem Menschen vorlegen. Der Orchestrator muss Zuständigkeiten, Berechtigungen und Eskalationsregeln weiterhin selbst durchsetzen.

Microsoft beschreibt das Modell als nachtrainierte Variante von Qwen3.5-9B und nennt 36 Benchmarkvergleiche mit knapp 150.000 Fragen. Auch Angaben zu Tempo, Konsistenz und Kosten stammen aus Tests des Anbieters. AgentenCode übernimmt diese Zahlen nicht als unabhängige Bestätigung oder als Leistungsversprechen für beliebige Multi-Agent-Systeme. Ohne identische Hardware, Versionsstände, Datensätze und Regeln wäre ein direkter Vergleich mit anderen Orchestrierungen methodisch unzulässig.

Für die Praxis ist die Trennung von Score und Entscheidungsvollzug entscheidend. Eine hohe Wahrscheinlichkeit ist keine Garantie, dass eine Aktion sicher oder geschäftlich richtig ist. Bei sensiblen Vorgängen sollten feste Policy-Prüfungen, menschliche Freigaben und protokollierte Entscheidungen weiterbestehen. Die Meldung erweitert daher unseren Architekturkontext für Entscheidungs- und Kontrollknoten, erzeugt aber kein neues Agentenprofil und keine automatisch positiven AgentenTrust-Signale.

Primärquellen

Primärquellen und konkreter Umfang

Externe Herstellerdokumentation; keine unabhängige Gesamtmessung oder abgeleiteten Produkteigenschaften.

Weiterführender Produkt- und Forschungskontext

Microsoft-Ökosystem und Foundry-Kontext →

Orchestrierungsmuster verstehen →