Microsoft startet Decision-1, ein Modell, das für Antwortoptionen Wahrscheinlichkeiten liefert statt Text. Laut Microsoft ist es 35-mal schneller als GPT-6 Sol und kostet 0,042 Dollar pro Million Input-Tokens. Alle Zahlen sind Herstellerangaben.
KI-Beratung und Softwareentwicklung aus dem St. Galler Rheintal.
Decision-1 eignet sich für Routing und Klassifikation, nicht für Chat. Tempo- und Genauigkeitswerte stammen von Microsoft, H2O.ai bestreitet Vergleichszahlen – teste mit eigenen Daten.
Microsoft hat am 9. Oktober Decision-1 vorgestellt, ein Modell, das keinen Text schreibt, sondern für vorgegebene Antwortoptionen Wahrscheinlichkeiten liefert. Laut Microsoft erreicht es in einem eigenen Vergleich über 36 Benchmarks eine Genauigkeit von 83,5 Prozent (nächster Konkurrent Quyet-1.0-Large: 81,9 Prozent) bei 85 Millisekunden Median-Latenz. Der Preis liegt bei 0,042 Dollar pro Million Input-Tokens, die Ausgabe ist gratis. Diese Zahlen stammen von Microsoft und sind nicht unabhängig geprüft.
Decision-1 basiert auf Alibabas Modell Qwen3.5-9B, das Microsoft für das Bewerten in einem einzigen Durchgang nachtrainiert hat. Du gibst Optionen vor, etwa Ja oder Nein, Multiple Choice oder eine Bewertungsskala, und das Modell liefert pro Option eine kalibrierte Wahrscheinlichkeit zurück («kalibriert» heisst: Eine Angabe von 80 Prozent soll auch in rund 80 Prozent der Fälle stimmen).
Als Einsatzgebiete nennt Microsoft Routing, Klassifikation, Priorisierung, Überprüfung und die Kontrolle von KI-Agenten. Für Chat, Zusammenfassungen oder Übersetzungen ist es nicht gedacht. Es versteht nur Text, hat ein Kontextfenster von 32'768 Token und liefert keine Begründungen. Laut Modellkarte soll es nicht allein über Kredit, Anstellung, Wohnen, Gesundheit oder Rechte entscheiden.
Microsoft gibt an, Decision-1 sei 4,5-mal schneller als Quyet-1.0-Large und 35-mal schneller als GPT-6 Sol. Der Haken: Microsoft hat sein Modell selbst über Foundry gemessen, die Werte der Konkurrenz stammen vom JevBench mit einem angepassten Median. Laut MarkTechPost bestreitet H2O.ai die Zahl für sein Modell H2O-Lightning-4B: Es messe 29 statt der in Microsofts Grafik genannten 210 Millisekunden. Decision-1 steht nicht auf der JevBench-Rangliste, unabhängige Ergebnisse fehlen also noch.
Auch die internen Tests sind Herstellerangaben: Das Xbox-Forschungsteam meldet Qualität im Bereich von GPT-6 Sol bei über 14-mal höherem Tempo und 200-mal tieferen Kosten.
Kürzlich haben wir über Jev von TypeSafe AI berichtet, ein Modell ohne Text, das mit 7,5 Milliarden Dollar bewertet wird. Mit Decision-1 steigt nun ein Grosskonzern in dieses Feld ein. OpenAI bietet laut MarkTechPost bereits einen «Luna Decisions»-Zugang für 0,10 Dollar pro Million Input-Tokens an.
Decision-1 gibt es nur als gehostete Schnittstelle über Microsoft Foundry und OpenRouter, ohne offene Gewichte. Ob und wann es in europäischen oder Schweizer Regionen läuft, nennen die Quellen nicht. Wenn du viele Routine-Entscheide automatisierst, etwa Tickets sortieren oder Agentenaktionen prüfen, ist die Kategorie interessant. Teste sie aber mit eigenen Daten, bevor du den Herstellerzahlen traust.
TypeSafe AI sammelt 870 Millionen Dollar bei 7,5 Milliarden Bewertung ein, weniger als einen Monat nach dem Start von Jev. Das Modell liefert Entscheidungen statt Texte. Tempo und Kosten stammen aus Herstellerangaben. Wir ordnen ein, was das für Schweizer Firmen heisst.