Microsoft hat am 27. Juli MAI-Cyber-1-Flash vorgestellt, das erste eigene Sicherheitsmodell des Konzerns. Es steckt in MDASH, einem Multi-Agenten-System, das Schwachstellen in großen Codebasen findet und behebt. Mustafa Suleyman und Hayete Gallot verkünden im Blogpost »world-class performance at 50% of the cost of leading models«. Man hört das Marketing-Getriebe von hier aus rattern.
Die Zahl, die man sich merkt: 95,95% im CyberGym-Benchmark, der misst, wie gut ein System über große Codebasen hinweg echte Sicherheitslücken findet. Das sind zwölf Punkte mehr als Claude Mythos, und auch Gemini und GPT bleiben zurück, alle vier Vergleichsmodelle liegen zwischen 83,2% und 85,6%. Das Kleingedruckte steht direkt daneben: Die 96 Prozent erreicht nicht das neue Modell, sondern die Kombination MAI-Cyber-1-Flash plus GPT-5.4. Der Flash erledigt bis zu 90% der Aufgaben, die restlichen zehn Prozent, also die wirklich harten, wandern weiter zu OpenAI. Microsofts erstes eigenes Cyber-Modell braucht für die Endgegner also weiterhin den Partner, von dem es sich gerade emanzipieren will.
Für Nutzer ist genau diese Arbeitsteilung der eigentliche Punkt. Microsoft rechnet vor, dass die Kombination gegenüber dem bisherigen Setup aus GPT-5.4, 5.4 mini und 5.3 Codex 50 Prozent günstiger ist. Token-Kosten sind bei Sicherheitsarbeit kein Detail, sondern die Grenze: Wer Millionen Zeilen Code dauerhaft scannen will, scheitert nicht an der Modellqualität, sondern an der Rechnung am Monatsende. Ein billiges Modell, das den Großteil schafft, und ein teures für den Rest, das ist die Blaupause, an der sich gerade die halbe Branche versucht. Dazu startet Microsoft Perception, ein agentenbasiertes Sicherheitssystem, das laufend überwacht und patcht, gefüttert aus über 100 Billionen Sicherheitssignalen täglich und Daten von 1,6 Millionen Kunden.
Einschränkung mit Ansage: CyberGym ist ein Benchmark, kein Angreifer. Microsoft veröffentlicht die Zahlen selbst, eine unabhängige Bestätigung steht aus, und das Modell wurde laut Blogpost von Microsofts eigenem AI Red Team geprüft, zusätzlich von einer nicht genannten dritten Partei. Das Modell stammt aus der MAI-Thinking-1-Linie, jener Reihe, der schon Training auf nicht lizenzierten Webdaten vorgeworfen wurde. Wer die 96 Prozent für bare Münze nimmt, sollte zumindest wissen, wer die Münze geprägt hat.
Quellen
- Microsoft AI: Introducing MAI-Cyber-1-Flash inside MDASH
- The Decoder: Microsoft launches its own cybersecurity model MAI-Cyber-1-Flash but still depends on OpenAI for the toughest tasks
- TechCrunch: Microsoft launches its first cybersecurity model, plus a new agentic cybersecurity system
Ähnliche News
- Microsoft kippt GPT-4 aus Copilot und schiebt ein eigenes Modell nach
- GPT-5.6 ist da, aber die US-Regierung lässt fast niemanden ran
- OpenAI lässt neue Modelle deine alten Chats nachspielen
Diese Meldung wurde mit Unterstützung von Claude (Anthropic) recherchiert und verfasst. Inhaltliche Fehler sind möglich. Die verlinkten Quellen ermöglichen eine eigene Prüfung. Fachbegriffe erläutert das Glossar.