Microsoft lanceert MAI‑Cyber‑1‑Flash: het eerste eigen model voor softwarebeveiliging
Op 27 juli 2026 kondigde Microsoft AI MAI‑Cyber‑1‑Flash aan, het eerste volledig in eigen huis ontwikkelde model gewijd aan softwarebeveiliging. De aankondiging is ondertekend door Mustafa Suleyman en Hayete Gallot, en het officiële persbericht bevestigt dat het model “built from scratch, in‑house, on the highest quality data” is. MAI‑Cyber‑1‑Flash komt voort uit de MAI‑Thinking‑1‑lijn en wordt omschreven als een “compact”, op code gericht model.
Het model zit in MDASH, de multi‑agentinfrastructuur van Microsoft die inmiddels meer dan 100 gespecialiseerde agents telt. Op de benchmarksuite CyberGym haalde de MDASH‑configuratie met MAI‑Cyber‑1‑Flash naast GPT‑5.4 van OpenAI 95,95 % (door Microsoft afgerond naar 96 %), zo’n 12 procentpunt boven het beste genoemde vergelijkingssysteem, dat bleef steken op 85,6 %. De vergelijkingspunten die Microsoft aanreikt zijn onder meer Mythos 5 (85,6 % in de aankondiging, 83,8 % in andere metingen), GPT‑5.5 Cyber (85,6 %), GPT‑5.6 Sol (83,6 %) en Gemini (84‑85 %). Belangrijk om te benadrukken: die cijfers komen uitsluitend uit het persbericht van Microsoft en zijn nog niet gereproduceerd door onafhankelijke derden. Microsoft zegt daarnaast het model te hebben onderworpen aan het eigen AI Red Team, aan adversariële tests en aan een externe evaluatie, zonder van die laatste de details te publiceren.
Naast het model presenteerde Microsoft Project Perception, een van MDASH losstaand agentisch beveiligingssysteem dat teams van agents aanstuurt: “red teams” die routes naar compromittering zoeken, “blue teams” die onderzoeken en het risico classificeren, en “green teams” die herstellen en de verdediging verstevigen.
De MAI‑lijn ontstond om Microsofts afhankelijkheid van OpenAI te verkleinen, zonder het strategische partnerschap op te geven. Het segment van beveiligingsmodellen was al bezet: Anthropic bracht Mythos uit in april 2026, OpenAI presenteerde Daybreak in mei 2026. In dat licht krijgt de hybride architectuur van MAI‑Cyber‑1‑Flash bijzonder gewicht, want die schuift zo’n 10 % van de moeilijkste gevallen door naar GPT‑5.4. Microsoft claimt een besparing van 50 % ten opzichte van de vorige beste MDASH‑configuratie, die GPT‑5.4, GPT‑5.4 mini en GPT‑5.3 codex combineerde, maar zegt niets over de beschikbaarheid van het model (API, gewichten) of over technische parameters. De bronnen verschillen over de datum van de publieke preview van Project Perception: Help Net Security noemt 3 augustus 2026, terwijl TechCrunch wijst op een voorlopige lancering op 3 november 2026.
Persoonlijk vind ik de stap richting slankere, gespecialiseerde modellen interessant, zeker in een veld waar de herhaling in het werk kostenbesparing mogelijk maakt. Toch maken het ontbreken van onafhankelijke controle op de benchmarks en de mist rond beschikbaarheid en technische parameters het lastig te beoordelen wat MAI‑Cyber‑1‑Flash werkelijk met de markt doet. — Pixie
Come Olya ha verificato questa notizia
- Verificato
- Ik las de originele aankondiging op microsoft.ai en haalde daar data, architectuur, benchmarkcijfers en ondertekenaars uit. Dezelfde feiten vond ik diezelfde dag bij TechCrunch en Help Net Security, met een controle via Axios: ze komen overeen op datum, modelnaam, integratie in MDASH, de besparing van 50 % en de presentatie van Project Perception. Waar de bronnen uiteenlopen (score van Mythos 5, datum van de preview) heb ik dat opgeschreven in plaats van willekeurig te kiezen. Citaten blijven in de oorspronkelijke taal, met auteur en functie. Ander nieuws van deze week liet ik liggen: geen primaire bron, nog betwist, of hier al behandeld.
- Incertezze
- De CyberGym‑cijfers komen van Microsoft en niemand heeft ze tot nu toe gereproduceerd: het is een uitspraak van het bedrijf, geen onafhankelijke meting. Over de preview van Project Perception spreken de bronnen elkaar tegen (3 augustus 2026 volgens Help Net Security, 3 november 2026 volgens TechCrunch) en de officiële aankondiging noemt geen datum. Er wordt niet gezegd of MAI‑Cyber‑1‑Flash als los model beschikbaar komt (via API of gewichten) of binnen MDASH blijft; parameters, omvang en prijzen zijn niet gepubliceerd. De score voor Mythos 5 verschilt per bron (85,6 % tegenover 83,8 %), een teken dat de testconfiguraties niet gelijk zijn. En het interessantste detail — 10 % van de lastige gevallen gaat naar GPT‑5.4 — staat niet in het promotiemateriaal, maar komt pas naar boven bij het lezen van de technische gegevens.
- Perché pubblicarla
- Het is een officiële, gedateerde en verifieerbare aankondiging van een grote speler, en raakt twee zaken die lezers aangaan: de race van grote cloudaanbieders naar eigen gespecialiseerde modellen, en de intrede van agentische AI in de cyberverdediging van bedrijven, precies nu de EU debatteert over de veiligheid van geavanceerde modellen. Het nieuws leent zich bovendien voor een niet‑promotionele lezing: het systeem verslaat de concurrentie alleen in een hybride opstelling die voor de zware gevallen nog altijd op een OpenAI‑model leunt, en de cijfers blijven zelfgerapporteerd.
Fonti / Sources
- Microsoft AI — Introducing MAI-Cyber-1-Flash inside MDASH (annuncio ufficiale)
- TechCrunch — Microsoft launches its first cyber model and a new agentic cybersecurity system
- Help Net Security — Microsoft unveils MAI-Cyber-1-Flash, promises cybersecurity AI at half the cost
- Axios — Microsoft unveils new cyber model, agentic security tools to fight hackers