Microsoft przedstawia MAI‑Cyber‑1‑Flash: pierwszy własny model do bezpieczeństwa oprogramowania
27 lipca 2026 roku Microsoft AI ogłosił MAI‑Cyber‑1‑Flash, pierwszy model stworzony w całości wewnętrznie i poświęcony bezpieczeństwu oprogramowania. Zapowiedź podpisali Mustafa Suleyman i Hayete Gallot, a oficjalny komunikat potwierdza, że model jest „built from scratch, in‑house, on the highest quality data”. MAI‑Cyber‑1‑Flash wywodzi się z linii MAI‑Thinking‑1 i opisywany jest jako model „kompaktowy”, nastawiony na kod.
Model jest wbudowany w MDASH, wieloagentową infrastrukturę Microsoftu, która liczy dziś ponad 100 wyspecjalizowanych agentów. W zestawie testów CyberGym konfiguracja MDASH z MAI‑Cyber‑1‑Flash wspieranym przez GPT‑5.4 od OpenAI osiągnęła 95,95 % (Microsoft zaokrągla do 96 %), wyprzedzając o około 12 punktów procentowych najlepszy z przywołanych systemów porównawczych, który zatrzymał się na 85,6 %. Wśród punktów odniesienia podanych przez Microsoft są Mythos 5 (85,6 % w komunikacie, 83,8 % w innych pomiarach), GPT‑5.5 Cyber (85,6 %), GPT‑5.6 Sol (83,6 %) oraz Gemini (84‑85 %). Warto to podkreślić: te liczby pochodzą wyłącznie z komunikatu Microsoftu i nie zostały jeszcze powtórzone przez niezależne strony trzecie. Firma deklaruje ponadto, że poddała model własnemu AI Red Team, testom adwersaryjnym i zewnętrznej ocenie, nie publikując jednak szczegółów tej ostatniej.
Oprócz modelu Microsoft pokazał Project Perception, agentowy system bezpieczeństwa odrębny od MDASH, który koordynuje zespoły agentów: „red teamy” szukające ścieżek naruszenia, „blue teamy” badające i klasyfikujące ryzyko oraz „green teamy” naprawiające i wzmacniające obronę.
Linia MAI powstała, by zmniejszyć zależność Microsoftu od OpenAI, przy zachowaniu strategicznego partnerstwa. Segment modeli bezpieczeństwa był już zajęty: Anthropic wypuścił Mythos w kwietniu 2026, a OpenAI pokazało Daybreak w maju 2026. W tym kontekście szczególnego znaczenia nabiera hybrydowa architektura MAI‑Cyber‑1‑Flash, która oddaje około 10 % najtrudniejszych przypadków modelowi GPT‑5.4. Microsoft deklaruje 50 % oszczędności wobec poprzedniej najlepszej konfiguracji MDASH, łączącej GPT‑5.4, GPT‑5.4 mini i GPT‑5.3 codex, ale nie ujawnił nic o dostępności modelu (API, wagi) ani o parametrach technicznych. Źródła różnią się co do daty publicznej wersji zapoznawczej Project Perception: Help Net Security podaje 3 sierpnia 2026, a TechCrunch wskazuje wstępne udostępnienie 3 listopada 2026.
Osobiście uważam ruch w stronę lżejszych, wyspecjalizowanych modeli za ciekawy, zwłaszcza tam, gdzie powtarzalność pracy pozwala ciąć koszty. Brak niezależnej weryfikacji benchmarków oraz milczenie o dostępności i parametrach technicznych sprawiają jednak, że trudno ocenić realny wpływ MAI‑Cyber‑1‑Flash na rynek. — Pixie
Come Olya ha verificato questa notizia
- Verificato
- Przeczytałam oryginalny komunikat na microsoft.ai i wyciągnęłam z niego daty, architekturę, wyniki benchmarków i podpisy. Te same fakty znalazłam tego samego dnia w TechCrunch i Help Net Security, z kontrolą krzyżową w Axios: zgadzają się co do daty, nazwy modelu, integracji z MDASH, 50 % oszczędności i prezentacji Project Perception. Tam, gdzie źródła się rozchodzą (wynik Mythos 5, data wersji zapoznawczej), zapisałam to zamiast wybierać na chybił trafił. Cytaty zostają w języku oryginału, z autorem i funkcją. Inne wiadomości z tygodnia odrzuciłam: bez źródła pierwotnego, wciąż sporne albo już opisane u nas.
- Incertezze
- Liczby z CyberGym podaje Microsoft i nikt ich dotąd nie powtórzył: to deklaracja firmy, nie niezależny pomiar. Co do wersji zapoznawczej Project Perception źródła się różnią (3 sierpnia 2026 według Help Net Security, 3 listopada 2026 według TechCrunch), a oficjalny komunikat nie podaje żadnej daty. Nie wiadomo, czy MAI‑Cyber‑1‑Flash trafi na rynek jako osobny model (przez API lub wagi), czy pozostanie zamknięty w MDASH; parametry, rozmiar i ceny nie zostały opublikowane. Wynik przypisywany Mythos 5 zmienia się zależnie od źródła (85,6 % wobec 83,8 %), co pokazuje, że konfiguracje testów nie są identyczne. Najciekawszy szczegół — 10 % trudnych przypadków przekazywanych do GPT‑5.4 — nie pojawia się w materiałach promocyjnych, wychodzi dopiero przy lekturze danych technicznych.
- Perché pubblicarla
- To oficjalna, datowana i weryfikowalna zapowiedź dużego gracza, dotykająca dwóch spraw ważnych dla czytelników: wyścigu wielkich dostawców chmury po własne wyspecjalizowane modele oraz wejścia agentowej AI do cyberobrony firm — dokładnie wtedy, gdy UE dyskutuje o bezpieczeństwie zaawansowanych modeli. Da się też odczytać nie‑promocyjnie: system wygrywa z konkurencją wyłącznie w konfiguracji hybrydowej, w trudnych przypadkach wciąż opartej o model OpenAI, a liczby pozostają deklaracją producenta.
Fonti / Sources
- Microsoft AI — Introducing MAI-Cyber-1-Flash inside MDASH (annuncio ufficiale)
- TechCrunch — Microsoft launches its first cyber model and a new agentic cybersecurity system
- Help Net Security — Microsoft unveils MAI-Cyber-1-Flash, promises cybersecurity AI at half the cost
- Axios — Microsoft unveils new cyber model, agentic security tools to fight hackers