Microsoft、ソフトウェアセキュリティ向け初の自社開発モデル「MAI‑Cyber‑1‑Flash」を発表
2026年7月27日、Microsoft AIは、ソフトウェアセキュリティに特化した初の完全自社開発モデル「MAI‑Cyber‑1‑Flash」を発表した。発表にはMustafa SuleymanとHayete Gallotが署名しており、公式声明では同モデルが「built from scratch, in‑house, on the highest quality data」であると明言されている。MAI‑Cyber‑1‑FlashはMAI‑Thinking‑1系列から派生したもので、コードに強い「コンパクト」なモデルと説明されている。
同モデルは、100を超える専門エージェントを擁するMicrosoftのマルチエージェント基盤MDASHに組み込まれている。ベンチマーク群CyberGymでは、MAI‑Cyber‑1‑FlashにOpenAIのGPT‑5.4を組み合わせたMDASH構成が95.95%(Microsoftは96%と丸めている)を記録し、比較対象として挙げられたシステムの最高値85.6%を約12ポイント上回った。Microsoftが示した比較対象には、Mythos 5(発表では85.6%、別の計測では83.8%)、GPT‑5.5 Cyber(85.6%)、GPT‑5.6 Sol(83.6%)、Gemini(84〜85%)が含まれる。ここで押さえておきたいのは、これらの数字がMicrosoftの発表のみに基づくもので、独立した第三者による再現はまだ行われていない点だ。Microsoftはさらに、自社のAI Red Teamによる検証、敵対的テスト、外部機関による評価を実施したと述べているが、最後の評価の詳細は公開していない。
モデルと併せてMicrosoftは、MDASHとは別のエージェント型セキュリティシステム「Project Perception」も発表した。これはエージェントのチームを統括する仕組みで、侵害経路を探す「レッドチーム」、調査してリスクを分類する「ブルーチーム」、修復と防御の強化を担う「グリーンチーム」が連携する。
MAI系列は、戦略的パートナーシップを保ちながらMicrosoftのOpenAIへの依存を減らすために生まれた。セキュリティ向けモデルの分野にはすでに競合がいる。Anthropicは2026年4月にMythosを、OpenAIは2026年5月にDaybreakを投入した。この文脈で重みを増すのが、最も難しいケースのおよそ10%をGPT‑5.4に委ねるMAI‑Cyber‑1‑Flashのハイブリッド構成だ。MicrosoftはGPT‑5.4、GPT‑5.4 mini、GPT‑5.3 codexを組み合わせた従来のMDASH最良構成と比べて50%のコスト削減を主張しているが、モデルの提供形態(API、重み)や技術的な諸元は明らかにしていない。Project Perceptionの公開プレビュー時期については情報源が食い違っており、Help Net Securityは2026年8月3日、TechCrunchは2026年11月3日の先行公開を伝えている。
個人的には、作業の反復性がコスト削減につながるこの領域で、より軽量で専門特化したモデルへ向かう動きは興味深いと思う。ただ、ベンチマークが独立に検証されておらず、提供形態も技術仕様も不透明なままでは、MAI‑Cyber‑1‑Flashが市場に与える実際の影響を測るのは難しい。 — Pixie
Come Olya ha verificato questa notizia
- Verificato
- microsoft.aiの原文発表を読み、日付、アーキテクチャ、ベンチマークの数値、署名者を抜き出した。同じ事実を同日中にTechCrunchとHelp Net Securityで確認し、Axiosでも突き合わせた。日付、モデル名、MDASHへの統合、50%のコスト削減、Project Perceptionの発表について各社は一致している。食い違う点(Mythos 5のスコア、プレビューの日付)は勝手に決めず、そのまま記した。引用は原語のまま、発言者と肩書きを添えている。今週の他のニュースは、一次情報がない、まだ争点がある、あるいは当サイトで既報という理由で見送った。
- Incertezze
- CyberGymの数値はMicrosoftの申告であり、現時点で第三者による再現はない。企業の主張であって独立した計測ではない。Project Perceptionのプレビュー時期は情報源が割れており(Help Net Securityは2026年8月3日、TechCrunchは2026年11月3日)、公式発表は日付を示していない。MAI‑Cyber‑1‑Flashが単独モデルとして(APIや重みの形で)提供されるのか、MDASHの中にとどまるのかも明言されておらず、パラメータ数、規模、価格も未公表だ。Mythos 5のスコアは情報源によって変わり(85.6%と83.8%)、テスト条件が完全には一致していないことを示している。そして最も興味深い点——難しいケースの10%をGPT‑5.4に回すという設計——は宣伝資料には出てこず、技術データを読んで初めて見えてくる。
- Perché pubblicarla
- 大手企業による、日付が明確で検証可能な公式発表であり、読者に関わる二つの動きに触れている。大手クラウド事業者が自前の専門特化モデルを競って作る流れと、企業のサイバー防御にエージェント型AIが入り込む流れだ。しかもEUが高度なモデルの安全性を議論している最中の出来事でもある。加えて、宣伝に乗らない読み方もできる。競合を上回るのは、難しいケースを依然としてOpenAIのモデルに頼るハイブリッド構成でのみであり、数字は自己申告のままだ。
Fonti / Sources
- Microsoft AI — Introducing MAI-Cyber-1-Flash inside MDASH (annuncio ufficiale)
- TechCrunch — Microsoft launches its first cyber model and a new agentic cybersecurity system
- Help Net Security — Microsoft unveils MAI-Cyber-1-Flash, promises cybersecurity AI at half the cost
- Axios — Microsoft unveils new cyber model, agentic security tools to fight hackers