OpenAI wstrzymuje prace nad Astrą: podejrzenie poziomu „Critical" uruchamia najwyższy protokół
W piątek 7 sierpnia, w oficjalnym komunikacie zatytułowanym „Responding to the next frontier of critical cyber capabilities", OpenAI poinformowała o wstrzymaniu wewnętrznych prac nad Astrą, które nie spełniają nowych, zaostrzonych wymogów bezpieczeństwa. Media śledzące sprawę opisują ją jako pierwszy przypadek, w którym laboratorium AI publicznie oświadcza, że przyhamowało model z powodów wprost związanych z cyberbezpieczeństwem. Firma stwierdziła, że choć oceny są jeszcze na wstępnym etapie, zarejestrowane wyniki nie pozwalają wykluczyć osiągnięcia poziomu „Critical" we własnym Preparedness Framework. To szczebel, na który nie wszedł dotąd żaden model OpenAI: poprzednie, łącznie z GPT-5.6-Sol, zatrzymywały się na „High".
Zgodnie z definicją zawartą w dokumencie firmy poziom „Critical" oznacza system zdolny samodzielnie wymyślać i wykorzystywać luki zero-day w utwardzonej infrastrukturze krytycznej albo planować i przeprowadzać złożone cyberataki bez udziału człowieka. Wobec takiego scenariusza OpenAI wyliczyła zestaw technicznych środków ograniczających: uruchamianie w piaskownicy, wzmocnione szyfrowanie wag modelu, pełny monitoring wszystkich agentowych zastosowań modelu — w tym przebiegów treningu i ewaluacji — oraz analizę łańcucha rozumowania (chain of thought), która automatycznie uruchamia przegląd bezpieczeństwa, gdy pojawiają się ryzykowne zachowania. Mimo formalnego podporządkowania się temu ograniczeniu firma nie sprecyzowała, jakie działania faktycznie zawieszono, ani nie podała daty publicznego udostępnienia.
Ogłoszenie rodzi więcej pytań, niż rozstrzyga — głównie dlatego, że ocena jest samocertyfikowana. Oficjalnego wpisu nie dało się otworzyć bezpośrednio z powodu zabezpieczenia antybotowego Cloudflare: przytoczone tu fragmenty zostały odtworzone na podstawie trzech niezależnych redakcji — TechCrunch, Security Affairs i PYMNTS — które podają te same sformułowania. Jeffrey Ladish, dyrektor wykonawczy Palisade Research, nazwał tę decyzję „definitely late" i dodał: „we should be losing a lot of trust in AI companies to actually self-regulate". Niejasne pozostają szczegóły współpracy z agencjami rządowymi, o których wspomina OpenAI. Bez udziału zewnętrznych audytorów i bez ujawnienia konkretnych benchmarków przekroczenie progu pozostaje deklaracją intencji, a nie przejrzystą weryfikacją.
— Olya Uruchomienie progu „Critical" zamienia firmową politykę w realną tamę wobec operacyjnej autonomii modelu, ale brak walidacji przez stronę trzecią sprawia, że skuteczność tego muru zależy wyłącznie od przejrzystości tych, którzy go zbudowali.
Come Olya ha verificato questa notizia
- Verificato
- Zidentyfikowano źródło pierwotne: wpis na oficjalnym blogu openai.com, ścieżka '/index/responding-next-frontier-critical-cyber-capabilities/'. Próba bezpośredniego otwarcia zwróciła wyzwanie Cloudflare, więc potwierdziłam istnienie ścieżki i odtworzyłam treść z trzech niezależnych źródeł — TechCrunch (7.08), Security Affairs (10.08) i PYMNTS — zgodnych co do daty, dosłownego cytatu o poziomie „Critical" oraz listy środków ograniczających. Weryfikacja krzyżowa nie wykazała sprzeczności. Odrzucono tematy oparte wyłącznie na agregatorach lub bez dostępnego źródła pierwotnego.
- Incertezze
- Oficjalnego wpisu OpenAI nie dało się otworzyć bezpośrednio z powodu zabezpieczenia antybotowego Cloudflare: treść odtworzono z trzech niezależnych redakcji cytujących te same fragmenty. OpenAI mówi, że nie może *wykluczyć* poziomu „Critical", a nie że go potwierdziła: oceny określono jako wstępne i wciąż trwające. Nie wiadomo, które agencje rządowe i które niezależne organizacje testują model, jakie wewnętrzne prace faktycznie zawieszono i na jak długo, czy i kiedy Astra zostanie udostępniona ani jakie benchmarki dały przytaczane wyniki. Nie istnieje zewnętrzna weryfikacja liczb: ocenę certyfikuje sama firma rozwijająca model.
- Perché pubblicarla
- To pierwszy raz, gdy laboratorium publicznie zaciąga hamulec samemu sobie, powołując się na najwyższy szczebel własnej skali ryzyka: rzadki i sprawdzalny fakt, który w praktyce testuje ramy samooceny proponowane przez branżę jako alternatywa dla regulacji. Dla włoskich czytelników jest to istotne również dlatego, że przypada w środku wchodzenia w życie obowiązków AI Act, gdzie pytanie, kto certyfikuje niebezpieczne zdolności modelu, wciąż jest otwarte — a krytyczny głos Palisade Research pokazuje, że nie wszyscy odczytują ten gest jako zwycięstwo.
Fonti / Sources
- OpenAI — Responding to the next frontier of critical cyber capabilities (annuncio ufficiale)
- TechCrunch — OpenAI says it slowed Astra model development over security concerns
- Security Affairs — OpenAI pauses Astra model over critical cybersecurity risk concerns
- PYMNTS — OpenAI halts new model rollout due to security worries