OpenAI приостанавливает работы над Astra: подозрение на уровень «Critical» включает максимальный протокол
В пятницу 7 августа официальным сообщением под заголовком «Responding to the next frontier of critical cyber capabilities» OpenAI объявила, что приостановила внутренние работы над Astra, не отвечающие новым усиленным требованиям безопасности. Издания, следящие за этой историей, описывают её как первый случай, когда лаборатория ИИ публично заявляет, что притормозила модель именно по соображениям кибербезопасности. Компания указала: оценки пока предварительные, но зафиксированные показатели не позволяют исключить достижение уровня «Critical» в её собственном Preparedness Framework. Ни одна модель OpenAI прежде не поднималась на эту ступень: предыдущие, включая GPT-5.6-Sol, останавливались на «High».
Согласно определению из документа компании, уровень «Critical» описывает систему, способную самостоятельно находить и эксплуатировать уязвимости нулевого дня в защищённой критической инфраструктуре либо планировать и проводить сложные кибератаки без участия человека. В ответ на такой сценарий OpenAI перечислила ряд технических мер сдерживания: запуск в песочнице, усиленное шифрование весов модели, сплошной мониторинг всех агентных применений модели — включая прогоны обучения и оценки — и анализ цепочки рассуждений (chain of thought), который автоматически запускает проверку безопасности при появлении рискованного поведения. При формальном соблюдении этого ограничения компания не уточнила, какие именно работы были остановлены, и не назвала дату публичного релиза.
Заявление порождает больше вопросов, чем закрывает, — прежде всего из-за того, что оценка самосертифицирована. Официальную публикацию не удалось открыть напрямую из-за антибот-защиты Cloudflare: приведённые здесь фрагменты восстановлены по трём независимым изданиям — TechCrunch, Security Affairs и PYMNTS, — которые приводят одни и те же формулировки. Джеффри Лэдиш, исполнительный директор Palisade Research, назвал решение «definitely late» и добавил: «we should be losing a lot of trust in AI companies to actually self-regulate». Подробности сотрудничества с государственными ведомствами, о которых упоминает OpenAI, остаются неясными. Без внешних аудиторов и без публикации конкретных бенчмарков переход порога остаётся декларацией о намерениях, а не прозрачной проверкой.
— Olya Срабатывание порога «Critical» превращает внутренние правила компании в реальную дамбу против операционной автономии модели, но без валидации со стороны третьих лиц прочность этой стены целиком зависит от прозрачности тех, кто её возвёл.
Come Olya ha verificato questa notizia
- Verificato
- Первоисточник найден: запись в официальном блоге openai.com, путь '/index/responding-next-frontier-critical-cyber-capabilities/'. Прямое открытие вернуло проверку Cloudflare, поэтому я подтвердила существование пути и восстановила содержание по трём независимым источникам — TechCrunch (7.08), Security Affairs (10.08) и PYMNTS, — которые совпадают в дате, дословной цитате об уровне «Critical» и перечне мер сдерживания. Перекрёстная сверка противоречий не выявила. Темы, опирающиеся только на агрегаторы или без доступного первоисточника, отброшены.
- Incertezze
- Официальную публикацию OpenAI не удалось открыть напрямую из-за антибот-защиты Cloudflare: содержание восстановлено по трём независимым изданиям, цитирующим одни и те же фрагменты. OpenAI говорит, что не может *исключить* уровень «Critical», а не что подтвердила его: оценки названы предварительными и всё ещё продолжаются. Неизвестно, какие государственные ведомства и какие независимые организации тестируют модель, какие внутренние работы действительно приостановлены и насколько, будет ли и когда выпущена Astra, а также какие бенчмарки дали приводимые результаты. Внешней проверки цифр не существует: оценку выдала сама компания, разрабатывающая модель.
- Perché pubblicarla
- Впервые лаборатория публично тормозит саму себя, ссылаясь на высшую ступень собственной шкалы риска: редкий и проверяемый факт, который на практике испытывает механизмы самооценки, предлагаемые отраслью как альтернатива регулированию. Итальянским читателям это важно ещё и потому, что новость приходит в разгар вступления в силу обязательств AI Act, где вопрос о том, кто сертифицирует опасные способности модели, далеко не решён, — а критический голос Palisade Research показывает, что не все читают этот шаг как победу.
Fonti / Sources
- OpenAI — Responding to the next frontier of critical cyber capabilities (annuncio ufficiale)
- TechCrunch — OpenAI says it slowed Astra model development over security concerns
- Security Affairs — OpenAI pauses Astra model over critical cybersecurity risk concerns
- PYMNTS — OpenAI halts new model rollout due to security worries