ChatGPT Images 2.5: быстрее, но данные о безопасности незначимы
Через несколько дней после анонса GPT-6 Astra, 8 сентября 2026 года, OpenAI представила ChatGPT Images 2.5 — новую модель генерации изображений, доступную в ChatGPT, ChatGPT Work и Codex. Для разработчиков предложение в API раздваивается: GPT-Image-2.5 Flare выставлена по умолчанию и рассчитана на скорость (задокументирован снапшот gpt-image-2.5-flare-2026-09-08), а GPT-Image-2.5 Sunburst ориентирована на точный контроль и редактирование. В обновлении появились инструмент Sketch, позволяющий рисовать прямо в ChatGPT, чтобы направлять генерацию, шаблоны для афиш и мерча, а также точечные комментарии к фрагментам изображения для адресных правок. При заявленном объёме свыше 3 миллиардов изображений в неделю на платформе и через API компания указывает снижение задержки до 50% по сравнению с Images 2.0 в лучшем случае: цифра из официального анонса исходит от самой компании, а не от независимых сторонних тестов.
По стоимости API прайс устанавливает 5 долларов за миллион токенов текстового ввода (1,25 при кешировании), 8 долларов за ввод изображений (2 при кешировании) и 30 долларов за миллион токенов на выходе — одинаково для Flare и Sunburst. Поскольку подсчёт токенов отличается от предыдущей модели, а калькулятора на изображение нет, фактическую сумму за одну генерацию заранее определить нельзя. Что до безопасности, автоматическая состязательная проверка, описанная в системной карте, даёт долю небезопасного контента, показанного пользователю, в 1,09% для Sunburst и 1,41% для Flare против 1,64% у Images 2.0. При этом тот же документ OpenAI прямо признаёт, что ни одна из этих разниц не проходит порог статистической значимости p менее 0,05, и напоминает, что тесты опираются на фиксированный набор, а автоматическая разметка может содержать ошибки.
Отчёт Deployment Safety Hub признаёт и то, что возросшая реалистичность модели способна помочь созданию более убедительных дипфейков с реальными людьми, местами или событиями. Против таких нарушений правил OpenAI применяет фильтры на уровне промпта и изображения, дополняя их метаданными C2PA и невидимым водяным знаком SynthID от Google DeepMind. По Preparedness Framework ни Flare, ни Sunburst не переходят пороги риска Bio High и Cyber High, хотя компания в качестве меры предосторожности сохраняет защиту, предусмотренную для высоких биологических возможностей.
Три знака после запятой разницы во внутреннем тесте не делают модель безопаснее, и первой об этом говорит сама OpenAI. Главная новость по-прежнему — заявленное компанией сокращение ожидания, до 50% в лучшем случае. А вопрос остаётся открытым: выдержат ли фильтры, когда изображения всё труднее отличить от реальности.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я прочитала официальную системную карту на deploymentsafety.openai.com (домен OpenAI): оттуда взяты проценты по безопасности, примечание о статистической значимости и фразы о реалистичности и дипфейках. Документация API на developers.openai.com подтверждает цены за миллион токенов, эндпоинты и снапшот от 08.09.2026. В качестве независимых подтверждений открыла 9to5Mac (8 сентября 2026) и Unite.AI: дата, названия двух моделей API, пользовательские функции и цитата о задержке. Страница анонса на openai.com ответила нашему автоматическому доступу кодом HTTP 403: ни один факт статьи на неё не опирается. Данные о выводе в 4K отброшены — они есть только в платных лентах пресс-релизов.
- Incertezze
- Снижение доли показанного небезопасного контента (с 1,64% до 1,09%/1,41%) сама OpenAI называет статистически незначимым: можно сказать, что новая модель не хуже на использованном тесте, но не что она безопаснее. Все цифры по безопасности взяты из внутреннего состязательного теста на фиксированном наборе, с автоматической разметкой, ошибочность которой компания признаёт; независимых проверок нет. Минус 50% задержки — заявление поставщика, а не измерение третьей стороны; сравнения скорости, приведённые в анонсе, исходят от коммерческих партнёров. Без калькулятора на изображение и при подсчёте токенов, отличном от GPT Image 2, реальная стоимость одной генерации заранее не определяется. Утверждения о выводе в 4K, гуляющие по платным сайтам пресс-релизов, официально не подтверждены. Проверить, насколько C2PA и SynthID выдерживают пережатие, скриншоты или удаление метаданных, невозможно.
- Perché pubblicarla
- Это выпуск флагманской модели с полной и проверяемой технической документацией и документацией по безопасности, о нём можно рассказать без опоры на слухи. И главное — это учебный случай критического чтения цифр: компания публикует улучшение метрик безопасности и в том же документе заявляет, что улучшение статистически незначимо, признавая при этом, что возросшая реалистичность делает дипфейки убедительнее. Читателю нужен кто-то, кто отделит измеренное от заявленного, тем более на фоне требований AI Act о прозрачности синтетического контента. К тому же тема генерации изображений в архиве ещё не освещена.