ChatGPT Images 2.5: швидше, але дані про безпеку незначущі
За кілька днів після анонсу GPT-6 Astra, 8 вересня 2026 року, OpenAI представила ChatGPT Images 2.5 — нову модель генерації зображень, доступну в ChatGPT, ChatGPT Work і Codex. Для розробників пропозиція в API роздвоюється: GPT-Image-2.5 Flare встановлено за замовчуванням і зорієнтовано на швидкість (задокументовано знімок gpt-image-2.5-flare-2026-09-08), а GPT-Image-2.5 Sunburst націлено на точний контроль і редагування. Оновлення додає інструмент Sketch, який дає змогу малювати просто в ChatGPT, щоб скерувати генерацію, шаблони для афіш і мерчу, а також точкові коментарі до фрагментів зображення для адресних правок. За заявленого обсягу понад 3 мільярди зображень на тиждень на платформі та через API компанія повідомляє про зниження затримки до 50% проти Images 2.0 у найкращому випадку: цифра з офіційного анонсу походить від самої компанії, а не від незалежних сторонніх тестів.
Щодо вартості API, прайс встановлює 5 доларів за мільйон токенів текстового вводу (1,25 у разі кешу), 8 доларів за ввід зображень (2 у кеші) і 30 доларів за мільйон токенів на виході — однаково для Flare і Sunburst. Оскільки підрахунок токенів відрізняється від попередньої моделі, а калькулятора на зображення немає, фактичну суму за одну генерацію наперед визначити неможливо. У частині безпеки автоматична змагальна оцінка, наведена в системній картці, показує частку небезпечного контенту, показаного користувачеві, на рівні 1,09% для Sunburst і 1,41% для Flare проти 1,64% в Images 2.0. Втім, той самий документ OpenAI прямо визнає, що жодна з цих різниць не долає поріг статистичної значущості p менше ніж 0,05, і нагадує, що тести спираються на фіксований набір, а автоматичні мітки можуть містити помилки.
Звіт Deployment Safety Hub визнає й те, що зросла реалістичність моделі може сприяти переконливішим дипфейкам про реальних людей, місця чи події. Проти таких порушень правил OpenAI застосовує фільтри на рівні промпта та зображення, доповнені метаданими C2PA і невидимим водяним знаком SynthID від Google DeepMind. За Preparedness Framework ані Flare, ані Sunburst не перетинають порогів ризику Bio High чи Cyber High, хоча компанія з обережності зберігає запобіжники, передбачені для високих біологічних спроможностей.
Три знаки після коми різниці у внутрішньому тесті не роблять модель безпечнішою, і першою про це каже сама OpenAI. Головною новиною лишається заявлене компанією скорочення часу очікування, до 50% у найкращому випадку. А питання відкрите: чи витримають фільтри, коли зображення дедалі важче відрізнити від дійсності.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я прочитала офіційну системну картку на deploymentsafety.openai.com (домен OpenAI): звідти взято відсотки щодо безпеки, примітку про статистичну значущість і фрази про реалістичність та дипфейки. Документація API на developers.openai.com підтверджує ціни за мільйон токенів, ендпоїнти та знімок від 08.09.2026. Як незалежні підтвердження відкрила 9to5Mac (8 вересня 2026) та Unite.AI: дата, назви двох моделей API, функції для користувача й цитата про затримку. Сторінка анонсу на openai.com відповіла нашому автоматичному доступу кодом HTTP 403: жоден факт статті на неї не спирається. Дані про вивід у 4K відкинуто — вони є лише в платних стрічках пресрелізів.
- Incertezze
- Зменшення частки показаного небезпечного контенту (з 1,64% до 1,09%/1,41%) сама OpenAI називає статистично незначущим: можна сказати, що нова модель не гірша на застосованому тесті, але не що вона безпечніша. Усі цифри щодо безпеки походять із внутрішнього змагального тесту на фіксованому наборі, з автоматичним маркуванням, хибність якого компанія визнає; незалежних перевірок немає. Мінус 50% затримки — це заява постачальника, а не вимірювання третьої сторони; порівняння швидкості, наведені в анонсі, походять від комерційних партнерів. Без калькулятора на зображення і з підрахунком токенів, відмінним від GPT Image 2, реальна вартість однієї генерації наперед не визначається. Твердження про вивід у 4K, що ходять платними сайтами пресрелізів, офіційно не підтверджені. Перевірити, наскільки C2PA і SynthID витримують перестиснення, скриншоти чи видалення метаданих, неможливо.
- Perché pubblicarla
- Це реліз флагманської моделі з повною та перевірюваною технічною й безпековою документацією, тож про нього можна розповісти без опертя на чутки. А головне — це хрестоматійний випадок критичного читання цифр: компанія публікує покращення метрик безпеки і в тому самому документі заявляє, що покращення статистично незначуще, водночас визнаючи, що більша реалістичність робить дипфейки переконливішими. Читачеві потрібен хтось, хто відокремить виміряне від задекларованого, надто з огляду на вимоги AI Act щодо прозорості синтетичного контенту. До того ж тема генерації зображень ще не висвітлена в архіві.