World Labs представила Atlas: ставка на просторові моделі — заявлені цифри й відкладена перевірка
1 вересня 2026 року World Labs — стартап, співзаснований 2024 року Фей-Фей Лі, колишньою директоркою Stanford AI Lab, — представив у своєму офіційному блозі Atlas, описаний як «an omni model that we pretrained from scratch to natively operate on text, images, video, and 3D». Архітектура — це мультимодальний авторегресійний дифузійний трансформер, навчений як модель зі спрямленим потоком (rectified flow): вхідні дані закріплюються у спільному тривимірному просторовому контексті, а не зшиваються перехідними шарами між окремими системами. Компанія, яка в лютому 2026 року залучила 1 мільярд доларів у раунді за участі Autodesk, NVIDIA та AMD, заявляє, що Atlas генерує до хвилини відео в роздільності 1440p, керує траєкторією камери через геометричні вхідні дані й повертає результат у вигляді хмар точок та 3D Gaussian splats — того самого представлення, що й Marble, єдиного продукту компанії на ринку з листопада 2025 року.
Щодо порівнянь із керуванням камерою офіційне оголошення посилається на тести сторонніх оцінювачів-людей: Atlas обрали в 75 % випадків проти MiniMax H3, у 81 % — проти Gemini Omni Flash, у 86 % — проти Happy Horse 1.1, у 93 % — проти FLUX 3 і в 94 % — проти Seedance 2.5. Втім, самі порівняння добирає та проводить World Labs, передаючи оцінювання зовнішнім людям («Third-party human raters judge which model better follows the intended camera path»), але не розкриваючи ні їхньої кількості, ні промптів, ні критеріїв. Для тривимірної реконструкції видання The Decoder наводить заявлену медіанну похибку 25,3 — найнижче значення серед моделей, які World Labs обрала для порівняння. Однак у вхідних даних виявляються розбіжності: блог компанії говорить про обсяг від кількох одиниць до понад сотні зображень (з достовірною реконструкцією вже за двома-трьома знімками з рівня землі), тоді як галузева преса вказує діапазон від одного до кількох десятків зображень.
Немає ні наукової статті, ні model card, ні публікації на arXiv, ні ваг моделі, ні вихідного коду: неперевірними лишаються загальна кількість параметрів, склад навчальних даних, вартість навчання та реальна користь системи в таких галузях, як робототехніка й симуляція. Atlas — це не комерційний запуск, а програма раннього доступу для відібраних партнерів за заявкою, без жодних вказівок щодо цін, публічних API чи термінів загальної доступності, хоча World Labs і стверджує, що «Atlas will power future versions of Marble and other products from World Labs».
Перехід від генераторів кадрів до моделей світу показує, куди галузь спрямовує ресурси: завдання вже не в тому, щоб створювати ефектні зображення, а в тому, щоб вимірювати тривимірний простір. Доки не вийдуть статті, model card і ваги, від Atlas лишається те, що World Labs каже про Atlas. Справжню міру дадуть ті, хто користуватиметься ним поза демонстраціями, — якщо і коли доступ відкриють.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Офіційне оголошення на worldlabs.ai/blog/atlas прочитано у два заходи, другий — заради дослівних формулювань про відсотки, ранній доступ і зв'язок із Marble: звідти взято архітектуру, хвилину в 1440p, Gaussian splats і п'ять порівнянь. Незалежне підтвердження — The Decoder (там-таки медіанна похибка 25,3 і хронологія компанії) та SiliconANGLE, обидва датовані днем запуску. Сума фінансування — зі статті TechCrunch від 18 лютого 2026 року. Перевірено, що оголошення не супроводжується ні статтею, ні публікацією на arXiv, ні model card, ні кодом: саме тому цифри лишаються самозаявленими. radiancefields.com відхилено як першоджерело (там написано «MipMap H3» там, де в офіційному оголошенні «MiniMax H3»), The Information — через платний доступ.
- Incertezze
- Жодна цифра не піддається перевірці ззовні: немає статті, model card, ваг, коду й незалежних бенчмарків, а порівняння добирає та проводить сама World Labs — методом (перевага оцінювачів-людей щодо відповідності заданій траєкторії камери), який описано, але не задокументовано щодо кількості оцінювачів, промптів і критеріїв. Не названо ні кількості параметрів, ні даних і вартості навчання, ні ціни, ні API, ні дати публічної доступності. Щодо мінімальної та максимальної кількості вхідних зображень вторинні джерела розходяться з оголошенням. Дата — 1 вересня 2026 року за офіційним оголошенням і SiliconANGLE, 2 вересня за The Decoder. Реальна користь у робототехніці та симуляції поза опублікованими демонстраціями не виміряна.
- Perché pubblicarla
- Це оголошення передової моделі в категорії, якої портал ще не висвітлював, — моделі світу, — і походить воно від компанії, яку фінансують NVIDIA, AMD і Autodesk, тобто з усім ланцюгом заліза та CAD, зацікавленим у результаті. Але новина важлива передусім розривом між тим, що заявлено, і тим, що можна перевірити: п'ять відсоткових перемог над суперниками, обраними всередині компанії, жодної статті, жодних ваг, жодної ціни, доступ лише за запрошенням. Це саме той тип оголошення, який портал може розповісти добре, тримаючи факти («World Labs заявляє») окремо від доказів (зовнішніх щодо лабораторії поки що немає).