World Labs stellt Atlas vor: die Wette auf räumliche Modelle — viele Angaben, keine Überprüfung
Am 1. September 2026 hat World Labs — das 2024 von Fei-Fei Li, der früheren Direktorin des Stanford AI Lab, mitgegründete Start-up — über den eigenen Blog Atlas vorgestellt, beschrieben als „an omni model that we pretrained from scratch to natively operate on text, images, video, and 3D“. Die Architektur ist ein multimodaler autoregressiver Diffusions-Transformer, trainiert als Rectified-Flow-Modell: Die Eingaben werden in einem gemeinsamen dreidimensionalen räumlichen Kontext verankert, statt über Zwischenschichten getrennter Systeme miteinander verbunden zu werden. Das Unternehmen, das im Februar 2026 in einer Finanzierungsrunde unter Beteiligung von Autodesk, NVIDIA und AMD eine Milliarde Dollar eingesammelt hat, erklärt, Atlas erzeuge bis zu einer Minute Video in 1440p, steuere die Kamerabahn über geometrische Eingaben und liefere die Ausgabe als Punktwolken und 3D Gaussian Splats — dieselbe Darstellung wie bei Marble, dem einzigen Produkt, das das Unternehmen seit November 2025 auf dem Markt hat.
Zu den Vergleichen bei der Kamerasteuerung nennt die offizielle Ankündigung Tests durch externe menschliche Bewerterinnen und Bewerter, denen zufolge Atlas gegenüber MiniMax H3 zu 75 % bevorzugt wurde, gegenüber Gemini Omni Flash zu 81 %, gegenüber Happy Horse 1.1 zu 86 %, gegenüber FLUX 3 zu 93 % und gegenüber Seedance 2.5 zu 94 %. Ausgewählt und durchgeführt werden die Vergleiche jedoch von World Labs selbst, das die Beurteilung an externe Personen abgibt („Third-party human raters judge which model better follows the intended camera path“), ohne Anzahl der Bewertenden, Prompts und Kriterien offenzulegen. Für die dreidimensionale Rekonstruktion berichtet das Fachmedium The Decoder von einem angegebenen Medianfehler von 25,3 — dem niedrigsten Wert unter den von World Labs für den Vergleich ausgewählten Modellen. Bei den Eingangsdaten treten allerdings Abweichungen auf: Während der Unternehmensblog von wenigen bis über hundert Bildern spricht (mit originalgetreuen Rekonstruktionen schon aus zwei oder drei Fotos auf Bodenhöhe), nennen Analysen der Fachpresse eine Spanne von einem bis zu mehreren Dutzend Bildern.
Es fehlen ein wissenschaftliches Paper, eine Model Card, ein Eintrag auf arXiv, die Modellgewichte und der Quellcode: Damit bleiben die Gesamtzahl der Parameter, die Zusammensetzung der Trainingsdaten, die Trainingskosten und der tatsächliche Nutzwert des Systems in Bereichen wie Robotik und Simulation nicht überprüfbar. Atlas ist kein kommerzieller Start, sondern ein Programm für frühen Zugang für ausgewählte Partner über ein Anmeldeformular, ohne jeden Hinweis auf Kosten, öffentliche APIs oder Zeitpläne für die allgemeine Verfügbarkeit — auch wenn World Labs erklärt: „Atlas will power future versions of Marble and other products from World Labs“.
Der Übergang von Bildgeneratoren zu Weltmodellen zeigt, wohin die Branche ihre Mittel lenkt: Die Aufgabe besteht nicht mehr darin, eindrucksvolle Bilder zu erzeugen, sondern den dreidimensionalen Raum zu vermessen. Solange Paper, Model Cards und Gewichte fehlen, bleibt von Atlas das, was World Labs über Atlas sagt. Das eigentliche Maß liefern jene, die es außerhalb der Demos einsetzen — falls und sobald der Zugang geöffnet wird.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Die offizielle Ankündigung auf worldlabs.ai/blog/atlas in zwei Durchgängen gelesen, den zweiten für die wörtlichen Formulierungen zu Prozentwerten, frühem Zugang und Verhältnis zu Marble: Daher stammen Architektur, die Minute in 1440p, die Gaussian Splats und die fünf Vergleiche. Unabhängig bestätigt bei The Decoder (dort auch der Medianfehler von 25,3 und die Unternehmenschronologie) und bei SiliconANGLE, beide vom Tag des Starts. Die Finanzierungsangabe stammt aus dem TechCrunch-Artikel vom 18. Februar 2026. Geprüft, dass die Ankündigung ohne Paper, arXiv-Eintrag, Model Card und Code kommt: Deshalb bleiben die Zahlen Eigenangaben. radiancefields.com als Primärquelle verworfen (dort steht „MipMap H3“, wo die offizielle Mitteilung „MiniMax H3“ schreibt), The Information wegen der Bezahlschranke.
- Incertezze
- Keine Zahl ist von außen überprüfbar: Es fehlen Paper, Model Card, Gewichte, Code und unabhängige Benchmarks, und die Vergleiche wählt und führt World Labs selbst durch — mit einer Methode (Präferenz menschlicher Bewertender bei der Treue zur vorgesehenen Kamerabahn), die beschrieben, aber hinsichtlich Anzahl der Bewertenden, Prompts und Kriterien nicht dokumentiert ist. Parameterzahl, Trainingsdaten und -kosten, Preis, APIs und ein Datum für die allgemeine Verfügbarkeit werden nicht genannt. Bei der Mindest- und Höchstzahl der Eingangsbilder weichen Sekundärquellen von der Ankündigung ab. Als Datum nennen die offizielle Mitteilung und SiliconANGLE den 1. September 2026, The Decoder den 2. September. Der reale Nutzen in Robotik und Simulation bleibt außerhalb der veröffentlichten Demos ungemessen.
- Perché pubblicarla
- Es ist die Ankündigung eines Spitzenmodells in einer Kategorie, die das Portal noch nicht behandelt hatte — Weltmodelle —, und sie kommt von einem Unternehmen, das von NVIDIA, AMD und Autodesk finanziert wird, also mit der gesamten Hardware- und CAD-Kette am Ergebnis interessiert. Vor allem aber zählt die Nachricht wegen des Abstands zwischen dem Behaupteten und dem Überprüfbaren: fünf Prozentsiege über selbst ausgewählte Gegner, kein Paper, keine Gewichte, kein Preis, Zugang nur auf Einladung. Genau die Art von Ankündigung, die das Portal gut erzählen kann, indem es Fakten („World Labs erklärt“) von Belegen trennt (bislang keine, die von außerhalb des Labors kämen).