worldlabs.ai via Hacker News

World Labs dévoile Atlas, un omni-modèle vidéo 1440p et 3D

5 médias qui couvrent ce sujet

TL;DR

  • Atlas unifies video generation, 3D reconstruction, and robot-camera simulation in one model, accepting up to six reference images and a camera path.
  • Autodesk's $200M anchor stake gives Atlas a direct industrial distribution channel that Runway and Nvidia Cosmos cannot quickly assemble.
  • No paper, model card, parameter count, or pricing accompanied the launch; early access is limited to unnamed partners only.

Atlas génère jusqu'à une minute de vidéo en 1440p à partir d'une ou plusieurs images, avec un contrôle caméra au pixel près. World Labs a mis le modèle en ligne le 1er septembre 2026.

"Atlas is an omni model that we pretrained from scratch to natively operate on text, images, video, and 3D", écrit l'équipe dans son billet. La description technique est aussi frontale: "Atlas is a multimodal autoregressive diffusion transformer: all inputs are combined into a shared spatial context." Le même modèle reconstruit des scènes réelles à partir d'une à plusieurs dizaines d'images, produit des nuages de points ou des 3D Gaussian splats, et alimente des workflows real-to-sim pour la robotique à partir de deux à cinq vues caméra.

Sur la génération vidéo avec contrôle caméra, World Labs publie des tests de préférence humaine où Atlas est choisi 81% du temps face à Gemini Omni Flash, 93% face à FLUX 3, 94% face à Seedance 2.5 et 75% face à MiniMax H3. Sur la reconstruction 3D, le laboratoire revendique une erreur absolue-relative moyenne de 25,3, contre 28,7 pour Pi3X, le meilleur système open-source cité. "Despite its generality, Atlas outperforms the best specialized open-source reconstruction models", précise le billet.

Le billet ne dit rien du nombre de paramètres, du compute d'entraînement ni du protocole exact des évaluations humaines. L'accès reste en early access sur partenariats via un formulaire, et Atlas alimentera les prochaines versions de Marble, l'outil de scènes 3D maison. La sortie s'ajoute aux 25 sujets de génération vidéo que nous avons suivis ces trois derniers mois, après Seedance 2.5 et JoyAI-Video-Edit cet été.

Ce qu'en disent les autres médias

Couverture consolidée 24h après publication

  1. SiliconANGLE Lire →

    Robotics focus: covers how developers use smartphone cameras to reconstruct physical spaces as 3D simulations for safe robot training, plus benchmarking and early user reaction.

  2. Implicator Lire →

    Investigative: no paper, no pricing, unnamed partners, and Atlas got native camera trajectories in benchmarks while competitors received only text descriptions.

    No paper, arXiv entry, model card or code accompanied the launch. World Labs disclosed no parameter count or training-compute figure.
  3. Crypto Briefing Lire →

    Funding and lineage detail: $1.23B total raised, AMD/NVIDIA/Fidelity backing, roadmap traced from Marble (Nov 2025) through World API and SceniX acquisition.

    Atlas can produce pixel-perfect, camera-controlled imagery and video at resolutions up to 1440p, running for durations of up to one minute.
  4. Superpower Daily Lire →

    Technical robotics bridge: Atlas generates RGB and depth readings for simulated robot cameras across rigid, articulated, and deformable objects, an angle most outlets skip.

    Atlas accepts one to six reference images and a manually designed camera path for up to one minute of 1440p video.

Shared on Bluesky by 2 AI experts