World Labs đã trình diễn trí thông minh không gian của mình bằng cách mô phỏng một chuyến đi bộ qua trụ sở Voyager cho Nvidia. Mô hình này sử dụng 32 hình ảnh đầu vào để tạo ra một bản tái tạo 3D cho phép điều khiển camera chính xác đến từng pixel và trải nghiệm bay qua khuôn viên. AI đã được huấn luyện trước từ đầu trên GPU Blackwell.

Atlas tích hợp văn bản, hình ảnh, video và tài sản 3D vào một ngữ cảnh không gian chung để mô phỏng môi trường và tái tạo cảnh. Bản trình diễn được xây dựng trên nền tảng mở của Nvidia, cho phép người dùng chọn đường đi và xem các khu vực cụ thể của công viên trong thời gian thực.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@nvidiaai“Atlas brings text, images, video, and 3D into a shared spatial context, enabling one model to generate new views, reconstruct scenes, and simulate worlds”x.com
  2. SUPPORT@nvidia“From just 32 images of our campus, World Labs’ Atlas model created a new way for you to move through our park in real time”x.com
  3. SUPPORT@drfeifei“From 32 input images to real-time flight through @nvidia's Voyager headquarters”x.com
  4. SOURCEmarketbrief.now
Bản Markdown