Induction Labs Photon-1: Desktop Simulation, Checkers, and Billiard Physics After One Pretraining
Induction Labs released the Imagination Models architecture and the Photon-1 model, which trains on raw video without action labels. Photon-1 can simulate desktop operations, play checkers, and model billiard physics after a single pretraining phase.
Hầu hết các agent (tác nhân AI) học từ video đều buộc phải biết hành động nào đã dẫn đến từng khung hình cụ thể. Induction Labs cho rằng yêu cầu này chính là nút thắt cổ chai. Tuần trước, công ty đã giới thiệu Imagination Models — một kiến trúc foundation model (mô hình nền tảng) được huấn luyện trước trên video thô mà hoàn toàn không cần nhãn hành động.
Hệ thống thử nghiệm là Photon-1 — một mô hình hỗn hợp chuyên gia thưa (Mixture of Experts - MoE) với tổng cộng 106 tỷ tham số, trong đó chỉ 5 tỷ tham số được kích hoạt (106B-A5B). Sau một chu kỳ huấn luyện trước, mô hình đã thể hiện khả năng mô phỏng hoạt động của desktop máy tính, chơi cờ đam và mô phỏng vật lý của bi-a.
Nguồn: MarkTechPost —
bản gốc
