李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界
斯坦福大学计算机科学家李飞飞团队正式发布了首个多模态世界模型 Atlas。该模型采用从零开始的预训练方式,仅需几张图片即可构建出完整的世界视图。Atlas 能够理解图像中的物体、场景及空间关系,并支持生成新的图像内容。这一成果标志着人工智能在视觉与语言深度融合领域取得重大突破,为后续开发通用人工智能系统奠定了重要基础。
EVENT DOSSIER
2026 年 9 月 3 日,斯坦福大学计算机科学家李飞飞团队正式发布首个多模态世界模型 Atlas。该模型采用从零开始的预训练方式,仅需几张图片即可构建出包含物体、场景及空间关系的完整世界视图。Atlas 支持理解图像内容并生成新的图像,标志着人工智能在视觉与语言深度融合领域取得重大突破,为后续开发通用人工智能系统奠定了重要基础。
斯坦福大学计算机科学家李飞飞团队正式发布了首个多模态世界模型 Atlas。该模型采用从零开始的预训练方式,仅需几张图片即可构建出完整的世界视图。Atlas 能够理解图像中的物体、场景及空间关系,并支持生成新的图像内容。这一成果标志着人工智能在视觉与语言深度融合领域取得重大突破,为后续开发通用人工智能系统奠定了重要基础。