摘要由 AI 生成
国产视频深度推理模型VLX-VR近日正式发布,该模型具备视频内容理解与推理能力,适用于智能视频分析与决策支持场景。
关键实体KEY ENTITIES
Google DeepMindMINERVAOmAI联汇VLX-VR哥伦比亚大学
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
信号强度SIGNALS
关键词热度
- OmAI联汇1
- VLX-VR1
- Google DeepMind1
- 哥伦比亚大学1
- MINERVA1
全部报道(1)SOURCES
↗
9 月 1 日,杭州联汇科技股份有限公司正式发布视频深度推理模型 VLX-VR。该模型在 Google DeepMind 与哥伦比亚大学联合推出的视频推理基准 MINERVA 上,以 78.8% 的视频问答准确率登顶榜首,超越谷歌 Gemini 3.5、OpenAI GPT-4.1 等国际旗舰模型。VLX-VR 推理逻辑一致性达 96.2%,且在 5 分钟至 15 分钟以上视频时长区间准确率随时长增加不降反升,最高达 80.92%。此次发布是 OmAI 联汇技术积累的延续,此前该公司于 2025 年 2 月在 GitHub 开源视觉推理模型 VLM-R1,首次将 DeepSeek-R1 的强化学习推理框架引入视觉领域。视频推理能力作为物理 AI 感知世界的基础能力,其进展正值中国机器人产业标准化进程加速阶段。