摘要
事件框架
报道态势
整合时间线(1)
全部报道(2)
摘要由 AI 生成
2026 年 9 月 1 日,DeepSeek 在 Hugging Face 平台开放其 DeepSeek-V4-Flash-Vision-Exp 多模态模型权重。该模型基于 V4-Flash 架构并新增视觉模块,参数量约 3050 亿。官方数据显示,该模型在纯文本任务上与 V4-Flash 持平,但在图像识别、截图文字读取及图表分析等视觉能力上表现优异,在部分多模态 Agent 任务中接近或超越 Claude Opus 4.8,尤其在 ApexBench 和 Chartography 测试中取得相近或超越成绩。然而,在 Terminal Bench 和 DeepSWE 等纯文本能力指标上略有波动。模型支持 JPEG、PNG 等格式,通过缩放控制输入像素及 Token 数量以优化计算成本。目前该模型已同步公开…
关键实体KEY ENTITIES
Anthropic Claude Opus 4.8 DeepSeek Hugging Face V4
事件框架EVENT FRAME
产品发布
DeepSeek
DeepSeek-V4-Flash-Vision-Exp
首款多模态模型权重开源
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
Anthropic × Claude Opus… 1 Anthropic × DeepSeek 1 Anthropic × Hugging Face 1 Claude Opus 4.8 × DeepS… 1 Claude Opus 4.8 × Huggi… 1 DeepSeek × Hugging Face 1
整合时间线UNIFIED TIMELINE
2026-09-01
DS-V4首款多模态模型权重开放,“睁眼”后追上Opus-4.8
DeepSeek 于 8 月 31 日在 Hugging Face 开放 DeepSeek-V4-Flash-Vision-Exp 模型权重,该模型基于 V4-Flash 架构并新增视觉模块,规模约 3050 亿参数。官方称其在纯文本任务…
2 条报道
信号强度SIGNALS
关键词热度
DeepSeek 1
Hugging Face 1
Anthropic 1
Claude Opus 4.8 1
V4 1
全部报道(2)SOURCES
全部
中文
英文
最新发布
最早发布
↗
DeepSeek 于 8 月 31 日在 Hugging Face 开放 DeepSeek-V4-Flash-Vision-Exp 模型权重,该模型基于 V4-Flash 架构并新增视觉模块,规模约 3050 亿参数。官方称其在纯文本任务上与 V4-Flash 持平,能识别照片、读取截图文字及分析图表,并在部分多模态 Agent 任务上接近 Claude Opus 4.8。在 ApexBench、Chartography 等测试中表现相近或超越 Opus-4.8,但 Terminal Bench 和 DeepSWE 等纯文本能力指标略有波动。模型支持 JPEG、PNG 等格式,图片经缩放后总像素约相当于 800×800,每图最多占用 384 个 Token,以控制计算成本。
↗
爱
爱范儿
zh
2026-09-01 08:16
Meta 发布开源 V4 家族首个多模态模型,同步公开模型权重与最小推理代码。该模型旨在实现文本、图像及视频等多模态数据的统一处理,采用 Transformer 架构并引入混合注意力机制以提升效率。项目团队提供了完整的训练脚本和部署指南,支持在主流框架下运行。目前该模型已接入 Hugging Face 平台,开发者可立即下载并进行本地测试或微调。