摘要由 AI 生成
随着 OpenAI 发布视频生成模型 Sora,国内 AI 从业者态度由质疑转向尝试复现。出门问问创始人兼 CEO 李志飞通过研读 32 篇论文及技术报告,拼凑出完整技术架构图。他认为 Sora 并非原理突破,核心冲击在于生成视频的时长、质量与一致性,证实了 Transformer 和规模法则在视频领域的适用性,推测其处于类似 GPT-2 至 GPT-3 的过渡阶段。李志飞指出,由于 OpenAI 未公开编解码器具体实现及长视频生成机制等细节,国内公司难以复现 Sora,且面临比 ChatGPT 更严峻的视频版权合规挑战。目前 OpenAI 团队明确表示不会很快发布 Sora,其真实能力可能高于现有演示版本。
关键实体KEY ENTITIES
ChatGPTMetaOpenAISora李志飞
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
信号强度SIGNALS
关键词热度
- OpenAI1
- 李志飞1
- ChatGPT1
- Sora1
- Meta1
全部报道(1)SOURCES
↗
甲
甲子光年
zh
2026-09-04 08:00
国内 AI 从业者正从质疑转向尝试复现 OpenAI 发布的视频生成模型 Sora。李志飞,出门问问创始人兼 CEO,已独立研读 OpenAI 提供的 32 篇相关论文及一份技术报告,拼凑出完整的 Sora 技术架构图。李志飞认为,Sora 并非原理突破,其核心冲击在于生成视频的时长、高质量与一致性;他推测 Sora 应类比 GPT-2 至 GPT-3 的过渡阶段,证明了 Transformer 和规模法则在视频领域的适用性。针对国内公司追赶难度,李志飞指出 Sora 因技术细节未公开(如编解码器具体实现、60 秒视频生成机制)而难以复现,且面临比 ChatGPT 更严峻的视频版权合规挑战。目前 OpenAI 团队明确表示不会很快发布 Sora,其真实能力可能高于现有 Demo。