强的离谱！这个大模型神器已开源，彻底爆了

Python编程 · 公众号 · · 2025-03-13 11:52

正文

潞晨科技正式推出 Open-Sora 2.0 —— 一款全新开源的 SOTA 视频生成模型，仅20万美元（224张GPU）成功训练商业级11B参数视频生成大模型。开发高性能的视频生成模型通常耗资高昂： Meta的视频模型训练需要6000多张GPU卡片，投入数百万美元。在多项关键指标上，它与动辄百万美元训练成本的模型分庭抗礼，全面提升视频生成的可及性与可拓展性。

今天，视频生成领域迎来开源革命！Open-Sora 2.0——全新开源的 SOTA（State-of-the-Art） 视频生成模型正式发布，仅用 20 万美元（224 张 GPU） 成功训练出商业级 11B 参数视频生成大模型，性能直追 HunyuanVideo 和 30B 参数的 Step-Video。权威评测 VBench 及用户偏好测试均证实其卓越表现，在多项关键指标上媲美动辄数百万美元训练成本的闭源模型。此次发布全面开源 模型权重、推理代码 及 分布式训练全流程 ，让高质量视频生成真正触手可及，进一步提升视频生成的可及性与可拓展性。

🔗 GitHub 开源仓库 ： https://github.com/hpcaitech/Open-Sora

1、体验与指标双在线

1.1 震撼视觉：Open-Sora 2.0 Demo 先行

🎥 观看宣传片，体验 Open-Sora 2.0 的强大生成能力

🎥 动作幅度可控： 可根据需求设定运动幅度，以更好地展现人物或场景的细腻动作。

🎥 画质与流畅度 ：提供 720p 高分辨和4 FPS 流畅视频，让最终视频拥有稳定帧率与细节表现。

🎥 支持丰富的场景 ：从乡村景色到自然风光场景，Open-Sora 2.0生成的画面细节与相机运镜都有出色的表现。

1.2、11B 参数规模媲美主流闭源大模型

媲美 HunyuanVideo 和 30B Step-Video ：Open-Sora 2.0 采用 11B 参数规模 ，训练后在 VBench 和人工偏好（Human Preference） 评测上都取得与用高昂成本开发的主流闭源大模型同等水平。
用户偏好评测 ：在视觉表现、文本一致性和动作表现三个评估维度上，Open Sora 在至少两个指标上超越了开源 SOTA HunyuanVideo，以及商业模型 Runway Gen-3 Alpha 等。以小成本获取了好性能。

VBench 指标表现强势 ：根据视频生成权威榜单 VBench 的评测结果，Open-Sora模型的性能进步显著。从Open-Sora 1.2升级到2.0版本后，与行业领先的OpenAI Sora闭源模型之间的性能差距大幅缩小，从之前的 4.52% 缩减至仅 0.69% ，几乎实现了性能的全面追平。此外，Open-Sora 2.0在VBench评测中取得的分数已超过腾讯的HunyuanVideo，以更低的成本实现了更高的性能，为开源视频生成技术树立了全新标杆！

2、实现突破：低成本训练与高效能优化

Open Sora自开源以来，凭借其在视频生成领域的高效与优质表现，吸引了众多开发者的关注与参与。然而，随着项目的深入推进，也面临着高质量视频生成成本居高不下的问题。为解决这些挑战，Open Sora团队展开了一系列卓有成效的技术探索，显著降低了模型训练成本。根据估算，市面上 10B 以上的开源视频模型，动辄需要上百万美元的单次训练成本，而 Open Sora 2.0 将该成本降低了 5-10 倍。

强的离谱！这个大模型神器已开源，彻底爆了

正文

请到「今天看啥」查看全文