商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 昆仑万维正式开源自研视频生成模型 SkyReels-V3

昆仑万维正式开源自研视频生成模型 SkyReels-V3

  发布于2026-08-15 阅读(0)

扫一扫,手机访问

昆仑万维旗下的Skywork AI团队,最近放出了一个重磅开源——SkyReels-V3,一款自研的视频生成大模型。说实话,这年头开源视频模型不算稀奇,但这款模型在架构设计上确实有点东西:它原生支持三大核心功能,而且是统一架构下的模块化组合。

哪三大功能?参考图像生成视频、视频时序延展,以及音频驱动虚拟人。简单说,就是既能拿几张图加一段文字直接生成视频,又能把已有的视频片段无缝拉长或拼接,还能让一张静态人像跟着语音“活”起来——唇形、表情、神态同步,甚至支持多角色对话场景。

  • 参考图像生成视频:只需要输入1到4张参考图,配合文本描述,就能产出一段连贯流畅的视频。人物身份、姿态、构图、风格细节,都能精准复现,不是那种“大概像”的模糊效果。
  • 视频时序延展:相当于给视频开了“时间伸缩”功能。单镜头可以平滑延长,想要切换场景?内置了五种专业级电影转场逻辑,多镜头智能切换,叙事拓展很自然。
  • 音频驱动虚拟人:给一张人物肖像,再给一段语音,自动生成唇形和表情同步的数字人视频。长时长输出没问题,多个角色对话也能协同,应用场景一下子宽了。

更关键的是,这三项能力并不是生硬拼凑——它们是模块化解耦设计的,每个模块都经过深度调优。既可以单独调用,也能按需组合。背后的底气来自团队的企业级数据清洗流程、毫秒级推理优化,以及高效稳定的大规模训练框架。生成质量、响应速度、部署成本三者之间,找到了一个相当不错的平衡点。多项核心评测指标已经比肩甚至超越当前业界顶尖方案,这不是谦虚的说法,是实测结果。

对于开发者来说,还有一个好消息:模型已经开源,可以直接拿去用。API也开放了限时免费体验——毕竟是新东西,先上手试试再决定是否深度集成,这个思路很实在。

本文转载于:https://www.php.cn/faq/2044519.html?uid=1246273 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注