京东宣布开源自研实时流式视频编辑模型 JoyAI-Video-Edit。与传统需要先导出完整成片再修改的流程不同,该模型主打“边播放、边编辑”:视频仍在播放时,系统即可根据指令替换场景、改变人物着装或调整画面风格,减少等待渲染的时间。
从京东公开的信息看,JoyAI-Video-Edit 的核心指标围绕“实时”展开。模型基于 JoyAI-Video 系列能力构建,在 720P 分辨率下可达到每秒 30 帧的推理速度。这一速度接近常见视频的播放帧率,意味着在播放过程中进行修改时,画面能够尽量跟上原视频节奏,降低延迟和卡顿感。
流式视频编辑的难点不只是单帧生成,而是连续帧之间的一致性。用户如果持续播放或不断发出新的编辑指令,模型需要连续输出后续画面,同时保持人物、物体、光照和运动轨迹稳定。京东称,JoyAI-Video-Edit 支持任意时长视频的稳定编辑,可随播放持续生成修改结果,而不是局限在几秒或几分钟的短片段。
这一能力对实际内容生产更直接。例如,创作者可以在预览阶段临时更换人物服装、调整背景街道,或给同一镜头切换不同视觉风格;直播、互动视频、快速原型制作等场景,也可能从低延迟编辑中受益。相比传统“剪辑—渲染—导出—再看效果”的循环,流式编辑把反馈链路缩短,修改成本更低。
不过,实时视频编辑仍受算力、输入素材质量和编辑指令复杂度影响。720P、30 帧是模型推理层面的指标,最终体验还与运行环境、视频编码、显存带宽和后处理流程有关。对于普通用户而言,能否在消费级设备上顺畅运行,仍需看官方后续提供的部署说明和优化工具。
目前,JoyAI-Video-Edit 已在京东开源社区开放获取。对开发者来说,该项目的价值不仅在于一个可下载的模型,也提供了一条观察实时视频生成管线如何设计的样本:如何在速度、画质和长时序稳定性之间做平衡,将是后续社区关注的重点。



