JoyAI-Video-Edit 今日发布
京东开源实时流式视频编辑模型
JoyAI-Video-Edit是京东于2026年8月正式开源的实时流式视频编辑模型,突破了传统视频"先拍完再剪辑"的固有模式。用户可以在视频播放过程中实时修改人物形象、场景细节和画面风格,全程无需等待漫长的渲染时间,实现"边看边改"的流畅互动编辑体验。
该模型依托京东JoyAI基础大模型底座,结合MLLM条件编码器、因果视频VAE和16B参数多模态扩散Transformer三大核心组件,采用自回归扩散编辑架构。在官方部署测试中,端到端完整 pipeline 在720P分辨率下稳定达到30帧实时运算,画面处理无明显延迟和卡顿,可适配常规视频播放同步修改需求。
JoyAI-Video-Edit支持自然语言指令控制,用户输入"把背景换成海边"或"把人物换成穿西装的形象"等描述即可完成编辑,无需专业视频编辑技能。产品支持超长视频连续编辑,突破了行业以往只能处理短视频片段的局限。应用场景涵盖零售营销(商品视频实时植入场景)、家装设计(视频画面风格转换)、影视制作(快速预览不同剪辑方案)以及具身智能数据大规模合成等领域。
目前项目已在GitHub开源(jd-opensource/JoyAI-Video-Edit),提供部署代码、技术报告和模型权重下载,并在HuggingFace上线了在线体验demo,用户可在单张RTX PRO 6000 GPU上运行实时流式视频编辑。
团队信息
AI产品库
官方
由 AI 猎手自动发现
评论与建议
登录 后参与评论或提建议