知识卡片:京东开源JoyAI-Video-Edit实时视频编辑模型
一句话结论:京东开源自研实时流式视频编辑模型JoyAI-Video-Edit,可在720P下以每秒30帧进行推理,支持边观看边修改人物与场景,并为具身智能数据合成提供新路径。
事件概述:据腾讯研究院AI速递20260806,京东开源了自研实时流式视频编辑模型JoyAI-Video-Edit。该模型支持任意时长稳定流式编辑,可实时替换物体、调整人物形象或改变画面风格,是京东面向物理世界打造的JoyAI模型矩阵的一部分。
方法/产品要点:
- 实时流式视频编辑:边观看边修改,无需等待全片渲染。
- 性能指标:720P下实现每秒30帧推理;支持任意时长稳定流式编辑。
- 核心功能:实时替换物体、调整人物形象、改变画面风格。
- 产业延伸:为具身智能数据合成提供新路径。
主要结果或产业意义:材料称该模型各项指标全球领先;其开源进一步完善了京东JoyAI模型矩阵,并展示了大模型在视频实时编辑与具身智能数据生成方面的应用潜力。
为什么重要:传统视频编辑通常需要离线处理和生成,JoyAI-Video-Edit将编辑能力推进到“实时流式”阶段,显著降低视频创作与修改的门槛;同时,它为具身智能提供合成数据路径,标志着同一模型体系从数字内容生成向物理世界交互延伸。
局限与不确定性:
- 具体开源地址、模型参数、训练数据、评估基准及开源协议待核实。
- 材料未提供官方论文或第三方独立评测,各项指标“全球领先”的具体对比口径待核实。
- 模型的算力需求、版权风险、长时编辑稳定性细节待核实。
可用于图书/PPT/简报的角度:
- 实时视频编辑技术的里程碑与产业应用。
- 大模型能力从文本/图像生成扩展到视频流式编辑的趋势。
- 京东在具身智能与物理世界AI上的布局,以及开源生态策略。
原始材料:
- 标题:腾讯研究院AI速递 20260806
- 英文标题(自译,原文未标注):Tencent Research Institute AI Daily Brief 2026-08-06
- 英文关键词:JoyAI-Video-Edit; Real-time Video Editing; Streaming; Embodied AI; JD.com
- URL: https://m.sohu.com/a/1059264119_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=5