网界
网络资讯 网界财经 科技人物 数据洞察 行业动态 智能出行 智能手机 数码极客 商业资讯

京东开源实时视频编辑AI:边播边改超便捷,适配电商多场景

2026-08-06来源:天脉网编辑:瑞雪

在视频创作领域,一项突破性技术正引发行业关注。京东近日宣布开源自主研发的实时流式视频编辑模型JoyAI-Video-Edit,该技术允许用户在视频播放过程中直接修改人物穿搭、替换商品或场景元素,彻底颠覆传统"先拍摄后编辑"的生产流程。

实测体验显示,用户只需在操作界面输入文字指令,系统即可实时完成视频内容修改。当测试者穿着绿色T恤自拍并输入"将上衣改为粉色"的指令后,画面中的服装颜色立即发生改变。更复杂的操作如"佩戴红色棒球帽和深色墨镜"同样能快速响应,虽然存在约0.3秒的轻微延迟,但整体流畅度已达到实用标准。该技术已实现六大核心功能:服装颜色/款式/材质的实时替换、配饰调整、艺术风格转换、场景置换、角色形象转换以及参考图驱动换装。

技术团队透露,JoyAI-Video-Edit基于全自研架构,在720P分辨率下可保持每秒30帧的处理速度。这种性能表现使其能够无缝适配电商直播场景——主播在展示商品时,观众看到的画面可同步替换为不同颜色或款式的商品,无需中断直播进行后期制作。测试中发现,系统的响应精度高度依赖提示词质量,当指令过于宽泛时,模型可能自主添加未要求的配饰或改变发型设计。

与行业主流的"文生视频"技术路线形成鲜明对比,京东选择押注"边播边改"的实时编辑赛道。当前市场上,阿里通义万相、快手可灵AI、字节即梦等平台均专注于通过文本或图像生成完整视频,而京东的技术方案更侧重于对现有视频流的动态修改。这种差异化策略在电商领域展现出独特优势,特别是对于需要即时调整商品展示效果的直播场景。

技术突破的背后,隐藏着京东在具身智能领域的战略布局。据研发团队介绍,该模型可通过编辑人手操作视频,批量生成机械臂训练所需的合成数据。通过保留物体空间关系和动作轨迹,同时替换场景、物体和机器人形态,单段视频可扩展出数十倍的训练样本,有效解决真实数据采集成本高、危险场景难以复现等行业痛点。

作为京东JoyAI模型矩阵的最新成员,JoyAI-Video-Edit与现有图像编辑、长音视频生成、实时画面反馈等模块形成技术协同。该矩阵已包含空间理解、语音交互、机器人操控等能力模块,此次开源的实时视频编辑技术,标志着京东在物理世界AI应用领域完成重要拼图。

影石发力全球市场:X6全景相机即将登场 日本首家旗舰店开业在即
8月5日,影石宣布两项新动作:全景相机新品Insta360 X6将于8月12日发布;日本首家直营旗舰店则将于8月8日在东京浅草开业。从新品迭代到海外渠道建设,影石正进一步加码全球市场布局。据报道,上千名日本…

2026-08-06

华为新品发布会来袭!多款旗舰新品齐亮相,哪款是你的菜?
搭载全新的腕上室内滑雪模式,支持单板、双板滑雪,可记录最大速度、平均坡度、累计下降、滑行趟数等数据。 华为WATCH GT 7Pro仅46mm一个尺寸版本。 另外,这次活动中还带来了首款3000元档的RG…

2026-08-06