首页 > 人工智能>京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型

京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型

IT之家人工智能2026-07-19 05:59:43
京东于 2026 世界人工智能大会上,以“AI 进入物理世界”为主题,发布了 JoyAI-Talker 实时语音交互模型和 JoyAI-Video-Edit 视频编辑模型。前者能低延迟对话并理解情绪,后者支持边预览边用自然语言编辑视频。这标志着京东正构建覆盖语音、图像、视频的完整基础模型体系。#2026世界人工智能大会# #AI模型#...

最新 7 月 18 日消息,2026 世界人工智能大会暨人工智能全球治理高级别会议(WAIC)昨日在上海世博、张江、西岸“三地四馆”同步启幕。

7 月 18 日,京东以“AI 进入物理世界”为核心主题亮相上海世博展览馆,首次系统展示面向物理世界的 JoyAI 模型矩阵。

在模型方面,京东推出了 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 实时视频编辑模型。据京东介绍,JoyAI-Talker 具备低延迟对话、情绪理解、工具调用和记忆等能力,让 AI 从机械执行指令走向理解人的意图和状态。该模型能够通过声纹识别用户身份,结合环境数据理解对话意图。

JoyAI-Video-Edit 则支持自定义画面和边预览边修改,让视频编辑更加实时、灵活。该模型将视频能力延伸至流式编辑,用户面对变化中的视频画面,可以直接用自然语言增删物体、替换人物、迁移服装,甚至重构整个场景。

最新此前报道,今年以来京东已陆续发布 Joy-Image-Edit、JoyAI-Echo、JoyAI-VL-Interaction 等 7 个基础模型。以 JoyAI 基座大模型为核心,京东已形成覆盖语音、图像、视频、实时交互、世界模型和具身智能的基础模型体系。

在本次 WAIC 期间,京东还开源了行业最大人类视角数据集 EgoLive,并打造了首个 JoyInside“AI Home”。观众在现场可以佩戴 JoyEgoCam,亲自体验第一视角数据采集。

相关阅读:

  • 《让大模型从“一问一答”走向“边看边说”,京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction》

2026 世界人工智能大会专题

《京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。

本文网址:https://www.jsj.wang/2026/07/17844120082907.html

相关图文