当前位置: 首页 » 资讯 » 新科技 » 正文

京东即将开源视觉语言实时交互模型

IP属地 中国·北京 编辑:刘敏 财联社 时间:2026-06-17 10:05:13

《科创板日报》17日讯,《科创板日报》记者独家获悉,京东团队即将开源视觉语言实时交互模型JoyAI-VL-Interaction。记者从一份在开源社区和海外AI技术圈受到关注的技术报告获悉,JoyAI-VL-Interaction把多模态大模型从一问一答,推进到实时流式交互,适合需要AI持续在场的场景。报告将JoyAI-VL-Interaction与豆包、Gemini 的App内视频通话助手进行了人工评测,覆盖监控预警、实时计数、实时翻译、时间感知、直播解说和引导、长程记忆六类场景。在58个案例中,JoyAI-VL-Interaction对豆包的总体胜率为77.6%,对Gemini的总体胜率为87.9%。其中,在监控预警场景中,对两个基线均取得100%胜率。

标签: 胜率 joyai vl-interaction gemini 科创板日报 豆包

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。