已发布集合
MOSS-VL 面向边说话边感知的实时视频理解
多模态应用可关注实时视频理解与语音交互结合的新模型。
- 内容数量
- 1
- 来源数量
- 1
- 时间范围
- 2026-08-18
- 主要标签
- 模型 · 多模态模型 · MOSS-VL
已发布证据
每条内容都保留摘要,并提供回到来源语境的路径。
MOSS-VL 面向边说话边感知的实时视频理解
转推内容称,OpenMOSS 发布 MOSS-VL,这是一个11B open vision-language 模型,面向“perceives while speaking”的实时视频理解。
为什么重要多模态应用可关注实时视频理解与语音交互结合的新模型。
原始来源