AI 产品
OpenMOSS发布MOSS-VL:支持实时视频理解的开源视觉语言模型
OpenMOSS组织发布了MOSS-VL,一个拥有110亿参数的开源视觉语言模型。该模型的核心特点在于其处理实时视频流的能力,能够在持续观看视频帧的同时生成回答,并内置了“主动沉默”和“动态自纠正”机制。目前,关于该模型的性能基准测试、实际应用效果及社区反馈等细节尚未在证据中披露。
多来源证据
事件时间线
- Twitter/X AI ListOpenMOSS发布MOSS-VL:支持实时视频理解的开源视觉语言模型
AI 产品
OpenMOSS组织发布了MOSS-VL,一个拥有110亿参数的开源视觉语言模型。该模型的核心特点在于其处理实时视频流的能力,能够在持续观看视频帧的同时生成回答,并内置了“主动沉默”和“动态自纠正”机制。目前,关于该模型的性能基准测试、实际应用效果及社区反馈等细节尚未在证据中披露。