Alpha Pulse New

AI 产品

OpenMOSS发布MOSS-VL:支持实时视频理解的开源视觉语言模型

首次出现 8月19日 02:30·最近更新 8月19日 02:30

OpenMOSS组织发布了MOSS-VL,一个拥有110亿参数的开源视觉语言模型。该模型的核心特点在于其处理实时视频流的能力,能够在持续观看视频帧的同时生成回答,并内置了“主动沉默”和“动态自纠正”机制。目前,关于该模型的性能基准测试、实际应用效果及社区反馈等细节尚未在证据中披露。

多来源证据

事件时间线

  1. 8月18日 20:10
    Twitter/X AI List
    OpenMOSS发布MOSS-VL:支持实时视频理解的开源视觉语言模型
返回新闻流