其他
AI公司Kimi发布PerceptionBench基准测试 评估多模态大模型视觉感知能力
月之暗面旗下AI产品Kimi在其官方博客发布名为PerceptionBench的新基准测试,旨在评估多模态大语言模型(MLLMs)的原子级视觉感知能力。这是官方确认的信息。该测试旨在衡量模型对图像基础元素的理解。Kimi同时介绍了其一系列AI工具产品线,包括全能AI工作空间Kimi、桌面AI助手Kimi Work、代码代理Kimi Code、浏览器扩展Kimi WebBridge以及可访问最新模型的Kimi平台,还提到了AI演示制作、网站构建、深度研究、表格处理和文档管理等具体功能。
多来源证据
事件时间线
- Kimi BlogPerceptionBench:评估多模态大语言模型的原子视觉感知能力