开发工具
多个大模型排行榜对Qwen3.8-max排名存在差异引发讨论
用户指出,新发布的大模型Qwen3.8-max在多个公开排行榜上呈现出不一致的排名(如第4、第7、第10名之后),引发了关于应以哪个榜单为权威标准的讨论。目前这主要是一个基于观察的讨论点,尚未形成共识。
多来源证据
事件时间线
- V2EX AI 用户与重大信号大模型排行榜到底哪个权威?
开发工具
用户指出,新发布的大模型Qwen3.8-max在多个公开排行榜上呈现出不一致的排名(如第4、第7、第10名之后),引发了关于应以哪个榜单为权威标准的讨论。目前这主要是一个基于观察的讨论点,尚未形成共识。