AI 产品
AI服务器负载测试显示Alibaba Qwen与NVIDIA组合性能大幅提升
一条推特帖子声称,在Alibaba Qwen、NVIDIA和LambdaAPI支持的同一服务器上进行负载测试,从1个流的148 tok/s(tokens per second)提升到64个并发请求的3395 tok/s,聚合吞吐量增加22.93倍,且无性能降级。测试基于3次运行的中位数,每次请求输出4k tokens,使用了LambdaAPI计算信用。此信息源自非官方推特,未经官方验证,属于声称而非确认事实。
多来源证据
事件时间线
- Twitter/X AI List@Alibaba_Qwen @nvidia @LambdaAPI 在同一服务器负载下:1个流时148 tok/s → 64个并发请求时3,395 tok/s,聚合吞吐量22.93倍