AI 产品
Rapid-MLX 0.11.0发布:提升Apple Silicon本地模型性能与可靠性
Rapid-MLX 0.11.0已发布,针对Apple Silicon优化本地模型性能。性能方面,TTFT从13.1秒降至0.51秒(25.6倍提升),响应缓存从656毫秒降至2毫秒(284倍提升),吞吐量达152 tok/s,冷启动秒级。此外,新增agent功能,可自主链式调用工具,并支持5个新模型家族,包括HY3 295B MoE等。这些改进基于具体数据,使本地模型更可靠,适用于实际工作流程。
多来源证据
事件时间线
- Twitter/X AI List🚀 Rapid-MLX 0.11.0发布!使Apple Silicon上的本地模型足够可靠,可以运行你的agent工作流程,而不仅仅是演示。 ⚡️ 性能 • 前缀缓存