其他
Qwen发布新博客:GSPO,一种面向语言模型的可扩展强化学习方法
2025年7月27日,Qwen官方发布了一篇新博客,介绍GSPO(可扩展强化学习用于语言模型)。文章开篇指出,强化学习(RL)已成为语言模型领域的关键技术,但提供的摘录仅包含部分内容,未展示具体细节。作为官方发布,这标志着Qwen团队在AI技术进展方面的最新动向。
多来源证据
事件时间线
- Qwen 官方GSPO:面向语言模型的可扩展强化学习 | Qwen
其他
2025年7月27日,Qwen官方发布了一篇新博客,介绍GSPO(可扩展强化学习用于语言模型)。文章开篇指出,强化学习(RL)已成为语言模型领域的关键技术,但提供的摘录仅包含部分内容,未展示具体细节。作为官方发布,这标志着Qwen团队在AI技术进展方面的最新动向。