Alpha Pulse New

其他

Qwen发布新博客:GSPO,一种面向语言模型的可扩展强化学习方法

含官方证据首次出现 8月8日 23:47·最近更新 8月8日 23:47

2025年7月27日,Qwen官方发布了一篇新博客,介绍GSPO(可扩展强化学习用于语言模型)。文章开篇指出,强化学习(RL)已成为语言模型领域的关键技术,但提供的摘录仅包含部分内容,未展示具体细节。作为官方发布,这标志着Qwen团队在AI技术进展方面的最新动向。

多来源证据

事件时间线

  1. 暂无
    Qwen 官方
    GSPO:面向语言模型的可扩展强化学习 | Qwen
返回新闻流