其他
英伟达发布多项AI技术进展,AMD推出新系统挑战
英伟达开发者博客近期发布多篇技术文章,介绍了其在AI计算领域的最新进展。其中包括通过NVLink技术扩展AI工厂网络,优化TensorRT引擎构建的可观测性和可取消性,以及在GB300 NVL72系统上创下单次专家混合模型预训练的世界纪录。此外,英伟达还提供了调试OptiX光线追踪应用程序的指南,并介绍了通过Prime Intellect Lab定制Nemotron 3 Nano模型的快速方法。与此同时,有报道称AMD推出了Helios AI机架级系统,旨在挑战英伟达的市场地位,但该信息的官方来源尚待确认。
多来源证据
AMD推出Helios AI机架级系统挑战英伟达
AMD公司推出Helios AI机架级系统,旨在通过新型架构在AI计算领域直接竞争英伟达,可能影响市场格局。
英伟达NVLink:AI工厂的扩展网络
AI需求持续加速。工作负载越来越大,模型越来越复杂,部署AI计算的压力也越来越大……
使长时间运行的英伟达TensorRT引擎构建在Python或C++中可观察且可取消
TensorRT引擎构建可能从几秒到几分钟不等。大型强类型模型、深度策略搜索以及全新GPU SKU上的冷计时缓存可能导致构建过程耗时显著增加,需要监控和控制手段。
在英伟达GB300 NVL72上创下单次专家混合模型预训练的世界纪录
前沿模型预训练已收敛到混合专家模型,这从根本上改变了限制大规模AI训练的因素。随着每令牌计算资源的……
使用英伟达OptiX工具包调试光线追踪应用程序
英伟达OptiX光线追踪引擎是一个用于在GPU上实现最佳光线追踪性能的应用程序框架。使用OptiX的应用程序可能以多种方式出现故障……
通过Prime Intellect Lab快速开始定制英伟达Nemotron 3 Nano模型
定制化使开发者能够获取通用模型,并根据用例、领域、语言等进行调整。然而,定制化也带来了……
事件时间线
- NVIDIA Developer Blog英伟达NVLink:AI工厂的扩展网络
- NVIDIA Developer Blog使长时间运行的英伟达TensorRT引擎构建在Python或C++中可观察且可取消
- NVIDIA Developer Blog在英伟达GB300 NVL72上创下单次专家混合模型预训练的世界纪录
- NVIDIA Developer Blog使用英伟达OptiX工具包调试光线追踪应用程序
- NVIDIA Developer Blog通过Prime Intellect Lab快速开始定制英伟达Nemotron 3 Nano模型
- Hermes NewsCrawler 输出AMD推出Helios AI机架级系统挑战英伟达