Skip to content
AI情报2026年9月18日AI情报
文章

英伟达优化JAX框架下的无丢弃混合专家模型训练: NVIDIA推出了使用NVIDIA Transformer Engine在JAX中训练dropless Mixture of Experts (MoE)模型的优化。此次更新解决了与dropless...

MoE路由相关的通信和计算瓶颈。

Frontier 编辑部来源: NVIDIA Generative AI
01

来源简报

英伟达优化JAX框架下的无丢弃混合专家模型训练: NVIDIA推出了使用NVIDIA Transformer Engine在JAX中训练dropless Mixture of Experts (MoE)模型的优化。此次更新解决了与dropless MoE路由相关的通信和计算瓶颈。