GB300 NVL72
2026年 8月 26日
在 NVIDIA GB300 NVL72 上使用 Qwen3.8-Flash-Next 进行代理式编码实验
阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构的预览,供开发者试验和评估。
2 MIN READ
2026年 8月 12日
在 NVIDIA GB300 NVL72 上部署参数量达 2.4T 的 Qwen3.8-2.4T-A95B 模型,并支持可配置推理
阿里巴巴发布了其最大的开放权重模型 Qwen3.8-2.4 T-A95B (Qwen3.8-Max) 的开放权重,
2 MIN READ
2026年 7月 21日
在 NVIDIA GB300 NVL72 上进行 MoE 预训练创下世界纪录
前沿模型预训练已融合多专家模型 (MoE) ,这从根本上改变了对大规模 AI 训练的限制。随着每 token 的计算量下降,
3 MIN READ