
阿里云Qwen3-235B-A22B-FP8旗舰版更新:性能大幅提升,超越行业标杆
阿里云近日发布了Qwen3-235B-A22B-FP8旗舰版模型,通过优化训练模式,全面提升性能,在多项测评中超越Kimi、DeepSeek等行业顶尖模型。该版本具备多语言长尾知识覆盖、用户偏好契合能力及长文本理解等优势,已在魔搭社区和HuggingFace上开源。
性能全面升级,超越行业顶尖模型
阿里云最新发布的Qwen3-235B-A22B-FP8旗舰版模型,经过对训练模式的优化,在指令遵循、逻辑推理、文本理解等方面表现优异,超越了Kimi-K2、DeepSeek-V3等行业顶尖模型,以及Claude-Opus4-Non-thinking等领先闭源模型。

功能特点与性能增强
- 类型:因果语言模型 / 自回归语言模型
- 训练阶段:预训练与后训练
- 参数量:235B,激活22B
- 层数:94
- 上下文长度:原生支持262,144
新版本在多语言长尾知识覆盖、用户偏好契合能力以及长文本理解等方面均取得显著进步。
此外,Qwen3-235B-A22B-FP8在主观及开放性任务中表现出色,能够提供更有用的回复,生成更高质量的文本。

开源与社区
Qwen3新模型已在魔搭社区和HuggingFace上开源更新,方便用户获取和使用。