Qwen3 开源:混合思考模式与多语言覆盖

Qwen3 提供 0.6B 到 235B(MoE)共 6 个稠密与 MoE 规格,创新点在于'混合思考':单一模型可按问题难度自动或手动切换'深度推理'与'快速响应'两种模式,兼顾成本与效果。预训练语料约 36 万亿 Token,覆盖 119 种语言。

Qwen 系列的全球衍生模型数量随后超越 Llama 登顶开源生态第一,HuggingFace 下载量与微调版本均居前列。它标志着中国开源模型从'追赶'进入'定义赛道'阶段,与 DeepSeek 形成'推理看 R1、生态看 Qwen'的格局。

阅读原文(Qwen)↗ ← 返回资讯列表