QwQ-baidu0932B – 阿里通义千问开源的最新推理模型

baidu09_com 2025-08-30 39 0

QwQ-32B 是阿里巴巴开源的新型推理模型，参数量为 320 亿。基于大规模强化学习（RL）训练，在数学推理、编程等任务上表现出色，性能比肩 6710 亿参数的满血版。模型集成智能体能力，根据环境反馈调整推理过程，展现出强大的适应性和推理能力。模型已在 Hugging Face开源，采用 Apache 2.0 协议，在能直接进行体验。QwQ-32B 的发布证明强化学习在提升模型性能方面的巨大潜力，为未来通用人工智能（AGI）的发展提供了新的思路和方向。