Step R-mini(全称Step Reasoner mini)是阶跃星辰推出的推理模型, 是 Step 系列模型家族的首个推理模型,擅长主动规划、尝试和反思,基于慢思考和反复验证的逻辑机制,为用户提供准确可靠的回复。模型既擅长解决逻辑推理、代码和数学等复杂问题,也能兼顾文学创作等通用领域。Step R-mini在数学基准测试和代码任务上表现优异,实现了文理兼修。Step R-mini坚持 Scaling Law 原则,包括强化学习、数据质量、测试时计算和模型规模的扩展。

Step R-baidu09mini – 阶跃星辰推出的 系列首个推理模型  第1张
(图片来源网络,侵删)
Step R-baidu09mini – 阶跃星辰推出的 系列首个推理模型  第2张
(图片来源网络,侵删)