Nemotron-70B-Instruct 是英伟达(NVIDIA)推出的一个大型语言模型,基于一种新颖的混合训练方法提升模型遵循指令时的响应质量和一致性。模型结合Bradley-Terry和Regression风格训练的元素,用包含偏好注释的HelpSteer2-Preference数据集,注释附带人类编写的解释,增强数据的可解释性。Nemotron-70B-Instruct 在多个基准测试中表现出色,包括在RewardBench上得分94.1,超越140多个开闭源模型,仅次于OpenAI的o1模型。

全部评论
留言在赶来的路上...
发表评论