SimpleAR 是复旦大学视觉与学习实验室和字节 Seed 团队联合推出的纯自回归模型。采用简洁的自回归架构,通过优化训练和推理过程,实现了高质量的图像生成。SimpleAR 仅用 5 亿参数即可生成 1024×1024 分辨率的图像,在 GenEval 等基准测试中取得了优异成绩。训练采用“预训练 – 有监督微调 – 强化学习”的三阶段方法,显著提升了文本跟随能力和生成效果。SimpleAR 兼容现有加速技术,推理时间可缩短至 14 秒以内。

SimpleAR – 复旦大学联合字节 Seed 团队推出的图像生成模型  第1张
(图片来源网络,侵删)
SimpleAR – 复旦大学联合字节 Seed 团队推出的图像生成模型  第2张
(图片来源网络,侵删)