先手 SENTE · 周报阅读清单 · 速读 · arXiv 2609.38721

UniEvo-VL:多模态模型用自己的批评来自我蒸馏

UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement
Fang Wu,Da Xing,Yanjie Huang,Junxi Wang 等 19 位作者 · 2026-09-30

同一个模型当老师和学生:老师多看一段自我批评

打开交互式解读 →

三个要点

0.747→0.808 GenEval 得分(Qwen-Image-2512,训练前后)

适合谁读:做图像生成模型后训练的团队;关注「无外部监督的自我改进」路线的研究者和投资人。

arXiv 摘要页 · PDF

AI 解读 · 基于原文:本页由 AI 根据论文原文整理,所有数字均可在原文中找到出处;引用前请核对原文。