跳到正文
Hacker News 热门· gmays·· 3 小时前AI 评分33

UniEvo-VL:多模态模型自我改进的自蒸馏训练框架

UniEvo-VL: Self-Distillation Training for Multimodal Model Self-Improvement

AI 导读

UniEvo-VL 是一个让多模态模型在测试时计算中通过自我批判反馈实现自我进化的框架,无需依赖独立的大型教师模型,而是让同一模型分别以学生和教师身份在不同上下文下训练,最小化去噪扩散分布差异。

来源:Hacker News 热门 · arxiv.org