ReflexTrack:用闭环反馈解决无训练视频分割的目标漂移问题

核心贡献

现有无训练RVOS方法多采用开环设计,缺乏对初始提示和时序传播的显式验证,导致在遮挡或形变场景下易失效。ReflexTrack通过Mask-guided Spatial Refinement和Video-level Mask Reflection构建闭环反馈,迭代优化空间提示并修复时序错误。实验显示其在Ref-VPS上显著优于基线,但在ReasonVOS上仍有提升空间。注意:该方法依赖强大MLLM,计算成本较高。