生成难度究竟在哪里?目标表征的实证研究
通过统一的掩码自回归整流流模型,系统比较了原始像素、SD-VAE潜变量、DINOv2和MAE特征四种目标空间,发现压缩率、重建保真度等常见属性无法单独预测生成行为,目标表征实质上是将难度重新分配到上下文建模、局部去噪和推理控制等不同组件中。
通过统一的掩码自回归整流流模型,系统比较了原始像素、SD-VAE潜变量、DINOv2和MAE特征四种目标空间,发现压缩率、重建保真度等常见属性无法单独预测生成行为,目标表征实质上是将难度重新分配到上下文建模、局部去噪和推理控制等不同组件中。