语义更强却看不清边界?LingBot-Vision的空间预训练

论文代表图:figure-08-p020-02

LingBot-Vision把边界从下游输出变成预训练信号,通过边界强制掩码和在线目标生成提升密集空间感知。本期查看深度、分割、视频对象分割和深度补全证据,同时讨论几何能力与全局语义分类之间的权衡。