CDSeg:用可渲染高斯载体,把二维分割标签搬进三维世界
现有方法要么需要大量三维标注来训练分割网络,要么用复杂的全局优化来求解标签,但都忽略了一个关键事实:高斯泼溅的渲染器本身就能告诉我们每个像素对应哪个三维原语。CDSeg 的核心洞察就是把这个渲染器变成像素与原语之间的关联引擎,让高斯原语充当标签的载体。
现有方法要么需要大量三维标注来训练分割网络,要么用复杂的全局优化来求解标签,但都忽略了一个关键事实:高斯泼溅的渲染器本身就能告诉我们每个像素对应哪个三维原语。CDSeg 的核心洞察就是把这个渲染器变成像素与原语之间的关联引擎,让高斯原语充当标签的载体。