We present NeSF, a method for producing 3D semantic fields from posed RGB images alone. In place of classical 3D representations, our method builds on recent work in implicit neural scene representations wherein 3D structure is captured by point-wise functions. We leverage this methodology to recover 3D density fields upon which we then train a 3D semantic segmentation model supervised by posed 2D semantic maps. Despite being trained on 2D signals alone, our method is able to generate 3D-consistent semantic maps from novel camera poses and can be queried at arbitrary 3D points. Notably, NeSF is compatible with any method producing a density field, and its accuracy improves as the quality of the density field improves. Our empirical analysis demonstrates comparable quality to competitive 2D and 3D semantic segmentation baselines on complex, realistically rendered synthetic scenes. Our method is the first to offer truly dense 3D scene segmentations requiring only 2D supervision for training, and does not require any semantic input for inference on novel scenes. We encourage the readers to visit the project website.


翻译:我们用NeSF来提供3D语义字段,这是仅用制成的 RGB 图像制作3D 语义字段的一种方法; 取代传统的 3D 表达式,我们的方法基于最近隐性神经场景演示中的工作,其中3D 结构通过点函数捕捉。 我们利用这种方法来回收3D 密度场,然后用2D 语义图来训练一个3D 语义分割模型。 尽管我们仅用2D 语义图来训练,但我们的方法仍然能够用新相机显示的3D 相容语义地图来制作,并且可以在任意的 3D 点进行查询。 值得注意的是, NESF 与生成密度场的任何方法都兼容, 随着密度场质量的提高,其准确性也有所提高。 我们的经验分析表明, 在复杂、现实的合成场景中,我们首先可以提供真正密度3D 3D 语义的语义分割模型,只需要2D 监督培训,并且不需要任何语义输入新场景的语义。 我们鼓励读者访问项目网站 。

0
下载
关闭预览

相关内容

3D是英文“Three Dimensions”的简称,中文是指三维、三个维度、三个坐标,即有长、有宽、有高,换句话说,就是立体的,是相对于只有长和宽的平面(2D)而言。
UIUC韩家炜:从海量非结构化文本中挖掘结构化知识
专知会员服务
95+阅读 · 2021年12月30日
专知会员服务
56+阅读 · 2021年4月12日
数字化健康白皮书,17页pdf
专知会员服务
104+阅读 · 2021年1月6日
专知会员服务
41+阅读 · 2020年12月18日
专知会员服务
38+阅读 · 2020年9月6日
【泡泡汇总】CVPR2019 SLAM Paperlist
泡泡机器人SLAM
14+阅读 · 2019年6月12日
revelation of MONet
CreateAMind
5+阅读 · 2019年6月8日
(Python)3D人脸处理工具Face3d
AI研习社
7+阅读 · 2019年2月10日
TorchSeg:基于pytorch的语义分割算法开源了
极市平台
20+阅读 · 2019年1月28日
Unsupervised Learning via Meta-Learning
CreateAMind
41+阅读 · 2019年1月3日
A Technical Overview of AI & ML in 2018 & Trends for 2019
待字闺中
16+阅读 · 2018年12月24日
【推荐】YOLO实时目标检测(6fps)
机器学习研究会
20+阅读 · 2017年11月5日
可解释的CNN
CreateAMind
17+阅读 · 2017年10月5日
Adversarial Variational Bayes: Unifying VAE and GAN 代码
CreateAMind
7+阅读 · 2017年10月4日
Arxiv
6+阅读 · 2021年4月13日
VIP会员
相关资讯
【泡泡汇总】CVPR2019 SLAM Paperlist
泡泡机器人SLAM
14+阅读 · 2019年6月12日
revelation of MONet
CreateAMind
5+阅读 · 2019年6月8日
(Python)3D人脸处理工具Face3d
AI研习社
7+阅读 · 2019年2月10日
TorchSeg:基于pytorch的语义分割算法开源了
极市平台
20+阅读 · 2019年1月28日
Unsupervised Learning via Meta-Learning
CreateAMind
41+阅读 · 2019年1月3日
A Technical Overview of AI & ML in 2018 & Trends for 2019
待字闺中
16+阅读 · 2018年12月24日
【推荐】YOLO实时目标检测(6fps)
机器学习研究会
20+阅读 · 2017年11月5日
可解释的CNN
CreateAMind
17+阅读 · 2017年10月5日
Adversarial Variational Bayes: Unifying VAE and GAN 代码
CreateAMind
7+阅读 · 2017年10月4日
Top
微信扫码咨询专知VIP会员