Nerf原理理解

🕗 发布于 2024-03-05 13:57 神经辐射场

神经辐射场是一个简单的全连接网络（权重约为 5MB），经过训练可使用渲染损失再现单个场景的输入视图。该网络直接从空间位置和观看方向（5D 输入）映射到颜色和不透明度（4D 输出），充当“体积”，因此我们可以使用体积渲染来以不同方式渲染新视图。优化 NeRF 需要几个小时到一两天（取决于分辨率），并且只需要一个 GPU。从优化的 NeRF 渲染图像需要不到一秒到大约 30 秒的时间，这同样取决于分辨率。

NeRF——Neural Radiance Fields（神经辐射场）的缩写，是来自2020年3月的一篇论文 Title：NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis nerf论文：https://arxiv.org/pdf/2003.08934.pdf nerf代码：https://github.com/bmild/nerf

、

三维模型一般用网格，点云或者体素方式表现

希望通过反渲染还原出一个三维模型

过往三维重建直接通过图片重建出网格，点云或者体素模型

NeRF是通过神经隐式方式建三维模型

神经隐式

我们可以简单地理解为:

我们使用一个NeRF神经网络采取体积雾(带不透明度的点云)的渲染方式，通过已知视角的图片进行训练，然后输入其它相机视角的参数,从而预测出未出现视角的图片。

此时三维模型的信息就储存在了NeRF神经网络之中!所以这是一种“隐式”的表示方法，而不是像点云、体素、网格这种显式的表示方式!

这里为了让视频一开始方便理解，在开头将输入的(x,y,z,θ,φ)认为是相机的位姿，而先避开采样点的概念。实际上在论文和代码中原作者是将这个(x,y,z)处理成了采样点的位置(x,y,z)，而(θ,φ)就是采样点对应的观测角度。采样点是可以基于相机的位姿得到的，也就是：

采样点位置=相机原点+采样距离*相机观测方向

这个理解方式是将这个点处理成了空间中的点，每个空间中的采样点在不同的位置和观测角度能呈现不同的颜色，而采样点的不透明度只与采样点的位置有关。

一个NeRF神经网络模型只能存储一个三维场景

以像素点这一层级作为训练资料，而不是整张图作为一个层级，1个batch就有很多来自不同地方像素点和不同地方相机参数作为训练资料。输出RGB和不透明值，先输出一段采样点上的RGBA的值，在射线方向上，对这些采样点进行特定积分，才得到像素点确切的颜色值。是一个体积雾渲染的过程。

第二

有在论文中提到位置编码信息，主要是为了将图像中的高频信息体现出来，能够大幅度提高图片的细节质量，不会受到周边像素平滑过后的影响

NeRF位置编码通过concat方式将这样的信息融合起来，每个位置编码由两项sin和cos合成，

空间坐标系中他用10项就是20维来表示xyz的位置编码

相机方向用4项，即8维来分别表示（x,y,z)的位置编码

是用一个全连接层，一直连最后得到最终结果

一个像素点对应有64个采样点，每个采样点基于光线的射线产生

最后我们只需要通过一组图片和对应的相机位姿去训练一个网络，网络就能储存对应的模型信息，我们再输入一个不一样视角的相机参数，就能把我们想要看到一个物体的角度呈现出来

NeRF: Representing Scenes as

Neural Radiance Fields for View Synthesis

"Bundle adjustment"（捆绑调整）是计算机视觉和摄影测量领域的一个重要概念，它是用于三维重建和摄影测量的一种优化技术。Bundle adjustment的目标是通过优化相机参数、特征点的三维坐标以及观测值，来提高相机位姿和三维点的估计精度。

具体来说，Bundle adjustment通常用于以下情境：

1. 摄影测量：当使用多个照片来创建地图或测量物体的三维结构时，需要估计相机的内部参数（如焦距、畸变等）以及每个照片的位姿（相机的位置和方向）。Bundle adjustment可以通过同时考虑多个观测值（例如特征点在不同照片中的投影）来提高这些参数的估计精度。
2. SLAM（Simultaneous Localization and Mapping）：在移动机器人、自动驾驶汽车和增强现实应用中，Bundle adjustment用于同时估计相机或传感器的位姿和周围环境的三维结构，以实现实时的定位和地图构建。
3. 结构从运动（Structure from Motion）：在计算机视觉中，Bundle adjustment被用于从多个图像中重建三维场景的几何结构。

Bundle adjustment的核心思想是最小化观测值与估计值之间的残差，通过调整参数来最小化这些残差。这是一个高度非线性的优化问题，通常使用数值优化方法（例如Levenberg-Marquardt算法）来解决。Bundle adjustment能够处理许多复杂情况，包括相机内外参数的变化、畸变校正、特征点匹配误差等。

总之，Bundle adjustment在计算机视觉和摄影测量中被广泛应用，用于提高三维重建和相机位姿估计的精度，从而在许多应用领域中发挥关键作用。

原文地址：https://blog.csdn.net/qq_36372352/article/details/136475530

免责声明：本站文章内容转载自网络资源，如本站内容侵犯了原著者的合法权益，可联系本站删除。更多内容请关注自学内容网（zxcms.com）！

上一篇：uniapp实现单选框卡片选择器,支持微信小程序、H5等多端
下一篇：001-CSS-水平垂直居中布局

leetcode289:生命游戏
根据，简称为，是英国数学家约翰·何顿·康威在 1970 年发明的细胞自动机。给定一个包含m × n个格子的面板，每一个格子都可以看成是一个细胞。每个细胞都具有一个初始状态：1即为（live），或0即为
阅读更多2024-10-20
MongoDB数据恢复
注意：两个MongoDB的版本要一致，本文使用的是mongo:4.2.24。先把K8S上面的MongoDB 容器停止（可以把副本改成0）。1、将容器挂载MongoDB的数据目录备份到本地。经常是数据文
阅读更多2024-10-20
C#中实现事务
C#中实现事务
阅读更多2024-10-20
【LeetCode每日一题】——560.和为 K 的子数组
给你一个整数数组 nums 和一个整数 k ，请你统计并返回该数组中和为 k 的子数组的个数。子数组是数组中元素的连续非空序列。
阅读更多2024-10-20
「漏洞复现」满客宝智慧食堂系统 selectUserByOrgId 未授权访问漏洞
请勿利用文章内的相关技术从事非法测试，由于传播、利用此文所提供的信息而造成的任何直接或者间接的后果及损失，均由使用者本人负责，作者不为此承担任何责任。工具来自网络，安全性自测，如有侵权请联系删除。本次
阅读更多2024-10-20
React面试题目（从基本到高级）
React前端面试常见题目涵盖了React的基础概念、组件、状态管理、生命周期、性能优化等多个方面。
阅读更多2024-10-20
12.个人博客系统（Java项目基于spring和vue）
1 在校学习的学生，可用于日常学习使用或是毕业设计使用 2 毕业一到两年的开发人员，用于锻炼自己的独立功能模块设计能力，增强代码编写能力。 3 亦可以部署为商化项目使用。 4 需要完整资料及源码
阅读更多2024-10-20
YoloV8改进策略：注意力改进|DeBiFormer，可变形双级路由注意力|引入DeBiLevelRoutingAttention注意力模块（全网首发）
本次改进的核心在于将DeBiLevelRoutingAttention模块嵌入到YoloV8的主干网络中，具体位置是在SPPF（Spatial Pyramid Pooling Fast）模块之后。这一
阅读更多2024-10-20
word取消自动单词首字母大写
情况说明：在word输入单词后首字母会自动变成大写取消单词首字母大写步骤：（1）点击菜单栏文件（2）点击“更多”——>“选项”（3）点击“校对”——>“自动更正选项”（4）取消“句首字母大
阅读更多2024-10-20
web前端网页用户注册页面
【代码】web前端网页用户注册页面。
阅读更多2024-10-20

Nerf原理理解

相关文章