IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 人工智能 -> SurroundDepth拜读:自监督环视多相机深度估计 -> 正文阅读

[人工智能]SurroundDepth拜读:自监督环视多相机深度估计

CVPR2022:SurroundDepth: Entangling Surrounding Views for Self-Supervised Multi-Camera Depth Estimation
Code:https://github.com/weiyithu/SurroundDepth

论文提出了SurroundDepth,将来自多个周围视图的信息合并到一起,以预测摄像头之间的深度图,具体地说:

  • 使用一个联合网络(joint network)来处理所有周围的视图
  • 并提出了一个交叉视图转换器(cross-view transformer)来有效地融合来自多个视图的信息、全局交互
  • 给定多摄像机外部矩阵( extrinsic matrices)、采用SFM(structure from motion)的稀疏深度来预训练模型,以预测真实世界的尺度
  • 估计车辆的整体自我运动(universal ego-motion),并将其传输到每个视图,以实现多视图一致性

解决痛点:

  • 尽管现代自动驾驶汽车通常配备多个摄像头来拍摄360度全景,现有的大多数方法仍然侧重于从单目图像预测深度图,而忽略了周围视图之间的相关性
  • 由于时间光度一致性(temporal photometric consistency)只能推断相对尺度,这些自监督单目深度估计方法无法产生尺度感知深度。然而,由于多摄像机外部矩阵中的平移向量获得了真实世界的尺度,因此可以获得尺度感知预测。

单目深度估计

一个深度估计网络

  • 只估计单图深度,多次估计获得多张无关联的深度图

一个位姿估计网络

  • 只估计一个相机的两帧间位姿,多个相机的位姿没有关联性

在这里插入图片描述

多目环绕深度估计

多目深度估计网络

  • 同时时刻的多目图像联合估计深度

多目位姿估计网络

  • 不同时刻之间的多个相机的深度图联合估计位姿

在这里插入图片描述

Overview

在这里插入图片描述
Depth Net:shared encoder and decoder
Pose Net: universal ego-motion PoseNet

Cross view transformer

在这里插入图片描述

  • depthwise separable convolutions降低图像分辨率后
  • 使用 cross-view attention整合全局信息
  • 再反卷积回原图像大小

SFM pretraining

  • 首先采用SIFT特征提取匹配
    • 由于小重叠和大视图变化,相邻视图只取相邻的 1 3 \frac{1}{3} 31? 部分匹配
    • 用epipolar geometry 过滤 outliers.
  • 使用相机外部矩阵进行三角测量来计算稀疏深度
  • 利用这些稀疏深度以及时间光度损失(temporal photometric loss)来预训练depth和pose网络

在这里插入图片描述

Joint pose estimation

分为两部分:

  • 整体位姿估计
  • 整体到局部位姿的转换

将N个target image和对应的N个source image一次喂到PoseNet 的encode,并在decode之前对提取的特征进行平均

在这里插入图片描述
获得整体位姿后,利用外参矩阵算单个相机的位姿:
在这里插入图片描述

  人工智能 最新文章
2022吴恩达机器学习课程——第二课(神经网
第十五章 规则学习
FixMatch: Simplifying Semi-Supervised Le
数据挖掘Java——Kmeans算法的实现
大脑皮层的分割方法
【翻译】GPT-3是如何工作的
论文笔记:TEACHTEXT: CrossModal Generaliz
python从零学(六)
详解Python 3.x 导入(import)
【答读者问27】backtrader不支持最新版本的
上一篇文章      下一篇文章      查看所有文章
加:2022-07-03 10:48:33  更:2022-07-03 10:49:31 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年11日历 -2024/11/26 0:41:26-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码