【论文阅读+代码复现】GSPN:Generative Shape Proposal Network for 3D Instance Segmentation in Point Cloud
Brief这是一篇CVPR18上的文章虽然表示是说的实例分割但是听同组的同学的推荐也可以做定位方面的事情因此加入到了paperlist。AbstructInstead of treating object proposal as a direct bounding box regression problem, we take an analysis-by-synthesis strategy and generate proposals by reconstructing shapes from noisy observations in a scene。通过综合分析的方式获得proposals。是不是可以取代anchor_based的方法。1 introductionIn contrast, we take a different perspective for object proposal which emphasizes more on the geometric understanding.**文章的亮点就在于从场景中分析出candidate objects。好处是双重的1.提出的proposals是具有higher objectness的GSPN生成网络是预先会去学习目标长什么样子再去提出候选框的。2.GSPN对自然物体场景下分布的噪声进行观察编码可以看做是一个实例感知提取的过程。有点迷后续解释结合GSPN提出的proposals作者提出了一个R-Pointnet网络。作者类比为Mask-RCNN.2 related work2.1 Object Detection and Instance Segmentation2D检测发展3D的CNN特别提了一下CVPR18上的第一篇实例分割的文章SGPN学习相似度矩阵的方法。作者表示这种自下而上的聚合策略不能很好的保证proposals具有较高的objectness2.3D Generative Models对于做3D检测的我来说。我觉得在3D中改掉anchor_based的方法才是重点因此这一部分细看。VAE变分自动编码器是经常用于在图像生成和形状生成上经常使用的它通过学习采样的数据x xx来学习一个分布这样不仅仅可以将采样数据解码为原始数据形式。VAE通过学习数据分布并最大拟合其相似分布。然而VAE不能像采样的数据中add controls不太懂先放一下因此一个后续的工作CAVE就此诞生了。因为CAVE和VAE可以学习数据分布的相似性但是GAN不能因此作者选择了VAE。怎么用CVAE生成proposals呢2.3 Deep Learning on Point Cloudpointnetgraph3 Method两个大部分GSPNproposalsR-PointNetinstance segmentationGSPNGSPN的voerview:GSPN采用生成object的方法去生成proposal。通过一个采样点生成一个和采样点编码点原始数据类似的proposals。作者称这个GSPN为CVAE方法。上图由几个子网络组成:prior network和recognition network用于参数化 为一个高斯分布。generation network学习生成表达式center-prediction network用于中心化上下文数据以及提出Location information中心点s ss采用球体结构选择三个尺度的scale进行输入。也就是c 1 , c 2 , c 3 c_1,c_2,c_3c1​,c2​,c3​整个过程都是很明显的就像上图所表示的那样1.首先center_network把三个尺度的信息进行编码融合成t tt作者这里说的是中心点t tt的回归2.将t tt进行translate后得到c ^ \widehat{c}c送入预先训练好的prior nework.再映射为一个高斯先验分布。3.Recognition network和prior network共享输入数据代码这里是 代码前面环境搭建和编译pointnet的操作我就不说了我的环境是py3.5tf1.14因此有些地方是需要改进的下面记录一下需要改进的地方在执行第一步时即python data_prep.py ./data/scannet ./data/scannet_preprocessed在文件data_pre.py的第86行会出现问题如下out_sem sem_label[idx] IndexError: too many indices for array也就是数组越界的问题我也不知道为什么会出现这个问题。如下修改第41和42行源码semLabel np.array(map(int, semLabel)) outGroups np.array(map(int, outGroups))改为semLabel np.array( semLabel) outGroups np.array( outGroups)

相关新闻

Python的标准库,random()

Python的标准库,random()

random()函数产生伪随机数,伪随机数是采用梅森旋转算法生成的(伪)随机序列中的元素,称为随机数基本随机函数:seed()、random()扩展随机函数:ranint()、getrandbits()、uniform()、randrange()、choice()、s…

2026/7/28 18:02:04 阅读更多 →
webpack(前端打包工具)

webpack(前端打包工具)

本质上,webpack 是一个现代 JavaScript 应用程序的静态模块打包工具。当 webpack 处理应用程序时,它会在内部构建一个 依赖图(dependency graph),此依赖图会映射项目所需的每个模块,并生成一个或多个 bundle。 官网地址https://we…

2026/7/28 18:01:04 阅读更多 →
leetcode—python  50天刷题  第21题  旋转链表

leetcode—python 50天刷题 第21题 旋转链表

题目描述 给定一个链表,旋转链表,将链表每个节点向右移动 k 个位置,其中 k 是非负数。 示例 1: 输入: 1->2->3->4->5->NULL, k = 2 输出: 4->5->1->2->3->NULL 解释: 向右旋转 1 步: 5->1->2->3->4->NULL 向右旋转 2 步: 4…

2026/7/28 18:01:04 阅读更多 →

最新新闻

基于地理位置算法GeoHash核心原理解析

基于地理位置算法GeoHash核心原理解析

文章目录认知GeoHash算法步骤根据经纬度计算GeoHash二进制编码组码GeoHash Base32编码长度与精度具体应用使用注意点认知GeoHash GeoHash将二维的经纬度转换成字符串,如北京9个区域的GeoHash字符串,分别是WX4ER,WX4G2、WX4G3等等,每一个字符…

2026/7/28 18:12:07 阅读更多 →
Eureka-Server的搭建

Eureka-Server的搭建

1.pom.xml<?xml version"1.0" encoding"UTF-8"?><project xmlns"http://maven.apache.org/POM/4.0.0" xmlns:xsi"http://www.w3.org/2001/XMLSchema-instance"xsi:schemaLocation"http://maven.apache.org/POM/4.0.0 …

2026/7/28 18:12:07 阅读更多 →
Path of Building PoE2:流放之路2角色构建规划的完整解决方案

Path of Building PoE2:流放之路2角色构建规划的完整解决方案

Path of Building PoE2&#xff1a;流放之路2角色构建规划的完整解决方案 【免费下载链接】PathOfBuilding-PoE2 项目地址: https://gitcode.com/GitHub_Trending/pa/PathOfBuilding-PoE2 还在为《流放之路2》复杂的天赋系统和装备搭配感到困惑吗&#xff1f;Path of B…

2026/7/28 18:12:07 阅读更多 →
Palworld服务器存档迁移终极指南:解决角色丢失问题

Palworld服务器存档迁移终极指南:解决角色丢失问题

Palworld服务器存档迁移终极指南&#xff1a;解决角色丢失问题 【免费下载链接】palworld-host-save-fix Fixes the bug which forces a player to create a new character when they already have a save. Useful for migrating maps from co-op to dedicated servers and fro…

2026/7/28 18:12:07 阅读更多 →
在OpenCV里实现极坐标变换3

在OpenCV里实现极坐标变换3

前面介绍了怎么样从直角坐标转换为极坐标,现在来学习从极坐标转换为直角坐标,如下图的公式就可以实现从极坐标到直角坐标的变换: 在OpenCV里也提供了函数cv2.polarToCart来实现相同的功能。下面的例子就是演示该函数的使用方式: #python 3.7.4,opencv4.1 #蔡军生 https://…

2026/7/28 18:12:07 阅读更多 →
Hibernate(一)

Hibernate(一)

总结Hibernate使用步骤贴 1&#xff0c;搭建环境 1.1 导入所有需要的jar包 包括 Hibernate框架包、sql驱动包、日志包。 1.2创建对应的实体类 根据orm思想创建的实体类&#xff0c;将与与表中的各项属性对应&#xff08;只是对应&#xff0c;不是完全一致&#xff09;。 …

2026/7/28 18:11:07 阅读更多 →

日新闻

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿&#xff01;3步让你的暗影精灵笔记本重获新生 【免费下载链接】OmenSuperHub Control Omen laptop performance, fan speeds, and keyboard lighting, and unlock power limits. 项目地址: https://gitcode.com/gh_mirrors/om/OmenSuperHub 你是否也曾为官方Om…

2026/7/28 0:00:43 阅读更多 →
RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

做 RAG 的人应该都踩过这个致命的坑&#xff1a;把几百页的财报、法规、技术手册扔给向量库&#xff0c;问一个具体问题&#xff0c;搜出来的全是沾边但没用的内容 —— 关键信息要么被硬切块拆碎了&#xff0c;要么藏在几十条结果的最下面。语义相似≠真正相关&#xff0c;这个…

2026/7/28 0:00:43 阅读更多 →
抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

2026年做短视频运营&#xff0c;从抖音上扒文案早就不是偷偷抄笔记的事了。我刚开始做内容的时候&#xff0c;每天刷半小时抖音&#xff0c;手动把爆款视频的口播敲进备忘录&#xff0c;一条2分钟的视频得花十来分钟&#xff0c;碰到语速快的还要反复回听。后来试了一圈工具&am…

2026/7/28 0:00:43 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档&#xff0c;可以直接使用&#xff01;系统支持图片、视频、摄像头等多种方式检测裂缝&#xff0c;功能强大实用。 1数据集6000张 8各类别

2026/7/28 12:04:22 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像&#xff01; pubg绝地求生目标检测数据集 1分类&#xff1a;e_body&#xff0c;14905个标签&#xff0c;txt格式 共计14244张图&#xff0c;99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/28 8:29:16 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别&#xff1a; allies enemy tag图片总量&#xff1a;7247张训练集&#xff1a;5139张验证集&#xff1a;1425张测试集&#xff1a;683张标注状态&#xff1a;全部已标注&#xff0c;即拿即用数据格式&#xff1a;支持YOLO格式及其他格式&#…

2026/7/28 5:03:42 阅读更多 →

月新闻