Automated Weld Seam Recognition and 3D Mapping for Robotic Post Processing Using Photogrammetry and Semantic Segmentation
采用语义分割与摄影测量结合的工件焊缝快速定位方法,误差约4.2mm。
核心发现
方法论
该方法通过多视角图像采集,利用SegFormer深度学习模型进行焊缝语义分割,提取焊缝轮廓。随后,采用RealityScan软件基于摄影测量技术进行工件三维重建,结合相机参数和深度图,将二维焊缝路径投影到三维模型中,实现焊缝的空间定位。该流程包括:• 多视角图像采集,•语义分割生成焊缝掩码,•轮廓提取与中心线拟合,•深度信息投影,•多视角融合,形成三维焊缝路径。整个流程实现了从二维图像到三维焊缝路径的高效转换,为机器人后续操作提供基础。
关键结果
- 通过68张1920×1080像素图像,成功重建工件三维模型,几何误差约3mm,满足后续精确测量需求。
- SegFormer模型在焊缝检测中表现优异,平均识别准确率达85%,在不同光照和反光条件下仍保持较好鲁棒性。
- 焊缝空间定位误差(RMSE)为4.2mm,验证了多视角图像结合摄影测量的可行性,误差在毫米级范围内,适合作为机器人路径规划的预处理基础。
研究意义
该研究突破了传统激光扫描在大工件高精度测量中的局限,提出基于普通智能手机图像的快速焊缝定位方案,显著提升了工业现场的测量效率。结合深度学习与摄影测量技术,为工业机器人实现自动焊缝识别、路径规划提供了新思路,推动了智能制造的发展。该方法降低了设备成本,简化了操作流程,具有广泛的工业应用潜力。
技术贡献
论文创新点在于将语义分割与摄影测量结合,提出多视角焊缝路径自动提取流程。引入SegFormer模型提升焊缝识别鲁棒性,结合深度图实现三维投影,解决了传统点云扫描成本高、效率低的问题。该流程实现了二维焊缝检测到三维空间路径的无缝转换,为机器人路径规划提供了可行的中间结果,具有理论创新和工程应用价值。
新颖性
本研究首次将基于深度学习的语义分割与摄影测量相结合,用于大型工件焊缝的快速定位。不同于以往仅依赖激光或结构光的高精度扫描,本方法利用普通手机图像实现粗略定位,极大降低成本和时间。创新在于多视角融合和空间路径投影,为工业自动化提供了新技术路径。
局限性
- 模型训练依赖有限的公开数据集,受光照、反光等环境变化影响较大,识别鲁棒性有待提升。
- 摄影测量重建存在一定误差,尤其在表面纹理不足或反光强烈的区域,影响焊缝路径的精度。
- 当前流程主要适用于较规则的焊缝,复杂焊缝形态可能需要更精细的后处理算法。
未来方向
未来将扩展训练数据集,增强模型对不同环境的适应性,结合多模态信息提升焊缝识别精度。计划引入表面法线和工具姿态估计,优化焊缝路径的平滑性和准确性。此外,将探索实时处理能力,实现现场快速焊缝定位与路径规划,推动工业机器人自主作业的智能化。
AI 总览摘要
工业制造中,焊缝的精确识别对于自动化后处理至关重要。传统方法依赖激光扫描或结构光设备,虽然精度高,但成本昂贵且耗时,特别是在大工件场景中。为解决这一难题,本文提出了一种结合普通手机图像、多视角摄影测量和深度学习的焊缝快速定位方案。
该方法通过多角度采集图像,利用预训练的SegFormer模型进行焊缝语义分割,提取焊缝轮廓。随后,采用RealityScan软件进行摄影测量重建,生成工件的三维模型,并结合相机参数和深度信息,将二维焊缝路径投影到三维空间中,实现空间定位。整个流程简洁高效,显著降低了设备成本和操作复杂度。
实验中,采用68张手机拍摄的高分辨率图像,成功重建了工件模型,几何误差约3mm,验证了流程的实用性。焊缝识别的准确率达85%,空间定位误差为4.2mm,满足工业机器人路径规划的基本需求。该技术不仅提升了焊缝检测的效率,还为后续的机器人自动焊接、打磨和检测提供了可靠的基础。
未来,研究将聚焦于模型鲁棒性提升、多模态信息融合以及实时处理能力,推动智能制造的自动化水平。整体而言,该方案为工业焊缝检测提供了一种低成本、高效率的解决方案,有望在实际生产中得到广泛应用。
深度分析
研究背景
随着工业自动化的发展,焊缝检测成为保障焊接质量的关键环节。传统方法多依赖激光扫描或结构光设备,虽然精度高,但成本昂贵且操作繁琐。近年来,深度学习与摄影测量技术的结合,为大规模工件的快速检测提供了新思路。已有研究如Ruiz de Oña等的Photogrammetric Suite WeldMap,主要应用于小型工件,难以应对复杂场景。激光点云虽精确,但在大面积场景中效率低下。本文旨在结合手机图像、多视角摄影测量与深度学习模型,突破现有技术瓶颈,实现大工件焊缝的快速粗略定位。
核心问题
大工件焊缝检测面临多重挑战:高精度扫描成本高、耗时长,且在复杂表面反光或纹理不足时识别困难。传统激光扫描设备虽能提供精确几何信息,但在大面积场景中效率低下,且设备成本高昂。如何利用低成本设备实现快速、准确的焊缝粗略定位,成为工业自动化中的关键难题。现有方法多依赖点云或结构光,受环境影响大,难以满足现场快速检测需求。本文提出利用普通手机图像结合深度学习与摄影测量,解决这一瓶颈。
核心创新
本研究的创新点在于:1)引入SegFormer深度学习模型进行焊缝语义分割,提升检测鲁棒性;2)结合摄影测量技术实现多视角三维重建,降低成本;3)将二维焊缝轮廓投影到三维模型中,获得空间路径。不同于传统依赖激光点云的方案,该方法利用普通手机图像,极大降低设备成本和操作复杂度。多视角融合技术确保焊缝路径的空间连续性,为机器人路径规划提供了可靠基础。这一创新组合实现了从二维检测到三维定位的无缝转换,推动工业自动化向低成本、智能化迈进。
方法详解
- �� 图像采集:用手机从多个角度拍摄工件,确保焊缝在不同视角下都被覆盖。• 语义分割:利用预训练的SegFormer模型对每张图像进行焊缝掩码预测,区分焊缝与背景。• 轮廓提取:对掩码进行滤波,连接焊缝区域,利用主成分分析估算焊缝方向,沿方向切片提取中心点,形成焊缝样条线。• 三维投影:结合摄影测量生成的深度图和相机参数,将焊缝样条线投影到三维空间。• 多视角融合:将不同视角的焊缝点合并,去除重复点和异常值,得到连续的三维焊缝路径。• 最终输出:生成空间焊缝模型,为机器人路径规划提供基础。
实验设计
实验使用一块40cm×10cm×5cm钢管焊接件,配备AprilTag标记以实现尺度校准。采集68张高分辨率图像,覆盖所有可视面。利用RealityScan软件进行摄影测量重建,获得点云模型,几何误差约3mm。焊缝检测采用SegFormer模型,训练数据包括388张公开图像,识别准确率达85%。将焊缝轮廓投影到三维模型,误差(RMSE)为4.2mm。结果验证了多视角图像结合摄影测量的可行性,整体流程实现了毫米级空间定位,为后续机器人操作提供了基础。
结果分析
重建模型几何误差约3mm,验证了流程的精度。焊缝识别准确率达85%,在不同光照条件下表现稳定。焊缝空间定位误差为4.2mm,满足工业路径规划需求。多视角融合有效减少了噪声和误差,整体流程实现了快速、低成本的焊缝粗略定位,为机器人后续精测和处理提供了可靠基础。这些结果表明,结合深度学习与摄影测量的方案具有实际应用潜力。
应用场景
该技术适用于工业现场焊缝快速检测、机器人路径规划、自动打磨和检验。只需普通手机和少量标记,即可实现大面积工件的焊缝粗略定位。未来可结合实时处理技术,提升现场应用效率,推动工业自动化升级。长远来看,该方法有望实现全自动化焊缝检测与机器人作业,降低人工成本,提升生产效率。
局限与展望
模型对光照和反光敏感,识别在强反光或低光环境下效果下降。摄影测量在纹理不足或表面反光强烈区域存在误差,影响焊缝路径精度。流程主要适用于规则焊缝,复杂焊缝形态可能需要更复杂的后处理算法。未来需增强模型鲁棒性,提升在多变环境中的适应能力,并实现实时处理。
通俗解读 非专业人士也能看懂
想象你在厨房准备一道菜,你需要找到锅里的调料瓶。传统的方法可能用手去摸,逐个检查每个瓶子,既慢又不方便。现在,你用手机拍摄厨房的全景,然后用软件自动识别出所有调料瓶的位置和轮廓。接着,利用这些图片,软件可以构建出厨房的三维模型,显示每个调料瓶的具体位置。这样,你就可以快速找到需要的调料,不用逐个摸索。这就像用相机和智能算法帮你快速找到焊缝的位置,节省时间,提高效率。
简单解释 像给14岁少年讲一样
想象你在玩一个超级复杂的拼图游戏,拼图块很多,要找到一条特定的线很难。可是,如果你用手机拍下拼图的不同角度,然后用特殊的软件帮你分析,识别出那条线在哪里,事情就变得简单多了。软件会把这些线的图片拼在一起,形成一个3D模型,就像你用积木搭建一个小房子一样。这样,你就可以很快知道那条线在房子上的具体位置。这个方法就像用手机和智能程序帮你找到焊缝的位置,不用费劲地用肉眼一块块找,节省了很多时间,也更准确!
术语表
语义分割 (Semantic Segmentation)
一种图像处理技术,将图像中的每个像素分类到不同类别中,帮助识别特定区域。
用来识别焊缝区域与背景的区别。
摄影测量 (Photogrammetry)
利用多张图片通过几何关系重建物体三维模型的方法。
实现工件的三维重建。
SegFormer
一种基于Transformer的深度学习模型,用于高效的语义分割任务。
用于焊缝区域的自动识别。
RMSE (Root Mean Square Error)
衡量预测值与真实值偏差的指标,数值越小代表误差越低。
用于评估焊缝空间定位的精度。
RealityScan
一款基于摄影测量的三维重建软件。
用来生成工件的三维模型。
开放问题 这项研究留下的未解疑问
- 1 当前模型在极端光照和复杂焊缝形态下表现不足,未来需增强鲁棒性。
- 2 如何实现实时焊缝检测与路径规划,仍是技术难点。
- 3 多模态信息融合(如激光与图像结合)仍需深入研究。
应用场景
近期应用
工业焊缝粗略检测
利用手机图像快速识别大工件焊缝位置,指导机器人进行后续高精度测量和处理。
机器人路径规划预处理
为机器人自动打磨或检验提供空间焊缝路径,减少人工干预。
远期愿景
全自动焊缝检测与机器人作业
实现现场实时焊缝识别、路径规划与自动作业,推动智能制造全面升级。
原文摘要
Accurate identification of weld seam geometries is essential for automated robotic post processing operations such as grinding, finishing, and inspection. For large workpieces, complete surface scanning using high precision laser scanners or structured light sensors can be time consuming and often generates substantial amount of data that are not relevant. This paper presents an experimental vision based pipeline for the approximate localization of weld seams. This serves as a preliminary stage before high precision measurement. The proposed approach aims to reduce the overall scanning effort and data acquisition efficiency. The proposed method includes capturing images of the workpiece from multiple viewpoints, identifying weld seams from the images using semantic segmentation, reconstructing the workpiece using photogrammetry, and projection of identified weld seams into the reconstructed model.