Autoware城市数据集采集与处理技术实践
2025-05-24 05:18:30作者:龚格成
数据集背景与目标
Autoware自动驾驶框架需要针对城市复杂场景进行算法验证和性能测试,特别是隧道和桥梁等极端环境下的定位与建图能力。为此,技术团队开展了一次专门的城市数据集采集工作,旨在为Autoware的LOAM-Based Localization功能开发提供高质量的测试数据。
传感器配置方案
本次数据采集采用了专业级的传感器组合:
- 激光雷达:Hesai Pandar XT32,这是一款32线机械式激光雷达,具有360°水平视场角和40°垂直视场角
- 组合导航系统:Applanix POS LVX GNSS/INS,提供厘米级定位精度和稳定的姿态测量
传感器间通过PPS脉冲信号和GPRMC时间信息进行硬件级时间同步,确保数据的时间一致性。激光雷达采用Strongest回波模式工作,优先记录最强反射信号。
数据采集路线规划
采集路线经过精心设计,覆盖了典型的城市复杂场景:
- 长距离隧道场景:测试GNSS信号完全缺失环境下的定位能力
- 大型桥梁场景:评估高度变化和开阔水域环境对传感器的影响
- 城市道路混合场景:包含常规道路、交叉路口等典型城市元素
数据处理流程
原始数据格式
- 激光雷达数据:PCAP格式原始数据包,包含点云信息和时间同步标记
- GNSS/INS数据:T04格式原始数据及处理后的文本格式,包含位置、姿态和速度信息
- ROS2数据包:包含传感器原始话题和预处理数据
坐标系统说明
- GNSS/INS采用NED(北-东-地)坐标系
- 激光雷达坐标系定义:X轴向后,Y轴向右,Z轴向上
- 传感器间标定参数精确测量,包含位置偏移和姿态旋转
点云生成技术
使用LOAM算法框架进行点云建图,处理流程包括:
- 点云特征提取:分离角点和平面点特征
- 运动补偿:补偿车辆运动造成的点云畸变
- 地图优化:结合GNSS/INS信息进行全局优化
- 降采样处理:采用0.2米体素网格进行点云精简
数据集技术特点
- 多场景覆盖:完整包含城市典型复杂场景
- 时间同步精度:硬件级同步确保数据时间一致性
- 数据完整性:提供原始数据和处理后数据
- 坐标系明确:所有传感器坐标系关系清晰定义
- 动态物体标记:原始数据中包含动态物体信息
应用价值
该数据集特别适用于以下自动驾驶技术研发:
- 无GNSS环境下的定位算法测试
- 激光雷达建图算法评估
- 多传感器融合系统验证
- 自动驾驶系统在极端场景下的鲁棒性测试
技术挑战与解决方案
在数据采集和处理过程中,团队遇到了若干技术挑战:
- 时间同步问题:初期数据存在微小时间偏差,通过优化硬件连接和增加时间校验标记解决
- 动态物体干扰:采用基于运动一致性的滤波算法减少动态物体对地图的影响
- 大场景建图:使用MGRS投影坐标系处理大范围场景,避免坐标溢出
- 传感器标定:通过多位置观测和优化算法提高标定精度
数据集使用建议
对于希望使用该数据集的研究人员,建议:
- 首先了解各传感器的坐标系定义
- 注意GNSS/INS数据的后处理特性
- 对于定位测试,建议从部分场景开始逐步扩展到完整路线
- 可利用提供的不同特征点云进行算法针对性测试
该数据集的建立为Autoware框架的城市自动驾驶能力提升提供了重要的测试基础,特别是为隧道、桥梁等复杂场景下的定位算法开发提供了宝贵的真实数据支持。
登录后查看全文
热门项目推荐
相关项目推荐
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0198
cann-learning-hubCANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。Jupyter Notebook0129
MiMo-V2.5-Pro-FP4-DFlashMiMo-V2.5-Pro-FP4-DFlash 是驱动 MiMo-V2.5-Pro-UltraSpeed 的底层模型: FP4 量化骨干网络:对 MoE 专家采用 MXFP4 量化,同时保持模型其他部分的更高精度,在几乎无损质量的前提下,显著减小模型体积并降低内存带宽压力。 BF16 DFlash 草稿生成器:用于块扩散推测解码,每次前向传播可生成一整个块的 tokens,并让骨干网络一步完成验证。 两者协同作用,既降低了每参数的位宽,又减少了骨干网络前向传播的次数,而这两者正是万亿参数模型解码过程中的两大主要成本来源。Python00
JoyAI-EchoJoyAI-Echo,这是一个独立的、仅用于推理的版本,旨在实现分钟级多镜头音视频生成。它采用了经过蒸馏的DMD生成器、配对的跨模态记忆以及故事级别的一致性。其性能的核心在于,一个跨模态视听记忆库能够在长达五分钟的视频中保持角色外观和语音音色的一致性。同时,一个训练后处理流程将基于记忆的强化学习与分布匹配蒸馏相结合,实现了7.5倍的速度提升,显著增强了视觉质量和对齐效果。00
AstrBot✨ 易上手的多平台 LLM 聊天机器人及开发框架 ✨ 平台支持 QQ、QQ频道、Telegram、微信、企微、飞书 | OpenAI、DeepSeek、Gemini、硅基流动、月之暗面、Ollama、OneAPI、Dify 等。附带 WebUI。Python08
handy-ollama动手学Ollama,CPU玩转大模型部署,在线阅读地址:https://datawhalechina.github.io/handy-ollama/Jupyter Notebook07
项目优选
收起
暂无描述
Dockerfile
767
5.02 K
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
865
1.96 K
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
691
1.36 K
Ascend Extension for PyTorch
Python
728
903
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
459
455
deepin linux kernel
C
32
16
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
1.09 K
1.12 K
本仓库是 Flutter SDK 与 Flutter Engine 的 OpenHarmony 适配版本,由 CPF-Flutter 团队维护。开发者可使用熟悉的 Flutter 技术栈开发 OpenHarmony 应用,3.35.7 及以后的适配版本可基于本仓库源码构建支持 OpenHarmony 的 Flutter Engine。
Dart
1.02 K
265
Claude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed.
Get Started
Rust
1.92 K
198
CANNBot 是面向 CANN 开发的用于提升开发效率的系列智能体,本仓库为其提供可复用的 Skills 模块。
Python
1.01 K
631