PytorchAutoDrive: 自动驾驶感知的开源框架

RayRay
PytorchAutoDrive语义分割车道检测PyTorch模型部署Github开源项目

pytorch-auto-drive

PytorchAutoDrive简介

PytorchAutoDrive是一个纯Python实现的自动驾驶感知框架,基于PyTorch深度学习框架开发。该项目由Zhengyang Feng和Shaohua Guo主要维护,旨在为自动驾驶领域的研究人员和开发者提供一个功能全面、易于使用的工具集。

主要特点

PytorchAutoDrive具有以下几个突出特点:

  1. 支持多种语义分割和车道线检测模型
  2. 基于配置文件的实现,易于修改和扩展
  3. 代码模块化程度高,易于理解和二次开发
  4. 提供数据加载、图像处理、可视化等辅助功能
  5. 支持混合精度训练,提高训练效率
  6. 集成TensorBoard日志记录
  7. 支持ONNX和TensorRT模型部署

这些特性使PytorchAutoDrive成为一个功能完备、易用性强的自动驾驶感知框架。无论是进行学术研究还是实际应用开发,都可以基于该框架快速构建和验证自己的想法。

支持的数据集

PytorchAutoDrive支持多个主流的自动驾驶数据集,包括:

语义分割数据集

  • PASCAL VOC 2012
  • Cityscapes
  • GTAV
  • SYNTHIA

其中GTAV和SYNTHIA主要用于无监督域适应(UDA)的基线设置,使用Cityscapes验证集作为验证。

车道线检测数据集

  • CULane
  • TuSimple
  • LLAMAS
  • BDD100K (进行中)

这些数据集涵盖了不同的场景和标注方式,为开发鲁棒的车道线检测算法提供了丰富的训练和测试数据。

CULane数据集示例

支持的模型

PytorchAutoDrive实现了多种经典和最新的语义分割及车道线检测模型:

语义分割模型

  • FCN (ResNet-101)
  • DeeplabV2 (ResNet-101)
  • DeeplabV3 (ResNet-101)
  • ENet
  • ERFNet

车道线检测模型

  • Baseline (支持多种骨干网络)
  • SCNN
  • RESA
  • SAD (开发中)
  • PRNet (开发中)
  • LSTR
  • LaneATT
  • BézierLaneNet

这些模型涵盖了从轻量级到大型网络的多种架构,可以根据具体需求选择合适的模型。同时,框架的模块化设计也使得添加新模型变得简单。

使用指南

安装

  1. 克隆代码仓库:
git clone https://github.com/voldemortX/pytorch-auto-drive.git cd pytorch-auto-drive
  1. 安装依赖:
pip install -r requirements.txt
  1. 按照 DATASET.md 的说明准备数据集

训练模型

以车道线检测为例,训练模型的基本命令如下:

python main_landet.py --train \ --config=<config file path> \ --mixed-precision

其中--config指定配置文件路径,--mixed-precision启用混合精度训练。

测试模型

测试模型的基本命令:

python main_landet.py --test \ --config=<config file path> \ --mixed-precision

可视化

PytorchAutoDrive提供了丰富的可视化工具,可以对图像和视频进行推理并可视化结果。详细使用方法请参考 VISUALIZATION.md

车道线检测可视化示例

模型部署

PytorchAutoDrive支持将训练好的模型导出为ONNX格式,并提供了TensorRT加速的支持。这使得模型可以更容易地部署到实际的自动驾驶系统中。详细的部署指南可以参考 DEPLOY.md

贡献指南

PytorchAutoDrive是一个开源项目,欢迎社区贡献。如果您想为项目做出贡献,请参考 CONTRIBUTING.md 了解具体的贡献流程和规范。

结语

PytorchAutoDrive为自动驾驶感知任务提供了一个全面而强大的开发框架。无论您是研究人员还是开发者,都可以利用这个工具来加速自己的工作。我们期待看到更多基于PytorchAutoDrive的创新成果,推动自动驾驶技术的进步。

如果您在使用过程中有任何问题或建议,欢迎在GitHub仓库中提出issue或pull request。让我们共同努力,为自动驾驶的未来贡献力量! 🚗💨

编辑推荐精选

Pixmax

Pixmax

一站式AI短剧创作平台

Pixmax专注打造下一代“ AI 视觉创作引擎”,整合行业顶尖 AI 大模型、工工业级精准控制及企业级协同管理功能,是全方位的 AI 内容创作平台。

豆包

豆包

字节跳动旗下 AI 智能助手

字节跳动旗下 AI 智能助手

GPT Plus|Pro充值

GPT Plus|Pro充值

GPT充值

支持 ChatGPT Plus / Pro 充值服务,支付便捷,自动发货,售后可查。

GPT Image 2中文站

GPT Image 2中文站

AI 图片生成平台

GPT Image 2 是面向用户的 AI 图片生成平台,支持文生图、图生图及多模型创意工作流。

Vecbase

Vecbase

你的AI Agent团队

Vecbase 是专为 AI 团队打造的智能工作空间,将数据管理、模型协作与知识沉淀整合于一处。算法、产品与业务在同一平台无缝协同,让从数据到 AI 应用的落地更快一步。

音述AI

音述AI

全球首个AI音乐社区

音述AI是全球首个AI音乐社区,致力让每个人都能用音乐表达自我。音述AI提供零门槛AI创作工具,独创GETI法则帮助用户精准定义音乐风格,AI润色功能支持自动优化作品质感。音述AI支持交流讨论、二次创作与价值变现。针对中文用户的语言习惯与文化背景进行专门优化,支持国风融合、C-pop等本土音乐标签,让技术更好地承载人文表达。

QoderWork

QoderWork

阿里Qoder团队推出的桌面端AI智能体

QoderWork 是阿里推出的本地优先桌面 AI 智能体,适配 macOS14+/Windows10+,以自然语言交互实现文件管理、数据分析、AI 视觉生成、浏览器自动化等办公任务,自主拆解执行复杂工作流,数据本地运行零上传,技能市场可无限扩展,是高效的 Agentic 生产力办公助手。

lynote.ai

lynote.ai

一站式搞定所有学习需求

不再被海量信息淹没,开始真正理解知识。Lynote 可摘要 YouTube 视频、PDF、文章等内容。即时创建笔记,检测 AI 内容并下载资料,将您的学习效率提升 10 倍。

AniShort

AniShort

为AI短剧协作而生

专为AI短剧协作而生的AniShort正式发布,深度重构AI短剧全流程生产模式,整合创意策划、制作执行、实时协作、在线审片、资产复用等全链路功能,独创无限画布、双轨并行工业化工作流与Ani智能体助手,集成多款主流AI大模型,破解素材零散、版本混乱、沟通低效等行业痛点,助力3人团队效率提升800%,打造标准化、可追溯的AI短剧量产体系,是AI短剧团队协同创作、提升制作效率的核心工具。

seedancetwo2.0

seedancetwo2.0

能听懂你表达的视频模型

Seedance two是基于seedance2.0的中国大模型,支持图像、视频、音频、文本四种模态输入,表达方式更丰富,生成也更可控。

下拉加载更多