
哈啰端到端大模型算法工程师-【自动驾驶】
任职要求
任职资格: 1. 本科及以上学历,专业方向包括计算机、软件、自动化、模式识别等理工科,工作经验不小于1年; 2. 具备较强的编程能力,精通Python及C++语言,熟悉Docker容器化部署,有良好的编程习惯和标准化的代码风格; 3. 熟悉模型迭代的基础流程体系,有样本生成、数据挖掘、模型训练、量化部署等开发经…
工作职责
工作职责: 1. 端到端模型的选型、设计、训练和优化,与团队协作完成模型的测试、验证和部署; 2. 构建数据标注和评测流程,并基于模型表现进行数据挖掘、数据清洗、数据配比等提升模型效果; 3. 分析路测数据中的corner场景,设计数据和模型等手段,提升该场景下模型表现并解决问题; 4. 利用数据增广、迁移学习、对比学习和强化学习等方法,提升数据利用效率,优化模型泛化能力; 5. 跟踪行业前沿技术,将创新性方案应用于实际项目。

1. 端到端模型研发: 负责新一代 End-to-End 自动驾驶算法的泊车场景的研发,包括但不限于基于 World Model(世界模型)、Video Generation(视频生成) 或 VLM(视觉语言模型) 的驾驶策略生成。 2. 数据闭环与评测: 搭建针对生成式规划算法的自动化评测体系,利用大模型进行数据挖掘、自动标注(Auto-labeling)及场景重建,通过数据闭环持续提升模型性能。

我们是谁? 作为中国领先的数字地图内容及导航服务提供商,高德地图日均服务数亿用户出行决策,每日处理超百亿级位置数据。视觉技术中心是驱动高德实现厘米级高精地图、实时三维重建、多模态感知等核心技术的引擎,持续突破自动驾驶、AR导航、智慧交通等领域的技术边界。 团队gihub主页:https://github.com/amap-cvlab 为何加入我们? 挑战世界级技术难题,追求智能上限 用AI驱动国民级APP的产品迭代和颠覆式创新 岗位职责: 团队主要聚焦多模态大模型技术在端到端自动驾驶的应用,我们期待你的工作将覆盖以下至少一个技术方向即可: 1. 在端到端自动驾驶、多模态大模型的训练及调优、BEV感知、基于深度学习/强化学习的规划控制、RLHF、驾驶场景视频生成等领域具备丰富且有独创性的研究经历。 2. 探索多模态大模型在下游任务中的技术能力,包括但不限于图文对齐/识别、跨模态理解生成、多模态检索、VLM端到端自动驾驶、世界模型等。 3. 了解大模型模型的训练/微调/推理加速方法,包括但不限于模型结构调优、训练效率提升、高效低成本微调、Muti-token推理,模型部署加速等。 4. 参与自动驾驶系统中机器学习算法的研究、开发与优化,包括但不限于深度学习算法在端到端感知大模型、规控大模型、视觉语言大模型等方面的应用。 5. 负责收集、整理和分析自动驾驶相关的数据集,进行数据预处理和标注,以提高模型的准确性和泛化能力。 6. 设计和实现端到端自动驾驶模型的训练流程,包括选择合适的优化算法、调整超参数、评估模型性能等,确保模型在不同场景下的稳定性和可靠性。

1. 参与端到端自动驾驶大模型的架构设计与核心算法研究,整合感知、预测与规划模块,推动模型整体性能持续提升; 2. 基于Transformer、VLM等主流架构,探索感知-规划一体化建模方法,提升模型在复杂、长尾驾驶场景下的泛化与鲁棒性; 3. 结合Momenta海量量产路测数据,设计数据闭环驱动的训练策略,构建高质量数据集,加速模型迭代; 4. 追踪自动驾驶和人工智能领域等相关领域最新研究进展,探索前沿技术在端到端驾驶模型中的落地应用。 5. 基于端到端大模型,进行世界模型算法预研,提升端到端模型效果和泛化性。