logo of baidu

百度自动驾驶数据闭环高级后端工程师(J94282)

社招全职2年以上IDG地点:北京状态:招聘

任职要求


-2年及以上经验,本科及以上学历
-熟练的python语言技能,熟悉shell命令及开发,掌握python/c++/go其中一门语言,对多线程、异步、大数据高并发等系统有独立设计经验,扎实的计算机科学基础,拥有缓存消息队列,关系数据库,nosql,操作系统,网络协议等相关知识,并对其中任一项具备深入的理解和认识
-熟悉分布式计算相关技术,熟悉hadoop、spark、storm等系统原理和适用场景,并拥有集群设计和SRE经验,具备服务网格,大…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


-负责自动驾驶数据全链路数据流构建,完成数据闭环下的AI Infra系统构建,包含挖掘相关框架、标注、数据管道、分布式训练、模型评测、推理和部署全链路的建设
-负责数据闭环系统稳定性和效率建设,对数据飞轮落地有想法和落地路径
-负责面向AI Infra 的数据存储系统建设,了解高吞吐下的Infra 框架设计
-负责面向大模型时代的工程架构优化工作,对各业务进行对接和合理化评估,针对现行系统中各种问题进行分析优化,给出设计优化方案并实现
包括英文材料
学历+
Python+
Bash+
C+++
Go+
多线程+
大数据+
高并发+
缓存+
消息队列+
NoSQL+
Hadoop+
还有更多 •••
相关职位

logo of didi
社招技术

深入理解自动驾驶算法逻辑,负责数据闭环系统架构与开发,设计并实现高效可扩展的数据闭环平台,覆盖数据挖掘、数据标注、数据集管理、模型训练评估和部署全链路,以支持模型开发: 1)搭建面向自动驾驶大模型的数据生产系统,涵盖数据清洗、增强、合成与标注全流程; 2)构建数据版本管理与回溯系统,实现数据集迭代过程的可追踪性,满足模型训练合规要求; 3)负责自动化标注与数据流水线,构建与迭代自动化、半自动化标注工具链(如大模型预标注、人机协同标注),提升数据产出的效率与质量; 4)与算法工程师及AI基础架构团队紧密合作,建设相关平台工具,提升自动驾驶模型的迭代效率和效果。

更新于 2026-06-09北京
logo of didi
社招技术

职位描述: 1)设计并实现高并发、高可用的数据标注平台后端架构,支持图像、点云、视频等多模态自动驾驶数据的标注需求; 2)搭建标注数据存储与治理系统,保障大规模标注数据(PB级)的安全存储与高效检索; 3)搭建面向自动驾驶大模型的数据生产系统,涵盖数据清洗、增强、合成与标注全流程; 4)构建数据版本管理与回溯系统,实现数据集迭代过程的可追踪性,满足模型训练合规要求;

更新于 2025-10-21北京
logo of meituan
实习软硬件服务-无人

1、参与自动驾驶数据闭环相关工作,支持数据采集、清洗、筛选、标注及质量分析等流程优化。 2、协助建设数据闭环链路,参与问题数据挖掘、场景归因、样本回流与效果跟踪。 3、配合算法、数据、工程团队,推动感知/规划/控制等模块相关数据需求落地。 4、参与长尾场景、异常 case、典型问题的分析整理,沉淀数据策略和运营方法。 5、支持日常数据分析与专项项目推进,输出过程文档、分析报告和复盘总结。

更新于 2026-06-15北京
logo of hello
社招2年以上算法

1、数据闭环体系搭建与落地:负责自动驾驶全链路数据闭环体系设计与搭建,日均处理亿级传感器原始数据及标注数据,保障数据从采集、处理到模型训练的端到端流转,支撑感知、决策规划等端到端模型的高效训练; 2、数据闭环工具链研发: 2.1 云端数据处理 pipeline 开发: •针对标注数据、场景数据,设计并落地数据清洗(去噪、去重、异常过滤)、解析、切片、抽帧、送标(对接标注平台)的全流程自动化 pipeline; •优化 pipeline 吞吐量与延迟,目标支撑日均 10 万 + 场景数据处理,服务算法团队数据生产需求; •推动工具链部署落地,解决线上运行故障(如数据阻塞、接口兼容问题),保障工具链可用性。 2.2 高价值场景数据挖掘体系建设: •搭建 “规则 + 大模型” 双驱动的数据挖掘产线:针对规则挖掘,设计接入多种传感器、定位、感知、底盘、车身信号并优化规则策略;针对大模型挖掘任务,完成数据方案制定、模型微调、loss优化、模型评测等; •与算法团队协作迭代挖掘策略,提升 corner case 召回率(目标≥85%)。

更新于 2025-10-10上海