logo of liauto

理想汽车【理想+】具身交互大模型算法工程师-视觉-北京

校招全职算法地点:北京状态:招聘

任职要求


1. 人工智能、计算机视觉机器学习模式识别、信号处理或相关专业的硕士或博士;
2. 有语言大模型、多模态大模型、视觉大模型相关研发经验;
3. 熟练掌握P…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


“理想+”是理想汽车面向全球顶尖技术人才的校园招聘计划。我们期待你的加入,与理想汽车一起成长、分享收获,通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。

【本岗位的主要工作内容】
1. 视觉大模型视觉基座架构研发,包括视频流编码器及token压缩;
2. 视觉大模型训练管线研发,包括基座预训练、后训练、强化学习,视觉RAG等;
3. 参与视觉大模型的研发和业务落地;
4. 具身智能基座模型能力研发及落地。

【技术课题】
1. 高效视觉编码器架构研究
2. 多模态Agent大模型研发
包括英文材料
OpenCV+
机器学习+
模式识别+
还有更多 •••
相关职位

logo of liauto
校招算法

“理想+”是理想汽车面向全球顶尖技术人才的校园招聘计划。我们期待你的加入,与理想汽车一起成长、分享收获,通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。 【本岗位的主要工作内容】 1. 视觉大模型视觉基座架构研发,包括视频流编码器及token压缩; 2. 视觉大模型训练管线研发,包括基座预训练、后训练、强化学习,视觉RAG等; 3. 参与视觉大模型的研发和业务落地; 4. 具身智能基座模型能力研发及落地。 【技术课题】 1. 高效视觉编码器架构研究 2. 多模态Agent大模型研发

杭州
logo of liauto
校招算法

“理想+”是理想汽车面向全球顶尖技术人才的校园招聘计划。我们期待你的加入,与理想汽车一起成长、分享收获,通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。 【本岗位的主要工作内容】 1. 负责多模态端到端大模型的多模态算法研发创新和落地,包括多模态数据管线建设、多模态对齐、多模态预训练、多模态后训练、多模态强化学习; 2. 语音大模型的探索与创新研究,打造技术影响力; 3. 具身智能基座模型能力研发及落地。 【技术课题】 1. 全模态全双工模型研究 2. 具身汽车Agent模型研发 3. 具身机器人Agent模型研发

杭州
logo of liauto
校招算法

“理想+”是理想汽车面向全球顶尖技术人才的校园招聘计划。我们期待你的加入,与理想汽车一起成长、分享收获,通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。 【本岗位的主要工作内容】 1. 负责多模态端到端大模型的多模态算法研发创新和落地,包括多模态数据管线建设、多模态对齐、多模态预训练、多模态后训练、多模态强化学习; 2. 语音大模型的探索与创新研究,打造技术影响力; 3. 具身智能基座模型能力研发及落地。 【技术课题】 1. 全模态全双工模型研究 2. 具身汽车Agent模型研发 3. 具身机器人Agent模型研发

北京
logo of liauto
校招算法

“理想+”是理想汽车面向全球顶尖技术人才的校园招聘计划。我们期待你的加入,与理想汽车一起成长、分享收获,通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。 【本岗位的主要工作内容】 参与构建机器人 Agent 模型与系统,让机器人具备自主规划、长期任务执行、自主恢复和持续学习能力。 1. 构建机器人长程任务规划(Long-horizon Planning)能力; 2. 研究 Embodied Agent、Memory、Reasoning、Tool Use 等关键技术; 3. 探索机器人自主决策、自主恢复、多阶段任务执行等能力; 4. 构建机器人 Agent 框架,实现模型、工具和环境的协同; 5. 推动 Agent 能力在真实机器人上的落地与应用。 【技术课题】 机器人agent模型与系统

上海