理想汽车大模型算法实习生
实习兼职算法与软件地点:上海状态:招聘
任职要求
1.人工智能、计算机科学、自动化、机器学习、机器人等相关专业硕士/博士在校生,基础扎实,有相关方向科研或项目经历者优先; 2.熟练掌握强化学习、CV、LLM 核心理论与技术原理,熟悉各技术在具身智能、智能Agent场景的应用逻辑。具备较强的算法建模、问题拆解与方案设计能力具备良好的科研思维与问题解决能力; 3.熟悉 P…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1.参与自动驾驶/具身智能、智能Agent相关算法研发与落地工作,聚焦感知、决策、交互核心技术迭代,助力AD/具身智能系统的智能化升级; 2.基于强化学习、计算机视觉、大语言模型技术,开展AD/具身场景下的算法建模、实验验证与效果优化,解决真实场景中的智能决策、环境感知、人机交互等技术问题; 3.负责Agentic AI工作流的搭建、调试与优化,打通大模型、感知算法、强化学习决策模型的协同链路,提升AD/具身智能体的自主感知、推理、执行能力。
包括英文材料
机器学习+
https://www.youtube.com/watch?v=0oyDqO8PjIg
Learn about machine learning and AI with this comprehensive 11-hour course from @LunarTech_ai.
https://www.youtube.com/watch?v=i_LwzRVP7bg
Learn Machine Learning in a way that is accessible to absolute beginners.
https://www.youtube.com/watch?v=NWONeJKn6kc
Learn the theory and practical application of machine learning concepts in this comprehensive course for beginners.
https://www.youtube.com/watch?v=PcbuKRNtCUc
Learn about all the most important concepts and terms related to machine learning and AI.
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
AI agent+
https://www.ibm.com/think/ai-agents
Your one-stop resource for gaining in-depth knowledge and hands-on applications of AI agents.
还有更多 •••
相关职位

实习研发
1、参与 Deep Learning Planning 算法设计、模型训练、评测构建等相关工作; 2、运用深度强化/机器学习等技术,优化模型结构,提高模型对复杂驾驶场景的理解和应对能力; 3、针对业务需求和实车Bad Case,设计并验证优化方案,完成算法的持续迭代; 4、负责收集、标注和处理自动驾驶相关数据,构建高质量的数据集,为模型训练提供有力支持;
更新于 2025-08-27北京
实习核心本地商业-基
1. 后训练研究:深入参与模型对齐工作,重点研究多种后训练算法;探索结果奖励和过程奖励模型的构建,提升模型在复杂逻辑下的推理能力。 2. Agentic RL优化:针对复杂业务场景,优化 Agent 的任务规划、反思与执行能力;提升模型在长链路任务中的稳定性和成功率。 3. 前沿技术落地:跟踪业界前沿技术路线,负责相关算法的复现、调优及在业务场景中的工程化落地。
更新于 2026-07-29北京
社招1-3年
1、负责利用自然语言处理和机器学习算法,实现客服、销售、收派、运营、办公职能等业务板块大模型的应用落地,支持业务目标的提升; 2、负责大模型的继续预训练、SFT、 RLHF与推理等工作,能够根据场景需求设计高效的训练方案,并解决训练中出现的问题,如过拟合、知识遗忘、上下文漂移等; 3、紧跟大模型技术的最新进展,面向集团各类业务场景,沉淀共性能力,实现大模型技术的标准化与产品化。
更新于 2026-07-02深圳