京东空间智能增强的具身端到端操作大模型探索研究
校招全职空间与具身智能方向地点:北京状态:招聘
任职要求
1. 计算机视觉、深度学习、机器人学或相关领域的本硕博在校生。 2. 具备深厚的3D视觉(空间计算)底层理论基础,精通PyTorch及Isaac Sim/Mujoco等物理仿真环境。 3. 熟悉多模态大模型(VLM)与端到…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1. 研发前沿的多模态空间智能大模型,构建机器人在具身操作中所需的Low-level复杂空间理解底座。 2. 设计并搭建高泛化能力的具身操作大模型,实现端到端的“感知-决策-控制”完整闭环。 3. 搭建高效的大规模数据生产流水线与Sim2Real(仿真到真实)训练验证平台。 4. 攻坚并建立超大规模的3D空间感知与多模态具身操作核心数据集。
包括英文材料
OpenCV+
https://learnopencv.com/getting-started-with-opencv/
At LearnOpenCV we are on a mission to educate the global workforce in computer vision and AI.
https://opencv.org/university/free-opencv-course/
This free OpenCV course will teach you how to manipulate images and videos, and detect objects and faces, among other exciting topics in just about 3 hours.
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
PyTorch+
https://datawhalechina.github.io/thorough-pytorch/
PyTorch是利用深度学习进行数据科学研究的重要工具,在灵活性、可读性和性能上都具备相当的优势,近年来已成为学术界实现深度学习算法最常用的框架。
https://www.youtube.com/watch?v=V_xro1bcAuA
Learn PyTorch for deep learning in this comprehensive course for beginners. PyTorch is a machine learning framework written in Python.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
还有更多 •••
相关职位
校招多模态大模型与应
1. 优化基于多模态大模型的3D内容生成算法,实现模型与场景等内容的可控生成与编辑,支持多模态输入驱动; 2. 探索高斯泼溅(Gaussian Splatting)等新型3D表征技术,优化模型、场景、4D及世界模型(World Models)等内容的高质量生成、高效压缩与实时渲染; 3. 推动3D空间智能生成技术在业务场景的落地,协同跨部门团队集成生成工具链路,实质性提升内容生产效率。
更新于 2025-05-19北京
校招算法类
1、探索空间智能领域前沿算法,掌握最新技术趋势; 2、设计并实现大规模生成式AI算法,包括但不限于图像/视频生成、3d/4d内容生成; 3、负责AIGC相关算法的优化和迭代,包含理解、生成、编辑等核心模块; 4、参与团队合作,与团队共同解决空间智能在房产行业落地的技术问题。
更新于 2026-03-10北京
实习算法类
1、探索空间智能领域前沿算法,掌握最新技术趋势; 2、设计并实现大规模生成式AI算法,包括但不限于图像/视频生成、3d/4d内容生成; 3、负责AIGC相关算法的优化和迭代,包含理解、生成、编辑等核心模块; 4、参与团队合作,与团队共同解决空间智能在房产行业落地的技术问题。
更新于 2026-06-02北京