高德地图高德-三维重建/生成模型与世界模型算法工程师/专家-视觉技术中心
社招全职2年以上技术类-算法地点:北京状态:招聘
任职要求
1. 计算机科学、人工智能、电子信息等相关专业研究生学历,博士优先; 2. 扎实的深度学习/机器学习/数学功底,熟悉Transformer、Diffusion Models、Reinforcement Learning、LLM等相关技术; 3. 重点技能: a. 至少深入掌握一项: i. SfM, MVS, NeRF, 3DGS 等三维重建及渲染算法 ii. Diffusion Models, Vi…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
我们是高德视觉技术中心,驱动高德实现高精度地图、三维重建、LLM/VLM,AI Agent等核心技术,持续突破自动驾驶、AR导航、具身智能、推广搜和生活服务等领域的技术边界。我们团队致力于利用三维重建、生成式世界模型、多模态大模型等技术打通虚拟与现实,探索空间智能技术路线,让算法在真实应用中产生即时经济价值与社会影响力。 团队gihub主页:https://github.com/amap-cvlab 岗位职责: 1. 3D动/静态生产:利用三维重建、生成模型、多模态大模型对单图、视频完成动态物体/静态场景重建、生成、编辑,并得到可交互的3D、长时序视频; 2. 世界模型构建:结合具身智能、自动驾驶等数据探索空间智能的统一范式,完成环境感知、智能体预测、决策规划等任务并得到未来状态和未来传感器信息,为强化学习提供基座; 3. 产线落地与性能优化:与具身智能、自动驾驶、智能导航等业务协同,完善仿真数据链路; 4. 跟踪学术界和工业界在生成式AI/世界模型相关领域的最新进展,保持公司在该领域的技术领先地位。
包括英文材料
学历+
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
机器学习+
https://www.youtube.com/watch?v=0oyDqO8PjIg
Learn about machine learning and AI with this comprehensive 11-hour course from @LunarTech_ai.
https://www.youtube.com/watch?v=i_LwzRVP7bg
Learn Machine Learning in a way that is accessible to absolute beginners.
https://www.youtube.com/watch?v=NWONeJKn6kc
Learn the theory and practical application of machine learning concepts in this comprehensive course for beginners.
https://www.youtube.com/watch?v=PcbuKRNtCUc
Learn about all the most important concepts and terms related to machine learning and AI.
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
还有更多 •••
相关职位
实习阿里巴巴研究型实
1、负责神经渲染建模相关技术研究,包括模型表示、模型压缩、模型编辑、模型质量优化、模型仿真等等方面; 2、负责神经渲染建模相关图象图形技术研究,包括图像检测、分割、超分,位姿估计,Mesh模型优化等等; 3、负责扫描建模相关技术研究,包括可微分几何建模、可微分纹理生成、基于深度先验的建模算法等等; 4、负责神经渲染建模的渲染相关研究,包括重光照技术、神经渲染的材质表示、透明反光材质渲染等等; 5、负责结合生成技术做3D物体模型、3D场景模型的生成,保障生成模型的高效果、可控性等等。
更新于 2026-03-20北京|杭州
实习阿里巴巴2027
1. 负责结合视频生成及大模型技术的3D模型编辑算法研发。重点攻克3D数字人妆容、发型、服饰的精细化编辑,提升算法在复杂编辑场景下的高稳定性与时空一致性; 2. 参与Physical AI与3D场景生成技术的深研。探索世界基础模型(WFM)算法,实现从单幅图像到可自由探索的3DGS(3D Gaussian Splatting)场景转换,以及从普通视频到视角连续、可交互空间视频的语义跃迁; 3. 研究3D信息(如几何、深度、姿态)与视频生成大模型的深度融合。通过3D先验实现对数字人姿态、表情及动作的高度可控生成,打造新一代高质量、高可控的短视频内容生产工具; 4. 与跨部门优秀人才协作,推动前沿算法在实际业务场景中的应用与落地,参与从算法原型设计到规模化部署的全过程,持续通过技术创新解决行业挑战。
更新于 2026-04-07北京|杭州
实习阿里巴巴日常实习
参与实现先进的Image to 3D生成算法,重点关注用于室内设计的家具建模应用,设计并实现高效的3D表征,改善网络结构,研究不同的预训练以及后训练方案,负责不同算法消融实验,清晰记录研究过程、方法及结果,产出高保真、高还原度的3D模型。
更新于 2026-05-21杭州