高德地图高德-3D/视频生成与世界模型算法专家/工程师-视觉团队
任职要求
"【任职要求】 1. 计算机科学、人工智能、电子信息等相关专业研究生学历,博士优先; 2. 扎实的深度学习 / 机器学习 / 数学功底,熟悉 Transformer、Diffusion/Flow Matching Models、Reinforcement Learning 原理 3. 重点技能: a. 至少深入掌握一项: i. SfM, MVS, NeRF, 3DGS 等三维重建及渲染算法; ii. Diffusion Models, Vi…
工作职责
我们是高德视觉技术中心,专注于以计算机视觉技术为核心的前沿研究与创新应用,致力于打造时空互联网领域的核心技术能力。 我们致力于构建 “真实世界 × 虚拟世界” 的生成式世界模型,引领多模态 AI 赋能智慧出行和日常生活。团队成员参与端到端 3D+视频+语言 大模型的研发,与阿里云算力、十亿级全域图像 / 点云 / 出行数据深度结合,让算法在真实应用中产生即时经济价值与社会影响力。 团队主页:https://github.com/amap-cvlab 岗位职责: 1. 核心算法研发:主导 1B-100B 参数级世界模型 / VLA / VLM 网络的整体方案与关键模块创新; 2. 高效预训练与微调:构建跨模态自监督目标(时序一致性、物理一致性、语言对齐等),并推动 SFT → DPO → RL-HF 全链路落地上线; 3. 跨模态推理与生成:针对 3D 场景、连续视频、语言描述开展对齐、生成与评估实验,推动端到端模型落地。创新3D场景/连续视频/交互策略/语言描述等跨多种模态的端到端理解与生成; 4. 产线落地与性能优化:与地图引擎、自动驾驶、智能导航等业务协同,迭代模型压缩、Edge-Cloud 混合部署、隐私数据训练; 5. 技术沉淀与传播:完成技术调研、实验复现、消融与报告撰写,将成果转化为论文、专利等技术沉淀。

我们是高德视觉技术中心,专注于以计算机视觉技术为核心的前沿研究与创新应用,致力于打造时空互联网领域的核心技术能力。 我们致力于构建 “真实世界 × 虚拟世界” 的生成式世界模型,引领多模态 AI 赋能智慧出行和日常生活。团队成员参与端到端 3D+视频+语言 大模型的研发,与阿里云算力、十亿级全域图像 / 点云 / 出行数据深度结合,让算法在真实应用中产生即时经济价值与社会影响力。 团队主页:https://github.com/amap-cvlab 岗位职责: 1. 核心算法研发:主导 1B-100B 参数级世界模型 / VLA / VLM 网络的整体方案与关键模块创新; 2. 高效预训练与微调:构建跨模态自监督目标(时序一致性、物理一致性、语言对齐等),并推动 SFT → DPO → RL-HF 全链路落地上线; 3. 跨模态推理与生成:针对 3D 场景、连续视频、语言描述开展对齐、生成与评估实验,推动端到端模型落地。创新3D场景/连续视频/交互策略/语言描述等跨多种模态的端到端理解与生成; 4. 产线落地与性能优化:与地图引擎、自动驾驶、智能导航等业务协同,迭代模型压缩、Edge-Cloud 混合部署、隐私数据训练; 5. 技术沉淀与传播:完成技术调研、实验复现、消融与报告撰写,将成果转化为论文、专利等技术沉淀。

1.负责公司游戏产品的视频创作,包括UE制作、AI运用、后期剪辑包装等; 2.负责游戏广告项目的策划和创意,完成游戏创意广告的实现; 3.关注、收集时下热点,理解用户属性及习惯,贴合游戏产品输出创意创作。
1.负责项目中的场景原画的整体设计,单体建筑的设计拆分; 2.跟进美术最终表现效果,提出改善意见并实施修改; 3.跟进原画外包,制定外包规范; 4.跟进3D场景引擎内的效果,配合3D场景完善场景制作。