logo of jd

京东技术方向-多模态大模型

校招全职管理培训生地点:北京状态:招聘

任职要求


1-毕业时间:2026年10月1日至2027年9月30日期间毕业,统招本硕学历不限,本硕同级同薪;
2-专业背景:拥有但不限于计算机、信息工程、人工智能、自动化、软件工程、数学、物理等相关专业学习背景;
3-专业能力:熟练掌握Python/C++/Java等至少一门编程语言,熟悉分布式计算框架(Flink/Spark)和深度学习框架(PyTorch/TensorFlow)。熟悉图像、视频、语音、音频信号处理、数字人等相关领域的技术知识,有一定实践经验更优;
4…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1-集训&轮岗:集训&轮岗时间为半年,集训&轮岗期间的工作地包含北京、宿迁等城市。集训期间会经历超100场培训,通过集训将会完成从学生向优秀职场人的转身。轮岗期间会在客服/物流一线深入实践,同时还会在总部核心技术部门进行轮岗学习,通过轮岗学习建立对业务、技术全流程的视角和理解,有利于技术在真实数据和商业环境中的落地;
2-定岗:公司的定岗导向是“热爱、擅长、坚定”,可自由定岗至各BGBU的算法类岗位,届时将结合个人志向和公司需求确认具体的部门、岗位和工作地。
包括英文材料
学历+
Python+
C+++
Java+
还有更多 •••
相关职位

logo of amap
社招1年以上技术类-算法

我们是谁? 作为中国领先的数字地图内容及导航服务提供商,高德地图日均服务数亿用户出行决策,每日处理超百亿级位置数据。视觉技术中心是驱动高德实现厘米级高精地图、实时三维重建、多模态感知等核心技术的引擎,持续突破自动驾驶、AR导航、智慧交通等领域的技术边界。 团队gihub主页:https://github.com/amap-cvlab 为何加入我们? 挑战世界级技术难题,追求智能上限 用AI驱动国民级APP的产品迭代和颠覆式创新 岗位职责: 团队主要聚焦多模态大模型及端到端模型在车端导航及定位应用,我们期待你的工作将覆盖以下至少一个技术方向即可: 1. 在端到端自动驾驶、BEV环境感知、多模态融合、强化学习等领域具备丰富且有独创性的研究经历; 2. 探索多模态大模型在下游任务中的技术能力,包括但不限于图文对齐/识别、跨模态理解生成、多模态检索、VLM端到端自动驾驶、世界模型等; 3. 了解大模型模型的训练/微调/推理加速方法,包括但不限于模型结构调优、训练效率提升、高效低成本微调、Muti-token推理,模型部署加速等; 4. 参与自动驾驶系统中机器学习算法的研究、开发与优化,包括但不限于深度学习算法在端到端感知大模型、规控大模型、视觉语言大模型等方面的应用; 5. 负责收集、整理和分析自动驾驶相关的数据集,进行数据预处理和标注,以提高模型的准确性和复杂场景泛化能力; 6. 设计和实现端到端自动驾驶模型的训练流程,包括选择合适的优化算法、调整超参数、评估模型性能等,确保模型在不同场景下的稳定性和可靠性。

更新于 2026-07-20北京
logo of amap
社招3年以上技术类-算法

团队介绍: 作为中国领先的数字地图内容及导航服务提供商,高德地图日均服务数亿用户出行决策,每日处理超百亿级位置数据。视觉技术中心是驱动高德实现高精度地图、三维重建、LLM/VLM,AI Agent等核心技术,持续突破自动驾驶、AR导航、具身智能、推广搜和生活服务等领域的技术边界。团队不仅在计算机视觉领域持续深耕,更将计算机视觉及AI技术在自主导航、高德打车、生活服务等多元化应用场景。 作为高德地图的核心技术驱动部门,我们以下一代三维地图引擎、多模态理解与生成、空间智能、世界模型等方向为核心,推动智能出行与真实世界连接的深度融合。 团队gihub主页: https://github.com/amap-cvlab 为何加入我们? 1. 挑战业界顶尖难题: 处理百亿级位置数据,攻克动态世界中海量POI的实时、精准感知与理解,定义未来地图的“AI之眼”。 2. 驱动国民级应用创新: 你的技术将直接应用于高德地图数亿用户依赖的扫街榜等核心功能,实现从技术突破到产品颠覆的全流程落地。 3. 置身前沿技术浪潮: 在三维地图、世界模型、具身智能等前沿领域进行深度探索与研发。 4. 预研与业务深度结合:在这里,你将同时接触到面向未来的技术预研和支撑亿级用户的业务算法。我们提供从0到1的创新探索环境,也看重从1到N的规模化落地能力。 职位描述: 我们正在寻找一位专注多模态视觉理解的算法工程师。您将主要负责利用多模态大模型技术,从海量街景图片与视频中自动发现、识别与更新地图POI信息,提升地图数据的鲜度、广度与精度,为用户提供更智能、更沉浸的出行与生活服务。本岗位兼具前瞻性技术探索与规模化业务落地的双重属性,你将有机会完整参与从创新模型研究到核心业务系统迭代的全过程。 主要职责: 1. 前瞻性模型预研与业务驱动研发:探索并研发适用于大规模街景图像/视频理解的下一代视觉-语言大模型(VLM),重点攻克POI变化发现、细粒度属性理解等关键课题,并将创新技术转化为实际业务解决方案。 2. 端到端业务落地与闭环优化: 主导多模态POI发现技术在“高德扫街榜”等核心业务中的集成、优化与全流程落地。 3. 前沿技术跟踪与创新: 持续跟踪多模态理解、视频表征学习、地理空间智能等领域的最新进展,探索技术边界发表高质量论文,实现空间感知理解的学术突破,持续迭代核心算法,达到业界sota。

更新于 2025-12-31北京
logo of alibaba
社招3年以上

1.负责多模态大模型的高质量的数据构造及模型评测工作,与算法团队密切合作,理解算法需求,提供满足算法研发需求的效据; 2.设计和实现各文生图文生视频NLM模型的数据标注生产,并不断优化这代,高效完成标注和内容生产项目; 3.构建井维护一喜完善的各领线시数摆内容质量管理体系,积极推动组况流程及交付流程优化,全面把控内容质量并对结果负责,并不断进行优化选代: 4.开展多模态大模型及应用的评测体系方案建设,能够从各领域专业层面设计专业评测方案、开展专业的评测服务; 5.承担本方向数据处理、数据清洗、数据蒸馆、数据合成等多样数据工程工作

更新于 2026-07-13杭州
logo of tencent
校招日常实习

作为计算机多模态方向的研究工程师,你可以: 1、研究和开发多模态处理算法和模型的研究与开发,包括但不限于:图像、视频、3D生成、声学信号的理解与生成、多模态信息和文本信息的对齐和整合; 2、设计和优化现有算法,提高性能和准确性,确保高质量的用户体验; 3、深入调研和关注多模态/NLP/CV等方向的前沿技术,及时将新技术应用到产品中。

深圳|北京|上海