logo of aliyun

阿里云阿里云智能-多模态大模型算法专家-飞天实验室

社招全职3年以上云智能集团地点:杭州状态:招聘

任职要求


1. 硕士及以上学历,计算机、人工智能等相关专业,具备扎实的多模态技术基础,有丰富的视觉、多模态技术研究成果发表及落地,在计算机顶会和期刊发表相关成果者优先(CVPRICCVNeurIPS等)。
2. 三年以上的多模态相关算法研究及应用经验;熟练掌握Qwen-VL等主流多模态大模型的模型架构及原理,具备多模态大模型后训练策略优化(指令微调、强化学习等)、数据闭环建设、高质量数据合成方面的实战经验,掌握高效的分布式训练、混合精度训练等训练框…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


部门简介
大数据和智能实验室聚焦于基于后训练技术的领域模型,积极推动AI大模型时代各行业的智能化升级。目前团队主要负责各行业和领域的语言大模型、多模态大模型、以及大模型基础研究,主要技术成果已成功应用到科学研究、安全审核、主权模型、生物医疗、大型国际赛事(奥运会、NBA)等多个领域大模型中。

工作内容
1.多模态大模型后训练研发:根据行业要求,探索适配领域特性的SFT/RL算法研发,构建高效、稳定、可扩展的垂域模型后训练范式,优化模型结构和推理效率,持续提升模型在业务场景下的效果、性能和用户体验,提升产品竞争力和市场规模。
2.垂域高质量数据闭环研发:持续建设高质量数据筛选流程,提升自动化预标注精度,推进垂域场景多模态数据 scale up,根据业务需求和评测结果提升定向数据挖掘能力,不断提升数据质量、多样性和生产效率。
3. 紧跟多模态大模型前沿技术趋势,从Visual RL到Token Compression,提升模型处理复杂、多变场景以及对模糊指令的遵循能力,优化模型响应速度,拓展模型在重点领域的智力边界,并以开源、技术报告等方式沉淀研究成果。引入新的算法技术和理念,为团队技术迭代提供前瞻性建议。
包括英文材料
学历+
CVPR+
ICCV+
NeurIPS+
算法+
还有更多 •••
相关职位

logo of meituan
社招核心本地商业-基

1.参与视觉大模型、语音大模型研发,探索表征学习和模型架构设计等关键技术; 2.参与跨模态大模型研发,提升模型多模态感知、理解、生成和执行能力; 3.深入调研视觉、语音、文本等模态前沿技术,等提升模型通用智能水平;

更新于 2025-05-09北京|上海|深圳
logo of tencent
社招3年以上WXG公共技术

参与微信大规模语言模型(WeLM)多模态基础模型的建设 1.探索研究基于 LLM 的多模态理解训练方案,从预训练开始建设高效智能多模态模型 2.探索研究基于 Long-Horizon 复杂多模场景的通用 Agent 训练策略 3.独立或与其他研究员合作进行前沿领域研究

更新于 2026-07-21北京
logo of quark
社招1年以上技术类-算法

负责千问APP相机场景的多模态算法能力建设,深入迭代VLM模型与Agent能力,你将负责多模态数据构建、VLM训练、数据飞轮和评测体系等关键工作,推动模型在图文对话、视觉RAG、多模态Agentic Search、视觉感知和推理等方向上的能力突破,持续提升用户在开放场景下的需求满足和体验上限。

更新于 2026-07-22北京|杭州
logo of alibaba
社招2年以上

1. 负责多模态大模型的核心技术攻坚和效果优化,基于平台垂直领域专业知识积累,面向百亿级商品实现结构化和细颗粒度的视觉理解能力,推动生成模型在效果和控制力上实现业界领先; 2. 借助大模型和大数据洞察能力,帮助服饰快时尚行业搭建从企划、设计、商详到孵化的全链路AI Agent解决方案,为行业带来新的商业模式和增长点。

更新于 2026-04-07杭州