阿里巴巴AI原生应用-多模态大模型算法专家-杭州
社招全职2年以上地点:杭州状态:招聘
任职要求
1、2年以上多模态或计算机视觉相关经验;有第一梯队大模型研发团队经历、CCF-A 类会议论文发表、或电商/零售行业落地经验者优先; 2、代码级熟悉VL开源生态,对网络架构、训练框架或推理优化至少一个方向有深入掌握; 3、具备大…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1. 负责多模态大模型的核心技术攻坚和效果优化,基于平台垂直领域专业知识积累,面向百亿级商品实现结构化和细颗粒度的视觉理解能力,推动生成模型在效果和控制力上实现业界领先; 2. 借助大模型和大数据洞察能力,帮助服饰快时尚行业搭建从企划、设计、商详到孵化的全链路AI Agent解决方案,为行业带来新的商业模式和增长点。
包括英文材料
OpenCV+
https://learnopencv.com/getting-started-with-opencv/
At LearnOpenCV we are on a mission to educate the global workforce in computer vision and AI.
https://opencv.org/university/free-opencv-course/
This free OpenCV course will teach you how to manipulate images and videos, and detect objects and faces, among other exciting topics in just about 3 hours.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
相关职位

社招2年以上
1. 负责多模态大模型的核心技术攻坚和效果优化,基于平台垂直领域专业知识积累,面向百亿级商品实现结构化和细颗粒度的视觉理解能力,推动生成模型在效果和控制力上实现业界领先; 2. 借助大模型和大数据洞察能力,帮助服饰快时尚行业搭建从企划、设计、商详到孵化的全链路AI Agent解决方案,为行业带来新的商业模式和增长点。
更新于 2026-04-07杭州
社招2年以上
1.负责电商领域多模态大模型的方案设计与落地,包括视觉-语言、视频-语言等方向的预训练、指令微调与对齐,在商品理解、内容理解/生成、内容审核、自动打标等多个淘天营销内容场景落地 2.构建电商多模态数据管线与数据质量治理体系,覆盖采集、清洗、标注、合成与去重,确保规模化训练的数据可用性 3.设计与实现多模态融合架构(如图像/视频/音频编码器、Connector/Q-Former等、跨模态注意力),提升跨模态理解与生成建模能力 4.进行指令微调与人类反馈强化学习(SFT、DPO、RLHF 等),完善人类偏好对齐,构建高质量评测与数据闭环 5.负责设计构建vlm加速相关算法方案,包括但不限于:模型剪枝、蒸馏、推理加速等
更新于 2026-03-25杭州
实习阿里巴巴日常实习
我们是国内使用量最大的电商AIGC平台之一。 你将参与到:构建以评测驱动的多模态数据高效处理与迭代机制,融合多模态理解、合成增强等关键技术,打造适用于AI电商场景的高质量融合数据,最终实现“数据-模型-场景”的高效协同闭环,推动新一代AI数据体系的建设。
更新于 2026-03-26杭州