logo of alibaba

阿里巴巴AI创新事业部-多模态算法专家/高级专家(理解与生成)-未来生活实验室

社招全职3年以上技术类-算法地点:北京 | 杭州状态:招聘

任职要求


1. 自然语言处理机器学习数据挖掘、人工智能等相关专业的硕士生/博士生;
2. 熟练掌握TensorflowPytorch等深度学习框架,扎实的编程基础,具备独立的算法实现能力;
3. 有LLM实操经验,参与过大模型…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。
2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。
3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。
包括英文材料
NLP+
机器学习+
数据挖掘+
TensorFlow+
PyTorch+
还有更多 •••
相关职位

logo of tongyi
社招3年以上技术类-算法

1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。

更新于 2026-06-23北京|杭州
logo of aligenie
社招3年以上技术类-算法

1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。

更新于 2026-04-08北京|杭州
logo of fliggy
社招1年以上

1. 从事多模态大模型的训练,包括预训练、指令微调与对齐,强化学习/RLHF后训练,提升模型在复杂场景下的泛化与生成能力。 2.从事高效多模态数据管线。 3. 将多模态大模型应用于内容生产,拍照讲解,多模态对话等多个旅行行业场景落地。 4.跟踪并实践多模态生成大模型前沿技术,引入新的算法技术及理念,推动业务落地及技术优化。

更新于 2026-03-30杭州
logo of aligenie
社招1年以上

1. 从事多模态大模型的训练,包括预训练、指令微调与对齐,强化学习/RLHF后训练,提升模型在复杂场景下的泛化与生成能力。 2.从事高效多模态数据管线。 3. 将多模态大模型应用于内容生产,拍照讲解,多模态对话等多个旅行行业场景落地。 4.跟踪并实践多模态生成大模型前沿技术,引入新的算法技术及理念,推动业务落地及技术优化。

更新于 2026-03-30杭州