logo of tongyi

通义视觉多模态(理解)大模型算法工程师

校招全职通义2026届秋季校园招聘地点:北京 | 杭州状态:停招

工作描述


任职要求
1. 来自全球Top高校计算机科学、人工智能、计算机视觉、具身智能、机器学习、深度学习或相关领域应届毕业生,博士/硕士毕业生优先。
2. 在多模态模型(尤其是视觉语言模型)方面有扎实的理论基础和实践经验,熟悉图像、视频、3D、文本等至少两种模态的建模方法。
3. 在国际顶级计算机会议/期刊(如CVPR、ECCV、ICCV、NeurIPS、ICML、ICLR、ACL、TPAMI等)以一作身份发表论文,或在开源社区、计算机领域竞赛中有突出研究成果和项目经历。
4. 具备扎实的代码功底,熟悉PyTorch/TensorFlow/Transformer等框架,精通大语言模型原理及视觉编码器(如 ViT、ResNet)的设计与优化,能够高效实现复杂模型结构并进行大规模训练(曾参与千卡集群项目者优先);ACM/ICPC,topcoder等编程比赛获奖者优先。
5. 对基础模型的前沿问题有持续热情,具备独立思考能力和系统性研究思维,敢于挑战现有范式。能够独立应用技术解决复杂问题,主导或深度参与过有影响力项目的人选优先。
…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
OpenCV+
机器学习+
Python+
PyTorch+
深度学习+
Transformer+
CVPR+
ECCV+
还有更多 •••
相关职位

logo of xiaohongshu
实习内容理解

1. 熟练掌握深度学习、机器学习、计算机视觉的基础知识,熟悉常用模型的原理、特点及应用,能够结合需要解决的问题选择适当的模型,并设计合理的技术方案; 2. 良好的科研能力,有成果发表在ICLR、CV

更新于 2026-01-04北京
logo of antgroup
社招5年以上产品类-平台型

1、学历: 硕士学历及以上,计算机(CS)/人工智能专业背景; 2、经验: 3年以上 AI/大模型产品经验,必须有 CV(计算机视觉) 或 多模态大模型(VLM) 落地经验; 3、能力: 懂 OCR

更新于 2026-07-24杭州
logo of oppo
校招AI/算法类

1. 核心技术能力: - 掌握多模态基础模型(CLIP/BLIP/VideoBERT等) - 熟悉决策系统技术栈(强化学习/bandit算法) - 理解现代NLP系统架构(RAG/A

更新于 2026-04-23北京|深圳
logo of bytedance
实习A159830

1、2027届硕士及以上学位在读,人工智能、计算机、自动化、数学等相关专业优先; 2、有视频大模型训练、智能硬件相关研究经验者优先,在学术会议上发表过多模态大模型相关研究论文者优先; 3、责任心强,积

更新于 2026-04-23北京