阿里云研究型实习生-视频生成模型优化研究
实习兼职阿里云研究型实习生地点:北京状态:招聘
工作描述
任职要求 1、计算机科学、人工智能、电子工程或相关专业硕士及以上学历,博士优先; 2、扎实的深度学习与计算机视觉基础,熟悉扩散模型、Transformer、生成式AI等核心技术; 3、在文生图或文生视频领域有实际研究或项目经验,了解主流模型架构(如 Wanx、CogVideo等); 4、精通 PyTorch 框架,具备良好的代码工程能力; 5、在 NeurIPS / ICML / CVPR / ICLR 等顶级会议发表过相关论文者优先; 6、具备优秀的科研创新能力、问题抽象能力与跨团队协作精神。…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
OpenCV+
https://learnopencv.com/getting-started-with-opencv/
At LearnOpenCV we are on a mission to educate the global workforce in computer vision and AI.
https://opencv.org/university/free-opencv-course/
This free OpenCV course will teach you how to manipulate images and videos, and detect objects and faces, among other exciting topics in just about 3 hours.
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
还有更多 •••
相关职位
实习阿里巴巴研究型实
1、前沿算法研究与创新: (1)深入研究当前主流文生视频模型(如Wanx、CogVideo等)的架构,定位其在计算、内存及I/O上的核心瓶颈; (2)探索并设计全新的高效模型架构,将MoE、Spars
更新于 2026-05-06北京|杭州
实习阿里巴巴研究型实
1、计算机科学、人工智能、电子工程或相关专业硕士及以上学历,博士优先; 2、扎实的深度学习与计算机视觉基础,熟悉扩散模型、Transformer、生成式AI等核心技术; 3、在文生图或文生视频领域有实
更新于 2026-03-17北京|杭州
实习阿里巴巴研究型实
1、在读博士,计算机视觉、多模态理解和表征学习、Vision-Language理解和生成大模型相关训练经验和落地经验者优先。 2、熟练掌握计算机视觉领域的基础理论和方法,熟悉PyTorch等主流深度学
更新于 2026-07-28北京|杭州