阿里巴巴研究型实习生 - 视频生成模型优化研究
实习兼职阿里巴巴研究型实习生地点:北京 | 杭州状态:招聘
工作描述
任职要求 1、前沿算法研究与创新: (1)深入研究当前主流文生视频模型(如Wanx、CogVideo等)的架构,定位其在计算、内存及I/O上的核心瓶颈; (2)探索并设计全新的高效模型架构,将MoE、Sparse Attention等先进思想引入Diffusion Transformer,研究少步/单步生成技术; (3)针对视…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
还有更多 •••
相关职位
实习阿里巴巴研究型实
1、计算机科学、人工智能、电子工程或相关专业硕士及以上学历,博士优先; 2、扎实的深度学习与计算机视觉基础,熟悉扩散模型、Transformer、生成式AI等核心技术; 3、在文生图或文生视频领域有实
更新于 2026-03-17北京|杭州
实习阿里云研究型实习
1、计算机科学、人工智能、电子工程或相关专业硕士及以上学历,博士优先; 2、扎实的深度学习与计算机视觉基础,熟悉扩散模型、Transformer、生成式AI等核心技术; 3、在文生图或文生视频领域有实
更新于 2025-11-26北京
实习阿里巴巴研究型实
1、在读博士,计算机视觉、多模态理解和表征学习、Vision-Language理解和生成大模型相关训练经验和落地经验者优先。 2、熟练掌握计算机视觉领域的基础理论和方法,熟悉PyTorch等主流深度学
更新于 2026-07-28北京|杭州