米哈游通用音频生成研究员
社招全职程序&技术类地点:上海状态:招聘
工作描述
任职要求 1、学历背景:计算机科学、人工智能、电子工程等相关专业博士学位或同等工程经验; 2、模型经验:具备大模型(LLM/生成模型)训练经验,熟悉分布式训练与大规模模型优化技术; 3、深入掌握以下至少一个方向: • 语音/歌声生成技术(TTS / SVS) • 音频生成技术(text2audio) • 连续和离散的Audio tokenization技术 • 音视频联合生成与跨模态时序同步技术 4、工程能力:精通Python与PyTorch,具备百万小时级数据处理与高效训练经验; 5、协作能力:具备跨时区国际团队协作经验,结果导向,自驱力…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
还有更多 •••
相关职位
实习阿里巴巴研究型实
1. 博士/硕士研究生,计算机等相关专业优先。 2. 有扎实的理论基础,对大模型相关技术研究感兴趣。 3. 在相关顶会或期刊发表论文、在高水平技术评测或竞赛中获得Top成绩、在开源组织有贡献或影响
更新于 2026-08-24北京|杭州
实习通义研究型实习生
1. 博士/硕士研究生,计算机等相关专业优先。 2. 有扎实的理论基础,对大模型相关技术研究感兴趣。 3. 在相关顶会或期刊发表论文、在高水平技术评测或竞赛中获得Top成绩、在开源组织有贡献或影响
更新于 2026-06-02杭州
校招程序&技术类
1、计算机科学、人工智能、电子工程等相关博士学历; 2、具备大模型(LLM 或多模态)训练经验,熟悉 Transformer 架构与大规模分布式训练框架(Megatron-LM, DeepSpeed,
上海|北京