千问千问C端事业群-音频多模态生成算法专家-杭州/北京/上海
社招全职2年以上技术类-算法地点:北京 | 杭州 | 上海状态:招聘
工作描述
任职要求 1. 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验; 2. 在语音合成、音乐生成、音效生成或语音端到端等领域有深入研究,具备大规模数据训练经验; 3. 熟练掌握 PyTorch/DeepSpeed/Me…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
PyTorch+
https://datawhalechina.github.io/thorough-pytorch/
PyTorch是利用深度学习进行数据科学研究的重要工具,在灵活性、可读性和性能上都具备相当的优势,近年来已成为学术界实现深度学习算法最常用的框架。
https://www.youtube.com/watch?v=V_xro1bcAuA
Learn PyTorch for deep learning in this comprehensive course for beginners. PyTorch is a machine learning framework written in Python.
DeepSpeed+
[英文] Getting Started
https://www.deepspeed.ai/getting-started/
DeepSpeed model training is accomplished using the DeepSpeed engine.
https://www.youtube.com/watch?v=pDGI668pNg0
还有更多 •••
相关职位

社招2年以上技术类-算法
1. 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验; 2. 在语音合成、音乐生成、音效生成或语音端到端等领域有深入研究,具备大规模数据训练经验; 3. 熟练掌握 PyTorc
更新于 2026-04-02北京|杭州|上海
实习阿里巴巴研究型实
1、在读博士,计算机视觉、多模态理解和表征学习、Vision-Language理解和生成大模型相关训练经验和落地经验者优先。 2、熟练掌握计算机视觉领域的基础理论和方法,熟悉PyTorch等主流深度学
更新于 2026-07-28北京|杭州