滴滴语音生成大模型算法工程师(TTS)(J251127015)
社招全职2-5年技术地点:北京状态:招聘
工作描述
任职要求 1、 专业背景:计算机/语音算法/AI 等相关专业硕士及以上,毕业年限2-5年最佳; 2、熟悉常见TTS框架(如:CoSyVoice、F5、 index-tts 、 Qwen3-tts、 VoxCPM、 DiTAR) 具备模型改动、调优经验; 3、熟悉常见音频表征技术…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
BERT+
https://www.youtube.com/watch?v=xI0HHN5XKDo
Understand the BERT Transformer in and out.
GPT+
https://www.youtube.com/watch?v=kCc8FmEb1nY
We build a Generatively Pretrained Transformer (GPT), following the paper "Attention is All You Need" and OpenAI's GPT-2 / GPT-3.
还有更多 •••
相关职位
校招程序技术类
1.计算机/人工智能/大数据/数学/统计等相关专业,熟悉PyTorch/TensorFlow,熟悉当前主流LLM模型/2D、3D生成模型/主流GAN、diffusion等生成式模型与训练/推理框架;
上海
社招3年以上技术类-算法
1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。 2.具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术。 3.熟练至少一种大模型训练框架(Deepspeed, Mega
更新于 2026-04-02北京|杭州

社招3年以上技术类-算法
1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。 2.具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术。 3.熟练至少一种大模型训练框架(Deepspeed, Mega
更新于 2026-04-02北京|杭州