腾讯音乐酷狗音乐音频生成大模型工程师
社招全职酷狗音乐-技术类地点:广州状态:招聘
工作描述
任职要求 1.熟练掌握Transformer架构、LLM、DiT等核心技术; 2.有歌声合成、音乐生成研发经验,深度研究过Stable Audio、ACE-step、Levo、F5-TTS、Qwen3-TTS等优秀的音频生成方案,熟悉音频vae和tokenizer; …
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
还有更多 •••
相关职位
社招3年以上技术类-算法
1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。 2.具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术。 3.熟练至少一种大模型训练框架(Deepspeed, Mega
更新于 2026-08-17北京|杭州
社招3年以上技术类-算法
1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。 2.具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术。 3.熟练至少一种大模型训练框架(Deepspeed, Mega
更新于 2026-04-02北京|杭州
