阿里巴巴AI创新事业部-多模态通用音频大模型算法工程师/专家-未来生活实验室
社招全职3年以上技术类-算法地点:北京 | 杭州状态:招聘
工作描述
任职要求 1、学历经验:硕士及以上,1年以上音频/语音/音乐生成大模型研发经验。 2、核心技术:精通音频生成算法,对DiT、Flow Matching、MLLM、vocoder等技术有自己的理解和实操经验。 3、底层技术:熟悉音频表征(HuBERT/WavLM等)及高音质编解码方案(EnCodec/DAC等),对音质敏感。 4、多模态能力:有 AudioLD…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
还有更多 •••
相关职位
社招3年以上技术类-算法
1、学历经验:硕士及以上,1年以上音频/语音/音乐生成大模型研发经验。 2、核心技术:精通音频生成算法,对DiT、Flow Matching、MLLM、vocoder等技术有自己的理解和实操经验。
更新于 2026-08-13北京|杭州
实习阿里巴巴研究型实
1. 计算机视觉、自然语言处理、人工智能等专业优秀在读博士; 2. 熟练掌握tensorflow、pytorch等至少一种主流深度学习框架,有复杂模型设计和建模经验; 3. 具备出色的学术研究和数据分
更新于 2026-07-27北京|杭州
实习通义研究型实习生
1. 计算机视觉、自然语言处理、人工智能等专业优秀在读博士; 2. 熟练掌握tensorflow、pytorch等至少一种主流深度学习框架,有复杂模型设计和建模经验; 3. 具备出色的学术研究和数据分
更新于 2025-11-24北京|杭州|上海