logo of aligenie

智能互联AI创新事业部-音乐生成算法-未来生活实验室

社招全职3年以上技术类-算法地点:北京 | 杭州状态:招聘

任职要求


1. 硕士及以上学历,1年以上音频/音乐生成大模型研发经验(T2M、T2A、语音大模型等均可);
2. 精通音频生成大模型核心算法,有LALM、DiT、Flow-Matching等框架训练调优实操经验;
3. 熟悉音频表征技术,掌握hubert、Best-RQ等自监督表征开发;精通高音质音频解码方案,对音乐音质…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 负责音乐生成大模型算法研发,攻克文本生成音乐、音乐编辑、音色克隆等核心技术;
2. 研发音乐理解大模型,搭建高精度、细粒度音乐内容描述体系;
3. 搭建完善的音乐训练数据集,支撑模型迭代优化;
4. 落地音乐生成大模型至核心业务,保障技术实用化;
5. 跟进行业前沿,维持团队音乐生成技术领先性。
包括英文材料
学历+
大模型+
还有更多 •••
相关职位

logo of alibaba
实习阿里巴巴日常实习

你要做什么 借助 AIGC 工具,高效产出各类风格的音乐 demo 对成品做音乐性把关,输出清晰、可执行的优化反馈 配合团队,把内容趋势转化为具体的选题方向和制作方案 跟踪 B 站 / 抖音 / 小红书 / 网易云的音乐二创热点,沉淀热门曲目与改编方向的选题库

更新于 2026-06-29北京|杭州
logo of alibaba
实习阿里巴巴日常实习

1、参与音乐数据的收集、整理与标注 2、参与音乐生成效果的听感评测,输出反馈 3、整理参考曲目、制作 Demo 与对比案例 4、跟踪音乐行业与音乐 AI 动态,产出简报 5、配合算法、产品团队完成日常音乐相关工作

更新于 2026-06-29北京|杭州
logo of tongyi
社招3年以上技术类-算法

1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。

更新于 2026-06-23北京|杭州
logo of alibaba
社招2年以上技术类-开发

我们是一个专注于AI Coding方向的充满活力和创业精神的创新业务团队,致力于通过智能化代码生成和开发工具重新定义软件开发体验。随着AI Agent技术的快速发展,我们正在寻找优秀的AI Agent研发工程师加入团队,共同构建下一代智能编程助手和自主代码开发系统,一起在AI驱动的编程革命中创造历史! 1、参与设计、开发和实现AI Agent,构建具备代码理解、生成、调试和优化能力的自主编程代理系统,并能适应特定用例和环境; 2、从事AI领域相关算法研究及算法的工程化实现,以提升Agent能力(推理、规划、记忆、工具使用); 3、设计和实现高效的AI算法,为代码自动生成、智能补全、bug检测等场景提供技术支撑; 4、参与设计多智能体协作架构,实现复杂编程任务拆解与分布式执行,提升AI Coding的质量及效率; 5、持续跟踪AI Agent、大模型、代码生成等前沿技术发展,推动团队技术水平提升。

更新于 2026-06-18北京|杭州