logo of tme

腾讯音乐酷狗音乐大模型加速工程师

社招全职2年以上酷狗音乐-技术类地点:广州状态:招聘

任职要求


1、本科及以上学历,计算机科学、电子工程、人工智能、数学等相关专业;2年及以上大模型加速、高性能计算、深度学习相关工作经验;
2、深入理解Transformer架构及大模型核心原理,熟练掌握至少一种主流训推框架…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责大模型训练效率提升与稳定性优化,研究并落地分布式训练策略(张量并行、流水线并行、专家并行等),提升GPU资源的利用率;
2、深耕主流训推框架(PyTorch、Megatron、DeepSpeed、vLLM、TensorRT-LLM等),参与框架二次开发与定制优化,优化算子实现、图融合及请求调度策略等;
3、负责大模型推理全链路优化,聚焦计算、内存带宽等核心瓶颈,通过量化(INT4/INT8/FP8)、剪枝、知识蒸馏、KV Cache优化、推测解码等技术,提升推理吞吐量,实现降本增效目标,保障推理服务稳定运行;
4、跟踪大模型加速领域前沿技术(如动态批处理、PageAttention、编译优化等),开展技术调研与验证,将优化方案落地到实际业务。
包括英文材料
学历+
大模型+
还有更多 •••
相关职位

logo of tencent
社招5年以上腾讯视频技术

1.核心攻坚生成类模型加速:聚焦文生图、图生图、视频生成等生成类模型,主导深度学习云端推理引擎的核心开发与推理效率优化,实现各相关AI算法的高质量落地; 2.蒸馏技术融合应用:结合生成类模型特性,将模型蒸馏技术(如DMD、CM等)融入推理引擎优化方案,在保证生成质量的前提下,进一步降低推理延迟。

更新于 2026-01-31北京
logo of tencent
社招2年以上TEG公共技术

1.主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型、多模态理解生成统一建模等方向的创新算法研究,攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)、多模态理解生成统一建模加速等技术方向,包括但不限于:(Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache 压缩等等); 2.通过分析模型和任务性能瓶颈,设计创新的算法优化方案,提升多模态大模型的推理效率,显著降低端到端延迟; 3.作为算法与框架团队之间的技术桥梁,聚焦于图像理解、视频生成、音频理解生成、视觉多轮交互、实时对话等任务,提升模型在推理端的性能; 4.高效协同框架开发及业务算法团队,确保技术方案落地。撰写高质量的技术文档与实验报告,并组织内部分享,推动团队整体技术认知提升。

更新于 2026-07-08深圳
logo of tencent
社招5年以上TEG公共技术

1.配合算法工程师,推动深度学习相关算法的落地,打造高吞吐、低延时的推理系统; 2.优化大模型推理性能,提升吞吐并控制成本; 3.优化大模型推理框架,提升框架易用性和可调试性。

更新于 2026-07-15深圳
logo of tencent
社招2年以上TEG公共技术

1.负责通用多模态大模型的推理部署,包括多模态理解、生成、语音大模型等研发支持,推动算法落地; 2.多模态大模型性能优化及推理框架优化,提升整体吞吐、降低部署成本;提升框架易用性; 3.紧跟多模态生成和理解领域的技术前沿,推动技术创新在产品中落地; 4.针对落地业务,优化部署方案及适配定制化需求。

更新于 2026-06-08深圳