腾讯音乐酷狗音乐大模型加速工程师
社招全职2年以上酷狗音乐-技术类地点:广州状态:招聘
任职要求
1、本科及以上学历,计算机科学、电子工程、人工智能、数学等相关专业;2年及以上大模型加速、高性能计算、深度学习相关工作经验; 2、深入理解Transformer架构及大模型核心原理,熟练掌握至少一种主流训推框架…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1、负责大模型训练效率提升与稳定性优化,研究并落地分布式训练策略(张量并行、流水线并行、专家并行等),提升GPU资源的利用率; 2、深耕主流训推框架(PyTorch、Megatron、DeepSpeed、vLLM、TensorRT-LLM等),参与框架二次开发与定制优化,优化算子实现、图融合及请求调度策略等; 3、负责大模型推理全链路优化,聚焦计算、内存带宽等核心瓶颈,通过量化(INT4/INT8/FP8)、剪枝、知识蒸馏、KV Cache优化、推测解码等技术,提升推理吞吐量,实现降本增效目标,保障推理服务稳定运行; 4、跟踪大模型加速领域前沿技术(如动态批处理、PageAttention、编译优化等),开展技术调研与验证,将优化方案落地到实际业务。
包括英文材料
学历+
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
还有更多 •••
相关职位
社招5年以上腾讯视频技术
1.核心攻坚生成类模型加速:聚焦文生图、图生图、视频生成等生成类模型,主导深度学习云端推理引擎的核心开发与推理效率优化,实现各相关AI算法的高质量落地; 2.蒸馏技术融合应用:结合生成类模型特性,将模型蒸馏技术(如DMD、CM等)融入推理引擎优化方案,在保证生成质量的前提下,进一步降低推理延迟。
更新于 2026-01-31北京
社招2年以上TEG公共技术
1.主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型、多模态理解生成统一建模等方向的创新算法研究,攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)、多模态理解生成统一建模加速等技术方向,包括但不限于:(Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache 压缩等等); 2.通过分析模型和任务性能瓶颈,设计创新的算法优化方案,提升多模态大模型的推理效率,显著降低端到端延迟; 3.作为算法与框架团队之间的技术桥梁,聚焦于图像理解、视频生成、音频理解生成、视觉多轮交互、实时对话等任务,提升模型在推理端的性能; 4.高效协同框架开发及业务算法团队,确保技术方案落地。撰写高质量的技术文档与实验报告,并组织内部分享,推动团队整体技术认知提升。
更新于 2026-07-08深圳
社招5年以上TEG公共技术
1.配合算法工程师,推动深度学习相关算法的落地,打造高吞吐、低延时的推理系统; 2.优化大模型推理性能,提升吞吐并控制成本; 3.优化大模型推理框架,提升框架易用性和可调试性。
更新于 2026-07-15深圳