logo of tencent

腾讯混元多模态大模型强化学习后训练框架研发工程师(北京)

社招全职3年以上AI技术地点:深圳状态:招聘

任职要求


1.熟悉常用的大模型训练推理框架,如PyTorch/Megatron/VLLM/Verl,有相关开发经验;
2.熟悉Docker、Kubernetes等容器和容器编排技术;
3.熟悉编译器相关…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.负责混元多模态大模型的RL后训练框架研发;
2.设计和开发高效的框架和算子,以支持各种硬件加速器;
3.参与强化学习算法的优化和实现,提高训练和推理性能;
4.跨团队协作,与算法、软件、硬件团队密切合作,提高框架性能和稳定性。
包括英文材料
大模型+
PyTorch+
Megatron+
还有更多 •••
相关职位

logo of tencent
社招3年以上AI产品

1.评测体系构建:通过紧跟先进模型及应用的前沿发展,设计全面、准确的多维度指标,建立覆盖多模态(语音/图/视频生成/编辑等)生成、多模态理解等全面、多维度的评测体系; 2.评测流程:熟悉大模型评测流程的实际执行与落地,协同多方相关团队高效完成评测工作,定期监控模型效果,分析问题并提供优化方案; 3.行业动态洞察:持续完善快速评测体系构建、快速反馈行业动态及模型能力,发现行业模型以及应用的前进方向、亮点; 4.结果归因:通过各种数据分析方法,深度分析模型评测结果,为大模型的更新调优提供精准的问题分析结论。

更新于 2026-06-08深圳
logo of tencent
社招2年以上TEG公共技术

1.负责通用多模态大模型的推理部署,包括多模态理解、生成、语音大模型等研发支持,推动算法落地; 2.多模态大模型性能优化及推理框架优化,提升整体吞吐、降低部署成本;提升框架易用性; 3.紧跟多模态生成和理解领域的技术前沿,推动技术创新在产品中落地; 4.针对落地业务,优化部署方案及适配定制化需求。

更新于 2026-06-08深圳
logo of tencent
社招2年以上TEG公共技术

1.主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型、多模态理解生成统一建模等方向的创新算法研究,攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)、多模态理解生成统一建模加速等技术方向,包括但不限于:(Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache 压缩等等); 2.通过分析模型和任务性能瓶颈,设计创新的算法优化方案,提升多模态大模型的推理效率,显著降低端到端延迟; 3.作为算法与框架团队之间的技术桥梁,聚焦于图像理解、视频生成、音频理解生成、视觉多轮交互、实时对话等任务,提升模型在推理端的性能; 4.高效协同框架开发及业务算法团队,确保技术方案落地。撰写高质量的技术文档与实验报告,并组织内部分享,推动团队整体技术认知提升。

更新于 2026-07-08深圳