logo of tencent

腾讯混元大语言模型算法工程师-大模型推理能力方向-深圳/北京

社招全职3年以上混元-模型算法技术地点:深圳状态:招聘

任职要求


1.有过大模型代码/数学/reasoning方向的研发经历;
2.在post-training方向有一定研究基础,熟悉SFT/DPO/PPO/Reward Model等pipeline;
3.较强的工程实现能力,熟练使用Python语言,有实际编程项目经验,熟悉DeepSpeedMegatron等分布式训练框架,熟练使用pytorch深度学习框架;
4.计算机科学、机器学习、统计学、应用数学等相关专业在校硕士、博士生;
5.在高水平国际会议和学术期刊发表过相关论文,或有高水平竞赛获奖经历优先。

工作职责


1.负责大语言模型(LLM)规划、推理、反思能力的研究,提升大语言模型的高阶推理能力;
2.跟进推理领域的前沿技术,将其应用于混元大模型基座,持续提升大模型的推理能力。
包括英文材料
大模型+
SFT+
Python+
DeepSpeed+
Megatron+
PyTorch+
深度学习+
机器学习+
相关职位

logo of tencent
社招混元-模型算法技

1.负责大语言模型(LLM)代码理解和生成相关的技术研究,提升大模型的代码基础能力; 2.跟进大模型代码领域的前沿技术,将其应用于研发生产中,持续提升大模型的代码能力; 3.负责大模型的代码相关的数据构建、训练调优及评测迭代,推进大模型技术在代码补全,Text2SQL,代码问答,代码Agent等业务场景落地。

更新于 2025-06-26
logo of tencent
社招3年以上TEG技术

1.负责混元大模型相关研发工作,包括文本创作、文本理解、数学、翻译、Agent FunctionCalls等专项; 2.负责混元在公司内相关业务场景落地,根据业务需求优化混元模型,提升业务效果; 3.负责跟踪和探索大语言模型的前沿问题,结合实际场景,提供全面的技术解决方案,参与前沿算法与应用的研究。

更新于 2025-06-19
logo of tencent
社招TEG技术

1.负责大模型语音模态的设计、开发和优化,包括但不限于语音/音频数据清洗、模型设计、训练策略等方面的研究与应用; 2.参与语音识别、语音合成、声音克隆等相关大模型语音模态能力的建设,提高跨模态整体效果。

更新于 2025-06-10
logo of tencent
社招TEG技术

1.负责大语言模型在知识问答能力上的算法设计优化及实现工; 2.建设RAG体系,对RAG链路中的重要模块进行优化,提升模型的性能效果; 3.调研业界前沿算法,追踪最前沿的技术动态,并应用在相关的项目中; 4.参与产品讨论,基于技术对产品提出改进建议。

更新于 2025-05-09