logo of tencent

腾讯微信-AI Infra工程师-大模型推理方向

社招全职微信AI助手技术地点:北京状态:招聘

任职要求


1.熟练掌握 C/C++Python语言,有计算机体系结构背景或软件开发背景,熟悉系统性能调优的方式;
2.具备基础的GPU编程能力,包括但不限于Cuda、OpenCL;熟悉至少一种GPU加速库,如cublas、cudnn、cutlass等;
3.有Tensorrt/FasterTransformer/Tens…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.配合算法工程师,推动深度学习相关算法的落地,打造高吞吐、低延时的推理系统;
2.优化大模型推理性能,提升吞吐并控制成本;
3.优化大模型推理框架,提升框架易用性和可调试性。
包括英文材料
C+
C+++
Python+
性能调优+
CUDA+
还有更多 •••
相关职位

logo of tencent
社招1年以上搜一搜技术

1.工作职责:; 2.负责开发和优化LLM,VLM等大模型的推理引擎,构建适合AI Search,智能 Agent相关领域大规落地应用中的推理基础架构; 3.紧跟 LLM Infra 领域的前沿技术演进突破,将合适成果落地于实际应用; 4.与搜索算法同学深度合作,联合优化,设计实现能够给大型搜索系统带来代际更迭的大模型。

更新于 2026-06-11北京
logo of tencent
社招1年以上搜一搜技术

1.负责开发和优化LLM,VLM等大模型的推理引擎,构建适合AI Search,智能 Agent相关领域大规落地应用中的推理基础架构; 2.紧跟 LLM Infra 领域的前沿技术演进突破,将合适成果落地于实际应用; 3.与搜索算法同学深度合作,联合优化,设计实现能够给大型搜索系统带来代际更迭的大模型。

更新于 2026-06-11北京
logo of tencent
社招1年以上搜一搜技术

1.负责大模型后训练框架和RL训练的设计,开发和优化。支撑LLM的高效、稳定训练; 2.持续追踪并引入业界最新开源生态技术(如 Verl, Slime, ROLL, AReal 等); 3.与搜索算法团队紧密合作,设计实现高性能的AI搜索大模型,加速最新的大模型技术在搜索场景的落地。

更新于 2026-06-11广州
logo of tencent
社招3年以上企业微信SaaS

1.负责大模型训练/推理场景下的性能分析与优化,重点优化 NVIDIA GPU 及 国产芯片 的计算、显存、通信和调度瓶颈; 2.负责 CUDA / Triton / C++ 高性能算子开发与优化,包括 GEMM、Attention、MoE、KV Cache、通信融合等方向; 3.负责多卡、多机训练/推理性能调优,优化 NCCL、NVLink、NVSwitch、InfiniBand/RDMA 等通信链路; 4.负责基于 NVIDIA GPU 和 国产芯加速卡 的性能调优,提升 GPU 利用率、吞吐、延迟和显存效率; 5.负责 PyTorch、TensorRT-LLM、vLLM、SGLang、Megatron-LM 等框架下的大模型性能优化落地; 6.结合 Nsight Systems、Nsight Compute、CUDA Profiler 等工具进行性能分析,定位并解决性能瓶颈。

更新于 2026-06-12广州