logo of weride

文远知行AI Infra推理平台工程师【2027届校招】

校招全职地点:深圳 | 广州 | 北京 | 上海状态:招聘

工作描述


岗位简介
加入我们,你将负责自动驾驶大模型从实验室到车端落地的关键一环——构建高吞吐、低延迟的推理服务平台。你会接触到业界最前沿的推理引擎(TensorRT、SGLang、vLLM)、KV Cache 共享与 P/D 分离架构,以及面向多模态大模型(VLM)的异构推理优化,直接影响自动驾驶系统的实时感知与决策能力。
岗位职责
推理服务化平台建设:参与构建高可用的模型推理服务平台,支持 LLM / VLM 等模型的服务化部署、弹性扩缩容与多租户隔离。
推理引擎深度优化:基于 TensorRT、TorchScript、SGLang、vLLM 等框架进行推理性能优化,探索 INT8/FP8 量化、算子融合、动态 Batch 等加速手段。
KV Cach…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
学历+
Python+
C+++
Go+
Rust+
深度学习+
PyTorch+
TensorFlow+
CUDA+
TensorRT+
还有更多 •••
相关职位

logo of jd
社招算法开发岗

1. 具备大模型多模态、CTR及端侧场景的推理引擎性能优化能力,能主导低延迟高吞吐方案设计; 2. 能够运用模型量化、蒸馏、压缩及端上编译优化等方法,实现资源受限环境下端侧模型的高效部署与运行; 3.

更新于 2026-09-20北京
logo of aliyun
社招5年以上云智能集团

1. 扎实的专业基础与经验:计算机、人工智能或相关专业,5年以上AI大模型推理系统或性能优化方向工作经验,具备扎实的计算机体系结构知识和大模型技术理解。 2. 出色的工程与编程能力:精通C++/Pyt

更新于 2026-07-27杭州
logo of amap
社招3年以上技术类-算法

学历与专业背景: 3年以上工作经验,硕士及以上学历,中大厂AI Infra从事经验 能力要求: 1. 有AI推理加速框架/引擎研发经验者优先,如参与过vLLM、TensorRT-LLM、Triton、

更新于 2026-09-17北京
logo of huya
社招MJ004366

* 计算机相关专业,本科及以上学历 * 熟练掌握至少一门语言:C++ / Python / Go * 熟悉 Linux 系统及网络基础 核心能力: 熟悉 AI 推理框架或引擎,如: * PyTor

更新于 2026-04-24广州