logo of quark

千问千问事业部-大模型压缩&推理加速技术专家/高级专家-杭州/北京/广州

社招全职3年以上地点:北京 | 杭州 | 广州状态:招聘♡ 收藏

工作描述


任职要求
1. 在量化、稀疏、蒸馏、投机解码、KV Cache压缩、Token压缩等至少一个方向有深入研究或大规模工程落地经验;
2. 具备扎实的Python/PyTorch开发能力和严谨的实验分析能力,能够设计评测集、消融实验和回归机制,平衡模型效果、推理延迟、吞吐和成本收益;
3. 在NeurIPS、IC…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
缓存+
Python+
PyTorch+
大模型+
NeurIPS+
还有更多 •••
相关职位

logo of xiaohongshu
社招3-5年引擎

1、熟悉蒸馏、剪枝、量化等模型压缩常用方案,参与或主导过大型项目业务落地或有相关论文者优先; 2、熟悉至少一种主流的深度学习训练或推理框架(TensorFlow / PyTorch / Onnx /

更新于 2026-07-14北京|上海|深圳
logo of xiaohongshu
实习引擎

任职要求 1、熟悉业界主流Dense、MOE大模型架构及主要特点,能识别出模型效果及主要使用场景,支持用户大模型的选型和使用需求; 2、了解至少一种大模型服务推理部署框架,如vLLM、SGLang、D

更新于 2025-12-08北京|上海
logo of xiaohongshu
实习引擎

任职资格: 1、熟悉蒸馏、剪枝、量化等模型压缩常用方案; 2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现; 3、熟练使

更新于 2025-12-08北京|上海
logo of aligenie
社招3年以上

1、精通大语言模型的基础架构(如Transformer等)和推理流程; 2、在量化/稀疏/剪枝/投机采样等任一领域有扎实研究或项目经验; 3、优先条件:在NeurlPS、ICML、ICLR、ACL等顶

更新于 2026-04-06北京|杭州|广州