logo of kuaishou

快手大模型服务开发平台研发工程师

社招全职3-5年J0012地点:杭州 | 北京状态:招聘

任职要求


1、本科及以上学历,计算机相关专业;
2、熟悉至少一种编程语言(如 GolangJavaPython 等); 
3、掌握如K8SKnative,Serverless等主流及新兴云原生技术,特别在AI应用托管领域与大模型结合的演进方向;
4、有 DockerKubernetes、v…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、面向AI应用场景设计开发业界领先的AI平台,包括prompt工程,RAG工程、模型微调、推理加速等能力;
2、负责大模型场景下多领域的数据工程,包含知识库数据的高质量处理,Prompt提示词的优化,模型微调数据集的质量提升;
3、负责大模型场景下模型推理框架的性能优化方案的设计与实现;
4、设计训练和优化大模型,跟踪和研发代码大模型的预训练、持续训练、SFT、RLHF等技术;
5、设计与实现AI智能体应用的编排定义,提升企业应用的智能度。
包括英文材料
学历+
Go+
Java+
Python+
Kubernetes+
Knative+
大模型+
Docker+
还有更多 •••
相关职位

logo of xiaohongshu
社招引擎

DirectLLM是小红书内部面向各业务场景建设的大模型API服务产品,通过标准化API接口提供LLM/MLLM等大模型推理服务,致力于为AI应用开发者提供品类丰富、数量众多的模型选择,并通过API接口为其提供开箱即用、能力卓越、成本经济的模型服务,各领域模型的能力均可通过统一的API和SDK来实现被不同业务系统集成。 工作职责: 1、参与/负责大模型推理服务平台(MaaS)的架构设计、系统研发、产品研发等工作; 2、深入参与面向大模型场景的请求调度、异构资源调度、引擎优化等核心工作,实现千亿级Token并行推理平台; 3、为内部产品线提供解决方案,协助公司内用户解决大模型应用过程中业务在平台上的使用问题。

北京|上海|深圳
logo of baidu
社招3年以上ACG

-为视觉大模型项目交付的方案、质量、效率负责 -完成项目交付过程中的技术对接、方案设计及核心功能的开发 -参与团队开发过程中的Code Review、文档撰写、复杂问题排查等工作 -参与团队公共技术组件的抽象、沉淀和架构优化

更新于 2025-04-24北京
logo of baidu
社招3年以上ACG

-为视觉大模型项目交付的方案、质量、效率负责 -完成项目交付过程中的技术对接、方案设计及核心功能的开发 -参与团队开发过程中的Code Review、文档撰写、复杂问题排查等工作 -参与团队公共技术组件的抽象、沉淀和架构优化

更新于 2025-04-24北京
logo of mihoyo
社招3-5年程序&技术类

岗位职责: 1. 负责大模型推理平台的开发、维护与性能优化,保障服务高可用性和高性能运行 2. 对大模型 KVCache 集群进行开发、维护与性能调优,解决大规模并发推理内存瓶颈 3. 管理推理服务的计算资源、流量及任务调度,优化集群资源利用率,降低推理成本 4. 建立推理服务监控告警体系,及时发现和解决性能异常和系统故障 5. 参与推理服务架构设计,支持多模态模型和不同规模模型的推理需求

上海|北京