
智能互联阿里云智能-百炼AI搜索技术专家/高级开发工程师(知识库&联网搜索方向)-北京/杭州
任职要求
1. 计算机/人工智能相关专业硕士及以上学历,2年以上工作经验,精通C++/Java/Go一门编程技术, 有大型分布式系统开发经验者优先。 2. 熟悉信息检索理论,具有高并发在线服务系统开发经验者优先。 3. 熟悉Linux系统脚本, 能够熟练使用Unix shell scripting…
工作职责
1. 结合LLM技术,设计和优化RAG全链路的基础架构,提升系统的吞吐能力和响应速度。 2. 构建高性能,可扩展的分布式文件处理和索引构建系统,承载海量文档的知识库的索引和检索需求。 3. 规划和优化检索集群,通过合理的分片,资源分配等策略降低延迟提高吞吐,针对业务场景进行服务优化。 4. 建立完善的系统监控,日志分析和trace平台,能快速定位和解决系统问题。
1. 结合LLM技术,设计和优化RAG全链路的基础架构,提升系统的吞吐能力和响应速度。 2. 构建高性能,可扩展的分布式文件处理和索引构建系统,承载海量文档的知识库的索引和检索需求。 3. 规划和优化检索集群,通过合理的分片,资源分配等策略降低延迟提高吞吐,针对业务场景进行服务优化。 4. 建立完善的系统监控,日志分析和trace平台,能快速定位和解决系统问题。
主导百炼模型控制台(PC+移动端)体系化建设:打造全球一致、高转化的一站式企业级MaaS体验平台。 1. 设计覆盖“发现→试用→调用→管理→计费”的端到端产品架构,统一交互规范,提升平台专业性与一致性; 2. 统筹国内外多端体验,在核心功能上保持全球统一,同时适配本地合规与语言、计费等区域需求; 3. 聚焦开发者“首用即成功”,通过 Playground、示例模板和参数调优降低使用门槛,优化注册到付费的转化路径; 4. 建立数据驱动的体验评估与迭代机制,结合用户行为与反馈持续提升留存与满意度。
1. 核心系统研发 (1)设计与优化大模型推理服务框架与分布式缓存系统。 (2)支持多推理引擎适配、多模态推理、分布式部署及高效数据管理。 (3)开发工具链与服务化能力,包括模型量化、转换、调度与生命周期管理。 2. 性能与稳定性优化 (1)优化推理服务框架的性能,包括引擎适配、生命周期管理和资源调度。 (2)深入优化kvcache的显存、内存和存储管理、批处理、缓存策略和网络传输。 (3)支持高性能通信协议、容错与负载均衡机制。 (4)提升系统可观测性,完善监控、告警与故障恢复体系。 3. 引擎与应用集成 (1)深度集成推理引擎、缓存系统和存储系统,优化访问模式与架构设计。 (2)满足大规模、多模态推理场景下的高吞吐与低延迟需求。