阿里巴巴高性能处理器执行子系统架构研究和实现-阿里星
实习兼职阿里巴巴2027届实习生地点:北京 | 杭州 | 上海状态:招聘
任职要求
1.计算机科学、微电子、集成电路设计等相关专业,海内外顶尖高校博士应届毕业生; 2.在计算机体系结构领域的顶级国际会议以第一作者身份发表过高质量学术论文,在执行子系统微架构方向有深厚理论功底; 3.对现代高性能微处理器架构有极度深刻的理解,精通指令级并行挖掘、乱序执行机制、动态资源分配及软硬协同调度; 4.熟练掌握Verilog/SystemVerilog等硬件描述语言,具备扎实的数字电路设计基础;熟练掌握C/C++及Python等脚本…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1.负责公司下一代自研高性能RISC-V服务器CPU执行子系统的核心微架构定义。针对超宽发射、超深乱序执行窗口、多线程架构进行前瞻性技术探索与PPA的极致平衡; 2.主导执行子系统关键模块的微架构设计与RTL开发,涵盖高频指令调度器(Issue Queue)、物理寄存器堆(PRF)管理、低延迟旁路网络(Bypass Network)、多样化执行单元以及高效的分支预测失败恢复机制; 3.参与或主导执行子系统C-Model/C++模拟器的开发与校准。基于云原生与大规模数据处理等真实工作负载,进行IPC瓶颈深度剖析与微架构调优; 4.作为技术骨干,与验证(DV)及物理设计(PD)团队紧密协同,解决先进制程下高主频带来的时序收敛难题,确保核心IP的成功硅片级落地; 5.紧跟学术界前沿动态,推动内部微架构创新成果在顶会发表;代表团队深度参与RISC-V国际基金会(RVI)或外部合作项目,推进行业标准定义。
包括英文材料
C+
https://www.freecodecamp.org/chinese/news/the-c-beginners-handbook/
本手册遵循二八定律。你将在 20% 的时间内学习 80% 的 C 编程语言。
https://www.youtube.com/watch?v=87SH2Cn0s9A
https://www.youtube.com/watch?v=KJgsSFOSQv0
This course will give you a full introduction into all of the core concepts in the C programming language.
https://www.youtube.com/watch?v=PaPN51Mm5qQ
In this complete C programming course, Dr. Charles Severance (aka Dr. Chuck) will help you understand computer architecture and low-level programming with the help of the classic C Programming language book written by Brian Kernighan and Dennis Ritchie.
C+++
https://www.learncpp.com/
LearnCpp.com is a free website devoted to teaching you how to program in modern C++.
https://www.youtube.com/watch?v=ZzaPdXTrSb8
还有更多 •••
相关职位
社招5年以上芯片
1. 负责高性能向量处理器的对标和技术演进路线制定 2. 负责高性能向量处理器需求分析、规格定义及架构设计 3. 负责高性能向量处理器在产品中的高效应用解决方案,收集和闭环痛点需求 4. 参与高性能向量处理器的微架构设计、PPA优化 5. 与算法、软件团队进行软硬件系统级联合优化和仿真。
更新于 2026-05-31深圳|上海
社招5年以上芯片
1. 深入理解产品应用需求,参与高性能向量处理器的需求分析、规格定义及架构设计 2. 牵头负责高性能向量处理器系统级建模,性能场景提炼分析和验证, 竞品性能对标和洞察 3. 负责高性能向量处理器功能+性能验证策略、验证方案及验证feature list的制定 4. 负责子系统/系统级前仿,跨IP、跨子系统功能+性能验证 5. 与算法、软件团队进行软硬件系统级联合优化和仿真 6. 支持Emu及回片性能澄清,硅后产品应用问题解决。
更新于 2026-05-31深圳|上海
社招3年以上TEG技术
1.通信算子开发:设计和实现大模型训练/推理场景下的高效集合通信算子(AllReduce、AllGather、ReduceScatter、AllToAll等); 2.通信计算融合:设计通信与计算的overlap策略,实现计算通信并行,提升大模型整体训练/推理性能; 3.通信性能调优:针对不同硬件平台(GPU、NPU等)进行算子性能分析和优化,解决性能瓶颈问题; 4.参与AI通信库整体架构设计,制定技术方案和开发规范。
更新于 2026-06-24深圳