米哈游多模态算法工程实习生(audio方向)
实习兼职程序&技术类地点:上海 | 北京状态:招聘
工作描述
任职要求 1. 计算机、人工智能、软件工程等相关专业本科及以上学历。 2. 深入理解 Transformer 架构,具备 LLM 或多模态大模型的大规模分布式训练经验。 3. 熟练运用 VERL、TRL、vLLM、SG…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
还有更多 •••
相关职位
实习
1. 硕士及以上学历,计算机,人工智能及机器学习等相关专业。 2. 熟悉Qwen-Vl系列,InternVl系列,VideoLLaMA3等视觉语言模型。 4. 具备较强的技术能力和创新意识,具备调研能
更新于 2025-12-22北京
实习
1. 对语音多模态大模型算法有浓厚兴趣,愿意在此领域深入学习 2. 具备良好的团队协作能力,能够有效沟通,共同解决技术难题 3. 积极主动,具备较强的问题解决能力,能够在项目中快速成长工作内容 4.
更新于 2026-07-28北京
实习
1、熟练掌握深度学习基础知识,对视觉感知算法/多模态大模型等方向有相关研究背景; 2、熟悉常见多模态模型框架,包括但不限于Qwen-VL系列、LLAVA系列等,熟悉多模态模型预训练与后训练; 3、能够
更新于 2025-12-29北京