美团多模态大模型算法专家
社招全职核心本地商业-基础研发平台地点:北京 | 上海 | 深圳状态:招聘
任职要求
1.熟练掌握Pytorch等深度学习框架,Python编程语言; 2.熟悉大模型相关算法,并具备相应的项目实践经验; 3.对前沿技术有强烈的探索欲,有出色的团队协作精神; 4.发表过领域顶级会议文章(NeurIPS、ICML…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1.参与视觉大模型、语音大模型研发,探索表征学习和模型架构设计等关键技术; 2.参与跨模态大模型研发,提升模型多模态感知、理解、生成和执行能力; 3.深入调研视觉、语音、文本等模态前沿技术,等提升模型通用智能水平;
包括英文材料
PyTorch+
https://datawhalechina.github.io/thorough-pytorch/
PyTorch是利用深度学习进行数据科学研究的重要工具,在灵活性、可读性和性能上都具备相当的优势,近年来已成为学术界实现深度学习算法最常用的框架。
https://www.youtube.com/watch?v=V_xro1bcAuA
Learn PyTorch for deep learning in this comprehensive course for beginners. PyTorch is a machine learning framework written in Python.
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
还有更多 •••
相关职位
社招3年以上WXG公共技术
参与微信大规模语言模型(WeLM)多模态基础模型的建设 1.探索研究基于 LLM 的多模态理解训练方案,从预训练开始建设高效智能多模态模型 2.探索研究基于 Long-Horizon 复杂多模场景的通用 Agent 训练策略 3.独立或与其他研究员合作进行前沿领域研究
更新于 2026-07-21北京
社招1年以上技术类-算法
负责千问APP相机场景的多模态算法能力建设,深入迭代VLM模型与Agent能力,你将负责多模态数据构建、VLM训练、数据飞轮和评测体系等关键工作,推动模型在图文对话、视觉RAG、多模态Agentic Search、视觉感知和推理等方向上的能力突破,持续提升用户在开放场景下的需求满足和体验上限。
更新于 2026-07-22北京|杭州
社招2年以上
1. 负责多模态大模型的核心技术攻坚和效果优化,基于平台垂直领域专业知识积累,面向百亿级商品实现结构化和细颗粒度的视觉理解能力,推动生成模型在效果和控制力上实现业界领先; 2. 借助大模型和大数据洞察能力,帮助服饰快时尚行业搭建从企划、设计、商详到孵化的全链路AI Agent解决方案,为行业带来新的商业模式和增长点。
更新于 2026-04-07杭州