logo of tongyi

通义通义实验室-多模态大模型算法专家/高级专家-杭州/北京

社招全职3年以上技术类-算法地点:北京 | 杭州状态:招聘

任职要求


1. 计算机科学、人工智能、机器学习或相关领域的硕士或博士学位;
2. 在多模态、计算机视觉NLPAIGC、计算机图形学、机器学习等一个或多个领域有较深入的研究;
3. 具有出色的分析、解决问题的能力,能深入解决大模型训练、应用存在的问题,有自主探索解决方案的能力者;
4. 能够积极创新, 乐于面对挑战, 负责敬业,优秀的团队合作精神,一起探索新技术,推进技术进步。
加分项:
1. …
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 探索研究多模态理解、多模态生成、计算机视觉、自然语言处理、音频等前沿技术;
2. 参与研发多模态、全模态大模型等下一代人工智能核心技术,探索大规模/超大规模多模态理解与生成交织的基础模型,提升大模型能力;
3. 负责跟踪和研究多模态大模型前沿技术调研、落地、对业务进行优化。
包括英文材料
机器学习+
学历+
OpenCV+
NLP+
AIGC+
大模型+
算法+
CVPR+
还有更多 •••
相关职位

logo of aliyun
社招3年以上云智能集团

1、围绕行业AI应用快速落地,研发端到端智能体核心技术,方向包括但不限于:Agent RL强化学习方法、全模态数据解析与私域知识加工、自规划和自主进化的多智能体等技术,提升智能体在复杂业务流中的效果与适应性。 2、攻坚突破大模型产品在行业应用落地和交付过程中的技术难题,与业界先进技术进行持续对比,并保持优势。 3、具备良好的产品化思维,驱动产品迭代,与产品和工程团队紧密合作,将算法技术应用于实际产品,带来产品商业化增量和竞争力。 4、深入研究大模型和智能体技术,持续关注和探索大模型和智能体方向的前沿动向和技术趋势,打造产品业界影响力。

更新于 2026-02-05北京|杭州
logo of tongyi
社招3年以上技术类-算法

1. 负责语音合成、语音识别、端到端语音交互大模型算法的基础研究和应用落地。 2. 参与语音合成与识别技术在业务场景落地,解决落地过程中的前沿问题,持续优化语音合成与识别核心技术效果。 3. 深入调研和关注音频/NLP/多模态/全模态等方向的前沿技术,持续探索语音技术的新能力和新应用。

更新于 2026-02-11北京|杭州
logo of meituan
社招核心本地商业-基

1.参与视觉大模型、语音大模型研发,探索表征学习和模型架构设计等关键技术; 2.参与跨模态大模型研发,提升模型多模态感知、理解、生成和执行能力; 3.深入调研视觉、语音、文本等模态前沿技术,等提升模型通用智能水平;

更新于 2025-05-09北京|上海|深圳
logo of tencent
社招3年以上WXG公共技术

参与微信大规模语言模型(WeLM)多模态基础模型的建设 1.探索研究基于 LLM 的多模态理解训练方案,从预训练开始建设高效智能多模态模型 2.探索研究基于 Long-Horizon 复杂多模场景的通用 Agent 训练策略 3.独立或与其他研究员合作进行前沿领域研究

更新于 2026-07-21北京