logo of bytedance

字节跳动算法测试开发实习生-智能创作

实习兼职A252026A地点:北京状态:招聘

任职要求


1、本科及以上学历在读,计算机、软件工程等相关专业优先;
2、熟悉常用的深度学习算法和模型,对度量学习或自监督学习有较浓厚的兴趣,有相关研究经验者优先;
3、有较好的算法和数据结构基础,有较好的编程能力…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
团队介绍:智能创作质量保障团队支持了公司内绝大多数产品&业务的音视频表达场景:通过火山引擎服务公司全球范围内几十条业务/产品线,上百家ToB客户;音视频&AI&特效&编辑&创作工具能力深度支持抖音、剪映、西瓜、头条、轻颜、Faceu、飞书等产品;领域覆盖中/长/短视频创作、直播、教育、硬件、新闻、社区、广告、工具、汽车、金融等行业领域。

1、深度参与视觉算法模块级模型的评测及评测体系建设,包括移动端、服务端算法的效果和性能基准测试,不限于产品分析、自动化测试工具开发等工作;
2、根据需求设计算法评测方案,业务场景数据覆盖,进行数据分析并执行评测,给出算法效果结论及优化建议;
3、挖掘新的测试&评测方法,对算法评测中与遇到的问题进行专项研究和改进。
包括英文材料
学历+
深度学习+
算法+
还有更多 •••
相关职位

logo of bytedance
实习A193557

ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:智能创作质量保障团队支持了公司内绝大多数产品&业务的音视频表达场景:通过火山引擎服务公司全球范围内几十条业务/产品线,上百家ToB客户;音视频&AI&特效&编辑&创作工具能力深度支持抖音、剪映、西瓜、头条、轻颜、Faceu、飞书等产品;领域覆盖中/长/短视频创作、直播、教育、硬件、新闻、社区、广告、工具、汽车、金融等行业领域。 1、主要负责客户端/服务端产品质量相关或业务线测试与工具开发工作; 2、深度参与产品研发项目,协同产品和研发团队高质量交付产品; 3、日常项目线下测试与线上质量分析; 4、参与质量体系规划和建设; 5、参与开发效率工具和保证技术项目质量。

更新于 2024-06-14北京
logo of bytedance
实习A215452

ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:抖音-智能创作团队是为抖音业务提供AI,特效,音视频创作技术能力,涵盖了计算机视觉、图形学、拍摄编辑、特效、客户端、服务端工程等技术领域,并以多种形式向抖音提供业界前沿的内容理解、内容创作、互动体验与消费的能力和行业解决方案,同时通过火山引擎为企业客户提供服务。 1、参与智能创作服务端业务的产品开发; 2、参与产品需求分析,设计系统技术方案,完成开发、测试和上线; 3、参与各专项技术调研,改进系统性能与稳定性。

更新于 2025-02-14北京
logo of meitu
实习产品&运营类

职位概述: 参与影像类AI Agent中台产品的建设与优化,支持公司各业务线在智能影像生成、编辑与智能创作场景下的Agent搭建与效果评估。协助产品经理推进AI Agent能力的持续迭代,探索AI与影像创作结合的创新路径。 ● 岗位价值 在AI Agent中台体系中实践从算法到业务落地的完整链路,学习多业务协同下的AI产品体系设计与实现逻辑,提升AI影像与Agent交互的理解与实操经验。 工作职责 ● 跟进AIAgent相关的竞品调研与能力对标分析,整理行业动态与最佳实践; ● 支持公司各业务线Agent搭建与优化; ● 输出需求文档与产品原型,跟进开发与测试进展; ● 跟进算法效果迭代,收集反馈并提出优化方案; ● Agent能力评估与需求分析,推动智能影像生成与编辑体验优化; ● 定期分析业务与用户数据,整理产品迭代日志与效果验证报告。

更新于 2025-10-23北京
logo of bytedance
实习A85390

团队介绍:字节跳动剪映研发团队,主要支持剪映、醒图、Faceu 等多款国内外产品的研发工作,业务覆盖多元化影像创作场景,截止2021年6月,相关产品多次登顶国内外App Store 免费应用榜第一,并继续保持高速增长。加入我们,一起打造全球最受用户欢迎的影像创作产品。 课题介绍: 1、课题背景: 1)数字化营销时代,企业对高质量、多样化营销素材的需求呈爆发式增长。从社交媒体图文到短视频广告,从个性化推荐文案到多模态互动内容,营销场景的复杂化与用户需求的碎片化对素材生成效率、创意水平和精准度提出了更高要求。传统依赖人工策划与设计的模式成本高、周期长,难以满足实时化、动态化、规模化的业务需求。尽管生成式AI(AIGC)技术(如GPT等)已在文本、图像生成领域取得突破,但在营销场景中仍面临创意适配性差、多模态协同能力弱、品牌一致性难保障等瓶颈。本课题旨在研发“创作领域Agent”,通过智能技术实现从策略洞察到内容生产的全链路自动化,推动营销效率与效果的革命性升级。 2)随着大语言模型、多模态模型等大模型的成熟,通过视觉理解、语音识别、文本生成等AI大模型能力,提升视频剪辑效率,基于创作者的需求和创意,高效的创作出炫酷、个性化的视频成为了可能。当前行业虽已有部分智能剪辑工具,但大多局限于规则化操作,成片或缺乏对用户意图的理解,效果同质化,或缺乏成片逻辑与情感,机械堆砌素材。 本课题旨在研究适合视频剪辑的大模型技术,结合剪映平台的强大剪辑能力和效果,打造一个智能剪辑的智能体(Agent),赋能自媒体内容生产、影视工业化、广告营销等场景。 2、课题挑战: 1、创意与商业价值的平衡:AI生成内容易陷入同质化,需突破算法在品牌调性理解、用户情感共鸣、营销目标对齐等方面的局限,确保创意兼具新颖性与商业转化价值。 2、多模态动态协同:文本、图像、视频等模态的生成需实现语义与风格的跨模态对齐,且需支持动态组合与实时迭代(如根据用户反馈即时优化素材)。 3、复杂场景泛化能力:营销场景高度细分(如电商促销、品牌故事、危机公关),Agent需具备上下文感知与领域迁移能力,避免“一刀切”生成策略。 4、计算效率与资源限制:高分辨率视觉素材生成、多版本AB测试等场景对算力需求极高,需优化模型轻量化与推理速度,满足企业级部署的可行性。 5、伦理与合规风险:需解决版权争议(如AI生成素材的版权归属)、内容安全(如虚假宣传、文化敏感性)等问题,构建可信可控的生成框架。 6、视频数据复杂性远超图片和文字,巨量的用户素材,要通过大模型去精准理解,并与图片、音频、文字等多模态特征统一,对多模态模型理解能力和推理优化,提出了极高要求。 7、大模型对素材编排和剪辑的结果,可能偏离用户真实意图,既要避免输出模板化、同质化,又要结合用户个性化和创意,在风格、节奏等维度上加入“人性化创意”。 8、大参数模型训练成本高,推理慢,如何通过模型优化、工程优化等手段,给移动端、PC等终端用户极致的体验,也是课题的一大挑战。 职位描述: 1、负责剪映CapCut的AI视频编辑方向的Agent模型训练与评测,使用SFT/RLHF/Post-training等技术对视频创作进行领域知识建模; 2、提升视频创作Agent大模型的增强模型和安全能力的指令遵从能力、提升Pre-trained Model在视频创作的能力,构建行业领先的视频创作专家的智能Agent。

更新于 2025-02-24北京