懂车帝

实习

岗位信息

招聘岗位
视频AIGC/多模态Agent算法实习生
工作城市
北京
学历要求
本科
是否笔试
未明确
招聘批次
实习
发布日期
2026-09-17

📋 岗位职责 / 任职要求

【岗位职责】 岗位介绍: 参与视频生成、多模态理解与智能创作 Agent 的研发,围绕真实视频创作问题开展技术探索;你将结合自己的兴趣和能力,参与具体算法模块或原型系统的开发,积累从论文复现、实验分析到应用验证的完整实践经验。 工作职责: 1、跟踪视频 AIGC、多模态大模型和 Agent 相关技术,阅读论文、复现方法,并分析其在视频创作场景中的适用性; 2、参与视频生成与编辑相关实验,包括模型选型、微调、生成控制及效果对比,探索提升画面质量、主体一致性和运动自然度的方法; 3、参与视频创作 Agent 的开发,完成脚本分镜、素材检索、模型调用、视频编辑或结果评估等模块的搭建与优化; 4、参与多模态数据处理、评测集建设和实验分析,识别典型失败案例,提出并验证改进方案。 【任职要求】 1、计算机、人工智能、数学、电子信息等相关专业在校生,本科、硕士或博士均可; 2、具备机器学习与深度学习基础,熟练使用 Python,能够使用 PyTorch 等框架完成模型训练、微调或推理实验; 3、对以下至少一个方向有学习和实践积累:图像/视频生成、多模态理解、大语言模型、Agent;能够清楚说明相关课程项目、科研或个人项目中的技术方法与个人贡献; 4、具备英文论文阅读、代码调试和实验分析能力,愿意主动定位问题,并通过实验验证想法; 5、能稳定投入实习;建议每周到岗不少于 4 天、连续实习不少于 3 个月(可实习 6 个月及以上者优先,具体安排可沟通)。 加分项: 6、有视频生成、多模态模型微调、视频理解或 Agent 项目经验; 7、有 LoRA 微调、数据合成、自动评测、工具调用或视频处理实践; 8、有可展示的 Demo、开源项目、竞赛成果或学术研究成果; 9、对镜头语言、剪辑节奏和视听表达有兴趣,能够结合创作需求分析生成结果。 投递建议: 欢迎附上 GitHub、项目报告、论文或作品链接,并注明可到岗时间、每周实习天数及预计实习时长; 课程项目和个人作品同样欢迎,重点说明你做了什么、遇到了什么问题,以及如何验证结果。

🏢 企业简介

总部北京

投递方式

投递入口需登录后查看,登录 / 注册 即可使用
🎁 内推码:登录后查看填写可提高简历优先级(不保证录用) 登录 / 注册

🎯 该企业笔试专题

🎯 字节笔试34 题去刷题 ›
📚 更多企业笔试真题:进入考试频道 ›

ℹ️ 信息来源

本条招聘信息由校招宝转载自 飞书招聘系统(企业校招官网),版权归原发布方所有,校招宝仅作信息聚合与导航。
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。