面壁智能
岗位信息
招聘岗位
基础模型预训练加速实习生
工作城市
北京
是否笔试
未明确
招聘批次
实习
发布日期
2026-07-24
📋 岗位职责 / 任职要求
【岗位职责】
参与基础文本模型的预训练和推理性能优化,主要工作包括:
1、跟进 NVIDIA GPU新硬件特性,基于Hopper、Blackwell等新硬件架构进行性能优化;
2、分析预训练性能瓶颈,根据trace数据设计和实现性能优化方案;
3、优化推理引擎的吞吐、延迟和显存利用率,分析并解决性能瓶颈;
4、开展不同硬件、精度和并行策略下的性能测试,沉淀可复现的测试结果和优化方案;
5、与算法及基础设施团队合作,将优化方案应用到实际模型训练或部署流程中。
【任职要求】
1、计算机、人工智能、电子工程等相关专业在读;
2、熟悉 Transformer 架构,理解预训练和自回归推理的基本流程;
3、熟练使用 Python,具备良好的工程实现和问题排查能力;
4、至少满足以下一个方向:
a.熟悉 PyTorch,以及 Megatron-LM、DeepSpeed、FSDP 等训练框架中的一种或多种,了解数据并行、张量并行、流水线并行、ZeRO 等技术;
b.熟悉 vLLM、SGLang、TensorRT-LLM 等推理引擎中的一种或多种,了解 KV Cache、连续批处理、Paged Attention、量化等技术;
c.熟悉 GPU 内存层次、线程调度、Tensor Core、算子融合及性能分析方法,具备实际的算子开发或调优经验;
d.了解 GPU 架构及 CUDA 基础,对算子性能、显存访问和通信开销有基本认识;
e.能够阅读英文技术文档和开源代码,并通过实验验证结论。
🏢 企业简介
总部北京
面壁智能是国内领先的大模型人工智能企业,专注于基础模型与高效训练推理技术的研发,在中文大模型领域具备突出的技术积累与行业影响力。公司总部位于北京,围绕智能体、端侧大模型等前沿方向持续布局,推动AI技术在多元场景中的落地应用。作为处于快速成长期的技术驱动型公司,面壁智能汇聚了来自顶尖高校与科研机构的研发力量,构建了开放的工程与研究氛围。在北京的在招岗位覆盖算法研究、工程开发等核心方向,为应届生提供参与前沿大模型项目、贴近产业一线的实践机会,技术路径清晰、发展前景广阔,适合具备探索精神与工程能力的毕业生加入。
投递方式
投递入口需登录后查看,登录 / 注册 即可使用ℹ️ 信息来源
本条招聘信息由校招宝转载自 飞书招聘系统(企业校招官网),版权归原发布方所有,校招宝仅作信息聚合与导航。
该来源未提供原文链接
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。