阿里巴巴集团
2027届民企

岗位信息

招聘岗位
AI Infra工程师
工作城市
上海、北京、广州、成都、杭州、深圳
毕业届别
2027
是否笔试
未明确
招聘批次
2027届
发布日期
2026-08-24

📋 岗位职责 / 任职要求

职位类别:技术类 业务集团:阿里巴巴控股集团、淘天集团、飞猪、阿里国际数字商业集团、阿里云、Token Foundry 职位描述:在这里,你将成为大模型技术落地的“幕后推手”。你将参与构建支撑千卡/万卡规模的 AI 计算基础设施,通过软硬件协同优化,解决大模型在训练、推理、调度全链路中的工程挑战。你的代码将直接决定大模型训练的效率、推理的响应速度以及集群资源的利用率,为 AI 时代的算力底座注入核心动力。 具体的职责包括以下相关方向的一项或多项: 1. 算力基建与分布式训练: ● 深入分布式训练架构,优化通信与底层算子性能,解决大规模集群通信瓶颈,提升模型训练的吞吐量与计算效率。参与研究新的训练框架和模式。 极致推理加速: ● 针对大规模推理场景,研发高性能推理引擎,通过kernel、框架、与算法结合的有损优化等手段,实现极致的低延迟与高并发。 2. 智能化资源调度与系统: ● 构建大规模 GPU 集群的统一调度与编排系统,实现算力资源的弹性分配与自动化调度,设计与优化面向 AI 计算场景的高性能通信、存储系统,保障海量任务的极致的效率。 3. 工程效率与平台化建设: ● 打造一体化的平台,覆盖大模型研发和迭代的全流程,降低模型迭代门槛,提升研发效能。 职位要求:1. 基础条件: ● 计算机、软件工程等相关专业优先。 ● 热衷于数据结构和算法、在ACM大赛成绩优异者优先;有顶会论文/高影响项目/开源贡献者加分。 2. 专业能力: ● 系统工程与编程能力:具备良好的系统工程基础,熟悉 Linux 开发环境,掌握 Python、Go、Java 等至少一门编程语言,具备扎实的工程实现能力。 ● 分布式系统:了解分布式系统基本原理(如一致性、容错、扩展性等)。 ● AI 系统领域专业知识:对于以下领域中的一项或者多项具备专业能力 ○ 了解 AI 的基本原理与常见算法,理解模型训练任务的基本流程及其资源需求。 ○ 了解主流训练推理框架(如 PyTorch、TensorFlow、vLLM、sglang)的基本使用方式及训练流程。 ○ 了解异构计算或高性能计算体系,有 GPU 相关优化经验者优先。 3. 能力特质: ● 沟通能力:能与跨域岗位,如:算法、产品等,进行良好的沟通。 ● 跨域视野:有较宽的技术视野与知识面,对算法研发流程、数据、GPU调度、训练、推理等相关领域的技术逻辑都有涉猎。 ● 系统思维: 乐于挑战复杂系统的性能极限,具备良好的性能分析与调优能力,喜欢从底层视角拆解并解决问题。 ● 极客精神:对 AI 大模型技术充满热情,具备快速学习新技术的能力,渴望在高性能计算领域实现技术突破。

🏢 企业简介

成立1999 年性质世界500强股票代码09988总部杭州上市已上市
📍 主要办公地点
杭州北京上海广州深圳成都南京

投递方式

投递入口为会员专属,登录 / 注册 后查看(注册送 15 天免费试用)
🎁 内推码1RL8SV8 / P01KByLNQX9o0v0NWRqPByUTYT0L / 2T51KE6F填写可提高简历优先级(不保证录用)

🎯 该企业笔试专题

🎯 阿里巴巴笔试140 题去刷题 ›
📚 更多企业笔试真题:进入考试频道 ›

🎯 AI校招画像 (来源:DeepSeek AI搜索)

💰 薪资待遇与年终奖
2027届校招已启动,技术岗需笔试+2-3轮业务面+HR面,非技术岗15薪左右,实习250-500元/天。

ℹ️ 信息来源

本条招聘信息由校招宝转载自 阿里巴巴校招官网,版权归原发布方所有,校招宝仅作信息聚合与导航。
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。