阿里巴巴集团
2027届民企

岗位信息

招聘岗位
大规模分布式训练推理加速及核心基础设施软硬协同优化-阿里星
工作城市
北京、杭州
毕业届别
2027
学历要求
博士
是否笔试
未明确
招聘批次
2027届
发布日期
2026-08-13

📋 岗位职责 / 任职要求

职位类别:技术类 业务集团:阿里巴巴控股集团 职位描述:随着大模型与生成式AI的爆发式增长,AI基础设施正面临前所未有的性能、规模与效率挑战。该岗位致力于培养构建下一代AI系统底座的领军人才,具备软硬协同、跨层优化的知识面和技术深度,支撑集团核心AI业务的训练推理提效、集群资源调度及异构算力协同优化,推动AI技术的边界突破。核心问题包括但不限于: 1. 极致性能优化:探索算法、训推引擎和基础设施的co-design协同突破效率瓶颈,最大化算力、网络和存储等硬件性能。 2. 高性能网络:负责设计、实现、维护AI和高性能计算所需要的高性能网络通信框架和大模型推理场景的性能优化,聚焦模型通信场景的能力建设,完善集合通信、点对点通信等通信方式与推理框架的联合方案设计,推动提升推理性能。 3. 智能资源调度:针对大规模分布式的LLM/多模态理解生成训练推理等新兴计算场景,优化多集群多地域的异构调度编排能力,实现分钟级模型分发、训推任务弹性伸缩等。 4. 其他随着AI模型、训推范式、算力硬件等迭代演进而出现的AI系统优化工程挑战和业界难题。 职位要求:1. 分布式系统、计算机体系结构、编译优化或通信与计算协同设计方向的硕/博士研究生。 2. 具备AI训推计算性能分析与优化的经验,能深入分析AI模型在GPU平台上的性能瓶颈,提出并实施优化方案。针对分布式训练和推理系统,进行性能调优,提升系统的吞吐量和效率。 3. 熟悉业界常见的优化栈(cuda/rocm/cutlass/ck/triton等),在高效的内存管理、通信优化(NvLink/Infiniband/RoCEv2等)关键技术上有实操经验。 4. 分布式系统研发经验是加分项:设计和实现高效的分布式训练和推理框架,解决大规模分布式系统中的通信、同步和负载均衡问题。探索新型的分布式架构,提升系统的可扩展性和容错性。 5. 前沿技术研究:跟踪AI Infra领域的最新研究进展,探索新的硬件架构、算法和系统优化技术。发表高水平学术论文,参与国际顶级会议(如ISCA、MICRO、OSDI、SOSP、ATC、NSDI等)。

🏢 企业简介

成立1999 年性质世界500强股票代码09988总部杭州上市已上市
📍 主要办公地点
杭州北京上海广州深圳成都南京

投递方式

投递入口为会员专属,登录 / 注册 后查看(注册送 15 天免费试用)
🎁 内推码1RL8SV8 / P01KByLNQX9o0v0NWRqPByUTYT0L / 2T51KE6F填写可提高简历优先级(不保证录用)

🎯 该企业笔试专题

🎯 阿里巴巴笔试140 题去刷题 ›
📚 更多企业笔试真题:进入考试频道 ›

🎯 AI校招画像 (来源:DeepSeek AI搜索)

💰 薪资待遇与年终奖
2027届校招已启动,技术岗需笔试+2-3轮业务面+HR面,非技术岗15薪左右,实习250-500元/天。

ℹ️ 信息来源

本条招聘信息由校招宝转载自 阿里巴巴校招官网,版权归原发布方所有,校招宝仅作信息聚合与导航。
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。