壁仞科技
岗位信息
招聘岗位
大模型推理框架开发工程师
工作城市
上海、北京、杭州、珠海
毕业届别
2027
是否笔试
未明确
招聘批次
27届校招
截止日期
2026-10-14
发布日期
2026-08-13
📋 岗位职责 / 任职要求
岗位简介
本岗位专注于大语言模型(LLM)与多模态大模型的高性能推理服务框架研发。你将深入国产GPU底层软件栈,参与构建从模型加载、分布式推理调度到高性能算子执行的全链路系统,直面真实业务场景下的高并发、低延迟推理挑战。在这里,你将接触最前沿的大模型推理加速技术,与资深系统工程师共同协作,为国产算力平台打造业界一流的模型服务基础设施。
岗位职责
基于壁仞GPU软件栈,参与大语言模型及多模态大模型推理服务框架的架构设计与工程落地;
围绕并行策略设计、GPU通信优化、算子融合、量化压缩等方向,持续优化模型推理性能,降低端到端推理延迟,提升线上服务的吞吐能力;
跟踪前沿论文与开源方案,结合 AI Agent 推动新方法在业务场景落地,参与开源社区建设与发展。
任职要求
计算机、软件工程、人工智能、自动化、通信、微电子、数学等相关专业优先;
扎实的编程能力,熟练掌握 C/C++ 或 Python,具备良好的代码风格与工程规范意识;
了解深度学习模型的基本架构(如Transformer、Diffusion等),对大模型推理的技术栈有一定认知;具备良好的学习能力和自驱力;
逻辑思维清晰,善于拆解复杂问题,具备良好的团队沟通与协作能力。
加分项
熟悉主流大模型推理框架(如 vLLM、SGLang、LMDeploy、TensorRT-LLM、TGI 等),有使用、适配或二次开发经验;
有 CUDA 编程经验,了解GPU体系结构、内存层次或并行计算基础,有算子手写或性能调优经历;
有深度学习模型部署、ONNX/TensorRT推理优化、量化压缩等相关项目实践;
有高性能计算、分布式系统、网络通信相关领域的研究或工程经验;
有学术竞赛(如ASC超算竞赛、ACM-ICPC、Kaggle)获奖经历,或有高质量开源项目贡献。
🏢 企业简介
总部上海
壁仞科技作为国内领先的智能计算芯片企业,专注于GPU等高端通用智能算力芯片的研发与技术创新,总部位于上海,在人工智能算力领域具备突出的行业影响力与技术布局。公司面向云计算、数据中心及智能终端等场景构建自主可控的算力底座,持续推动国产高性能芯片的突破与应用。目前业务覆盖上海、北京、杭州等核心城市,研发体系完善,技术赛道前沿且发展空间广阔。对于应届生而言,可深度参与从芯片架构到系统软件的全链路技术攻关,在国产算力崛起的窗口期获得高成长性的职业平台与扎实的工程历练。
官方公告
查看官方公告原文 ›投递方式
投递入口需登录后查看,登录 / 注册 即可使用🎯 AI校招画像 (来源:校招宝数据聚合)
🏢 公司文化与工作氛围
JD出现一人项目与协同多个AI Agent的研究模式描述,团队对AI赋能研发接受度高,工作方式偏工程探索型;建议面试时了解团队与项目节奏。
⏰ 加班情况与工作强度
芯片研发项目周期长、节点密集,流片前后通常强度较高;具体作息、加班与调休安排建议在面试沟通时确认,以官方公告为准。具体作息、值班与出差安排建议在面试沟通时确认,以官方公告为准。
💰 薪资待遇与年终奖
库内79条岗位未公开薪资标准,以官方公告为准。半导体行业通常按职级定薪并提供项目激励,建议offer阶段书面确认基本工资、绩效与股权或奖金构成。
🎁 福利体系
库内未披露福利细则,以官方公告为准。建议在offer沟通时索要书面福利清单,重点确认五险一金缴纳基数、补充医疗与体检、补贴项目及年假标准。
📋 校招流程经验
库内未见完整流程说明,投递走MokaHR平台;建议按网申—笔试或技术测评—专业面试—综合面试—offer路径准备,并以官方公告为准。
🚀 投递建议与避坑指南
岗位按技术方向细分,投递前务必对照JD选择;简历突出GPU、C++、编译器、驱动或数字IC相关项目经历;多城市岗位可同时关注上海、北京、杭州与珠海。
👥 员工口碑与离职率评价
库内无员工评价原文,建议通过牛客、脉脉及校友渠道交叉了解芯片公司真实加班与团队氛围,再结合面试沟通判断,最终以官方公告为准。
📈 热门岗位方向与招聘趋势
本批以2027届与27届校招为主,硬件与芯片加软件开发合计占比近半,说明企业正持续扩充软硬协同研发力量;上海为绝对主力,杭州、珠海为重要研发支点。
ℹ️ 信息来源
本条招聘信息由校招宝转载自 企业公开校招公告,版权归原发布方所有,校招宝仅作信息聚合与导航。
查看官方原文 ›
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。