优刻得科技股份有限公司
岗位信息
招聘岗位
2027校招-大模型推理优化工程师
工作城市
上海
是否笔试
未明确
招聘批次
校招
截止日期
招满即止
发布日期
2026-09-02
📋 岗位职责 / 任职要求
岗位职责
负责LLM/VLM大模型的部署与推理性能优化,系统性降低硬件延迟瓶颈,保障高并发下线上服务稳定性(TTFT与TPOT满足SLA要求)。 探索前沿推理加速技术,推动在新型GPU/NPU等硬件上的落地。
任职要求
1. 2027届毕业应届生 2. 至少具备以下2个领域中的实践经验: a. Transformers与Diffusers库,深入理解Attention变体(GQA、MLA、Linear Attn、Sparse Attn)及其优化技术(FlashAttention、PagedAttention); b. GPU编程(CUDA/cutlass/Triton/TileLang开发)且掌握性能分析工具(Nsight、PyTorch Profiler等); c. 模型压缩(量化、稀疏化、知识蒸馏); d. GPU集群通信架构(卡间通信NVLink/PCIe,机间通信RDMA/RoCE),理解NCCL、HCCL等通信库的工作机制; 3. 符合以下条件者优先: a. 有超大规模模型(1T参数以上)的分布式部署经验; b. 有推理系统经验,如为vLLM、SGLang、TensorRT-LLM贡献过核心PR; c. 有投机采样(Speculative Decoding)的落地与优化经验(如EAGLE、DFlash等); d. 有相关开源项目、专利或论文发表; e. 有国产芯片(如昇腾、海光等)的在线服务加速经验。 4. 良好的团队协作能力与工程落地能力,对技术有持续热情。
投递方式
投递入口需登录后查看,登录 / 注册 即可使用ℹ️ 信息来源
本条招聘信息由校招宝转载自 智联招聘(企业校招官网),版权归原发布方所有,校招宝仅作信息聚合与导航。
该来源未提供原文链接
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。