九识智能
岗位信息
招聘岗位
【27届校招】VLX模型推理工程师
工作城市
杭州、苏州
是否笔试
未明确
招聘批次
校招
发布日期
2026-08-20
📋 岗位职责 / 任职要求
About the Role
我们正在探索下一代自动驾驶智能系统,将 Vision-Language-Action(VLA)、Vision-Language Model(VLM)等大模型能力部署到车载计算平台,实现具备更强环境理解、推理决策能力的智能驾驶系统。
随着自动驾驶模型从传统感知网络向 End-to-End Driving 和 Embodied AI 演进,大模型正在成为下一代自动驾驶核心技术。然而,车载平台存在算力、显存、功耗以及实时性限制,需要针对模型结构、推理框架、GPU Runtime 和硬件架构进行深度优化。
我们希望寻找具备 大模型部署、推理优化、GPU加速、AI Runtime 能力的工程师,共同推动 VLA 模型从实验室走向真实车辆。
Responsibilities
参与自动驾驶 VLA / VLM 大模型车端部署与性能优化,包括:
Model Deployment(模型部署)、Inference Optimization(推理优化)、On-device AI(端侧智能)
参与多模态大模型推理系统优化,包括:
Vision Encoder Optimization(视觉编码器优化)、LLM Inference Optimization(语言模型推理优化)、Multimodal Fusion Optimization(多模态融合优化)
参与模型压缩与推理加速技术研发,包括:
Quantization(INT8/INT4量化)、Operator Fusion(算子融合)、Graph Optimization(计算图优化)、Memory Optimization(内存优化)
参与车载 GPU Runtime 与 Kernel 优化,包括:
CUDA Kernel Optimization、TensorRT Plugin Development、CUDA Graph、GPU Memory Optimization、Tensor Core Optimization
分析并优化 VLA 模型在 NVIDIA Orin 平台上的性能瓶颈,包括:
GPU Compute Bottleneck、Memory Bandwidth Bottleneck、Kernel Launch Overhead、CPU-GPU Synchronization Overhead
参与自动驾驶大模型推理基础设施建设,包括:
TensorRT / ONNX Runtime Backend Optimization、Inference Pipeline Optimization、Performance Benchmarking、Profiling System Development
跟踪并研究前沿 Embodied AI 与大模型部署技术,包括:
VLA(Vision-Language-Action)、VLM(Vision-Language Model)、LLM Inference、AI Compiler、ML Runtime Optimization
Preferred Qualifications
有以下方向经验之一:
VLA / VLM Model Deployment、LLM Inference Optimization、TensorRT Optimization、CUDA Kernel Optimization、AI Compiler、ML Runtime
熟悉以下模型部署框架或工具之一:
TensorRT、ONNX Runtime、TensorRT-LLM、TVM、OpenVINO、PyTorch Deploy
有以下优化经验之一:
Model Quantization(INT8/INT4)、Operator Fusion、Memory Optimization、Inference Pipeline Optimization、Custom Operator Development
熟悉 GPU 架构与性能分析工具,包括:
CUDA Programming、GPU Memory Hierarchy、Tensor Core、Nsight Systems、Nsight Compute
熟悉 NVIDIA Embedded GPU 平台,包括:
Jetson Orin、CUDA、cuDNN、TensorRT、Embedded AI Optimization
熟悉自动驾驶、大模型或具身智能相关技术,包括:
VLA(Vision-Language-Action)、VLM(Vision-Language Model)、End-to-End Driving、BEV、Multi-modal Fusion
有以下项目经验之一优先:
自动驾驶模型部署、机器人/具身智能系统、大模型推理优化、GPU Runtime 开发、AI Infra 开源项目
What You Will Gain
在这里你将有机会:
参与自动驾驶下一代 VLA / VLM 大模型上车落地
深入优化真实车载平台上的 大模型推理系统
参与从模型转换、Runtime优化到GPU Kernel加速的完整技术链路
深入掌握:
Transformer / Multimodal Model Optimization
TensorRT / CUDA Runtime
GPU Performance Optimization
Embedded AI System
与 GPU、AI Infra、自动驾驶算法团队协作,推动大模型从云端训练走向真实车辆部署
🏢 企业简介
总部苏州
投递方式
投递入口为会员专属,登录 / 注册 后查看(注册送 15 天免费试用)ℹ️ 信息来源
本条招聘信息由校招宝转载自 Moka 招聘系统(企业校招官网),版权归原发布方所有,校招宝仅作信息聚合与导航。
该来源未提供原文链接
招聘信息以官方原文为准,投递前请核实截止日期与要求。如涉侵权或信息有误,请邮件联系 kknee@qq.com,我们将在 24 小时内处理。