AI Runtime工程师
- NIO
- Shanghai, Hefei, China
- CNY 500,000 – CNY 900,000
上海、合肥社招全职数字技术 - 算法本科及以上3-5 年
职位描述
负责开发深度学习AI模型的runtime软件,完成计算资源调度、内存管理、host-device并行优化工作。 1,分析和解决KMD/UMD的功能、性能和稳定性问题,确保高质量交付AI系统的运行时软件; 2,与编译器、驱动工程师协同提供定制优化项和编程api; 3,参与故障检测和恢复机制设计,保证AI系统的可靠性; 4,参与Profiling工具设计,保证AI系统的性能可视化和瓶颈定位; 5,持续改进通信和调度机制, 与业务团队协作完成多模型部署,提高芯片的综合计算效率和系统吞吐量;
职位要求
1,计算机、通信或者电子相关专业,本科及以上学历,有AI芯片系统软件开发或验证经验者优先; 2,熟悉NPU/GPGPU体系结构,深入理解ROCm/Cuda Runtime项目; 满足以下条件优先: 1,熟悉AI系统的运行时开发; 2,熟悉集群通信的原理和实现,包括MPI,NCCL等通信库。 熟悉AI推理引擎运行机制,理解Pytorch Aten,Executorch,TVM Runtime
投递
Skills
- C++
- CUDA
- ROCm
- AI Runtime
- NPU/GPU Architecture
- Performance Optimization
- NCCL/MPI


