JobConnect

AI Infra 研发工程师(LLVM / 异构计算 / C++)

  • NIO
  • Shanghai, Shenzhen +2 more, China
  • CNY 400,000 – CNY 600,000

上海、深圳、合肥、杭州社招全职数字技术 - 芯片研发本科及以上1-3 年

职位描述

负责面向异构计算(GPU / AI 芯片)的编译技术研发,打造高性能代码生成与优化体系,释放芯片极致算力:

  1. 编译器基础建设:参与基于 LLVM / 开源框架的编译器中间表示(IR)、Pass 优化pipeline设计与开发;
  2. 代码生成与指令优化:参与针对目标硬件架构的代码生成、指令调度、寄存器分配及特定指令级性能调优;
  3. 计算图与算子优化:参与领域特定语言(DSL)或深度学习模型的图优化、算子融合与 Lowering 代码生成;
  4. 编译工具链与质量保障:参与编译器测试基准、正确性验证及回归测试体系建设,保障工具链稳定交付。

职位要求

  1. 计算机、微电子、电子工程、软件工程或相关专业本科及以上学历;
  2. 扎实的 C/C++ 编程能力,具备良好的代码风格与软工素养;
  3. 理解编译原理基本概念(如 AST、CFG 控制流图、IR 中间表示、数据流分析、常见优化算法等);
  4. 具备良好的问题分析与调试能力,对底层硬件体系结构、计算机系统或性能优化有浓厚兴趣。 满足以下条件优先
  5. 开源编译器经验:有 LLVM / GCC / Clang 等开源编译器的实际使用、Pass 开发、静态代码分析或二次开发经验;
  6. AI 编译与图优化经验:接触过 MLIR、TVM、Triton、TileLang、XLA、Torch-MLIR 等 AI 编译与算子生成框架;
  7. 后端与指令集经验:有 LLVM Backend、GCC 后端开发经验,或有 RISC-V / ARM / DSP / x86 等指令集代码生成与汇编优化经验;
  8. 异构计算与性能优化经验:熟悉 CUDA / OpenCL / HIP 编程,了解 GPU/NPU 内存层级(SRAM/Cache/DRAM)与并行优化策略;
  9. 高校/竞赛经历:在校期间参加过编译系统设计赛、体系结构设计赛,或在相关领域顶级会议/期刊有论文发表。

投递

Skills

  • C++
  • LLVM
  • Compiler Optimization
  • Code generation
  • Heterogeneous computing
  • CUDA
  • MLIR

Related jobs

NIOApply for this job