AI Infra 测试工程师
- NIO
- Shanghai, Shenzhen +2 more, China
- CNY 300,000 – CNY 500,000
上海、深圳、合肥、杭州社招全职数字技术 - 芯片研发本科及以上1-3 年
职位描述
职位描述 负责 AI Infra 软件栈的功能、精度、性能及稳定性测试,覆盖从 AI 算子、Runtime、 AI 推理引擎到及大模型应用的完整技术链路,建设高质量、自动化、可持续演进的测试体系:
- AI 算子与 Runtime 测试:负责 AI 算子及 Runtime 的功能、精度、性能和稳定性测试,覆盖算子计算逻辑、数据类型、边界场景、异常场景及多卡并行等测试;
- AI 推理引擎测试:参与大模型推理引擎(如 vLLM / TensorRT-LLM / SGLang 或自研引擎)、推理引擎的功能、精度、性能和兼容性测试,覆盖计算图优化、算子融合、内存管理、代码生成及 Runtime 执行等关键环节;
- 大模型测试与质量保障:负责大模型及多模态模型的功能、精度和性能测试,覆盖模型推理、量化、多卡并行、长上下文、KV Cache 等典型场景,建立模型端到端测试与质量评估体系;
- 自动化测试体系建设:基于 Python/PyTest 等技术设计、开发和维护自动化测试框架及测试用例,持续提升测试覆盖率、执行效率和问题发现能力;
- 性能分析与问题定位:针对算子、Runtime、编译器及推理引擎的性能问题进行分析,结合 Profiling、Tracing、GDB 等工具定位性能瓶颈和功能问题,并协助研发完成问题复现、定位及闭环;
- CI 与测试基础设施:负责 CI 测试环境、自动化流水线及测试任务的维护和优化,推动测试流程标准化、自动化和持续集成,保障 AI Infra 软件版本的稳定交付。
职位要求
- 计算机、软件工程、人工智能、电子信息、微电子等相关专业本科及以上学历;
- 熟练掌握 Python、PyTest、Shell 及常用 Linux 命令,具备独立开发和维护自动化测试框架、测试脚本及测试用例的能力;
- 了解 AI Infra 基本技术原理,熟悉 AI 算子、深度学习框架、Runtime、推理引擎或 AI 编译器中的一种或多种;
- 了解 Transformer、CNN 等主流模型及基本推理流程,理解算子计算、显存/内存管理、模型量化及多卡并行等基本概念;
- 具备较好的问题分析、调试和定位能力,能够从测试现象出发分析问题并协助研发快速定位根因;
- 熟悉软件测试流程和常用测试方法,具备测试方案设计、测试用例设计、测试报告及质量分析能力;
- 具备良好的工程意识、责任心、学习能力和团队协作能力。 以下经验优先
- 有 AI 芯片、AI 算子、Runtime、推理引擎或 AI 编译器测试经验;
- 有 vLLM、SGLang、TensorRT-LLM、PyTorch 等深度学习/推理框架使用或测试经验;
- 有大模型/多模态模型的功能、精度、性能或稳定性测试经验;
- 有多卡并行、集合通信、模型量化(FP8/INT8/INT4 等)或分布式推理测试经验;
- 熟悉 LLVM / GCC / Clang 等编译器,或具有 C/C++、GDB、编译原理、IR/代码生成等相关经验;
- 熟悉 Profiling/Tracing 等性能分析工具,具备端到端性能分析经验;
- 有 AI Agent 相关测试或工程实践经验。
投递
Skills
- Python
- Pytest
- AI Inference Engine Testing
- Performance profiling
- Linux
- CI/CD
- Deep Learning Frameworks







