【工作职责】
1. 架构设计:负责以下至少一个技术方向的软件架构设计与核心模块规划,包括AI编译器;AI加速器配套的Runtime、驱动与固件、AI开发、调试、运维一体化工具链
2. 关键技术攻关:针对以下一个或多个方向,开展前瞻性技术研究与工程实现,持续提升系统资源利用率与模型训练/推理效率,包括前端图优化与后端算子优化;指令生成、优化及转译技术;系统资源管理与调度策略;调试、调优与运维工具链等
3. 性能调优:基于性能分析工具,定位AI模型训练与推理中的性能瓶颈,从基础软件层面制定并实施优化方案,不断提升AI加速芯片整体性能与竞争力
4. 行业交流与影响力:代表公司参与国内外重要技术会议与学术研讨,主导或深度参与相关开源社区(如AI编译器方向)建设与贡献,提升公司在AI基础软件领域的技术影响力与品牌认知
【任职要求】
1. 核心技能:
(1)深入理解 GPU/NPU架构,熟悉SIMT/SIMD、张量核、内存层次结构
(2)精通C/C++,熟练应用Python ,能开发高性能代码生成后端
(3)在下列方向至少精通一项:
a. MLIR/LLVM 架构,能开发自定义Pass和Dialect;熟悉 XLA、TVM、IREE 等AI编译器生态
b. 分块/分片、访内优化、算子调度、循环优化等编译优化手段
c. AI 运行时,精通延迟(Latency)与吞吐(Throughput)权衡,能设计高并发低延迟服务
d. 驱动与固件,精通AI加速器的固件和驱动原理与核心流程
e. AI模型训练和推理过程的性能分析、调试和调优工具技术原理和核心流程
2. 经验要求:
本科及以上学历,5 年以上AI基础软件研发经验,曾主导过AI编译器、Runtime、驱动和固件或者开发运维工具项目或者其核心模块的研发,有实际产品落地经验。
有 RISC-V、ARM 或 X86 架构优化经验者优先。
3. 加分项:
(1)在LLVM(MLIR)、Triton、TileLang、Linux等相关领域的开源项目中有功能级贡献
(2)精通PyTorch、TensorFlow、Megatron、DeepSpeed、FasterTransformer等业界主流深度学习框架的内核
(3)具备 RISC-V 或自定义加速器经验
(4)在操作系统和AI基础软件领域发表过高水平研究论文或拥有相关技术专利