【工作职责】
1. 参与面向网络安全领域的垂直大模型交付工作,包括基于大模型做流程设计、agent优化和模型安全能力提升;
2. 负责对接阿里内部各个业务线的网络安全需求,包括情报安全、流量安全、数据安全等不同场景,构建高质量业务数据,优化交付流程;
3. 开展大模型全流程训练工作,包括预训练、CPT、SFT、GRPO及安全工具结合的Agentic RL;
4. 针对经典且依赖安全专家经验的的安全任务(如漏洞检测、流量情报分析、代码生成等)优化模型能力,提升其在真实攻防场景中的模型性能与鲁棒性;
5. 探索大模型在代码安全、漏洞挖掘、逆向工程等方向的应用,并推动技术成果落地与学术发表。
【任职要求】
1. 计算机、信息安全、人工智能或相关专业硕士及以上学历;
2. 具备扎实的大模型基础知识和训练经验,熟悉大模型的模型架构和改进方案,熟悉预训练、SFT、GRPO、PPO、Agentic RL 等主流训练范式,并有实际项目或研究经历;
3. 拥有网络安全领域知识基础,了解常见攻击手法、防御机制、日志分析或漏洞原理;
4. 动手能力强,熟练掌握基于 DeepSpeed/Megatron 的各种训练框架变体,具备大规模LLM训练调优能力;
5. 在AI或网络安全方向有科研产出,以主要作者身份在 NeurIPS、ICML、ICLR、ACL、IEEE S&P、USENIX Security、CCS、NDSS 等顶会发表过论文者优先。
加分项:
1. 有代码大模型(如 Qwen-Coder、CodeLlama、StarCoder 等)或者多模态模型训练经验者优先;
2. 参与过agent、workflaw全流程设计并有实际交付经验者优先;
3. 有大模型加速、量化、蒸馏、剪枝经验者优先