【工作职责】
Agent 核心架构建设:负责通用 Agent 框架的设计与研发,包括意图识别(Router)、任务编排(Planning)、工具调用(Function Calling)及多轮对话状态管理(Memory),构建支持高并发、低延迟的在线智能分发系统。
大模型调优与对齐:基于开源或自研基座模型,利用 SFT、RL 等技术进行垂直领域微调。增强模型的小红书风格化表达(社区感)、复杂指令遵循能力及工具调用准确率等。
垂类智能体落地:深入旅游、美妆、装修、法律等核心垂类,设计专有的 Workflow,打通笔记、商卡、POI 等结构化数据,提升用户从 搜索 到 决策 的转化效率。
评测与迭代体系:建设 Agent 自动化评测平台(LLM-as-a-Judge),制定涵盖准确性、相关性、有用性及安全性的多维评估指标,通过离线评测与在线 A/B 实验持续驱动效果优化。
【任职要求】
基础素质:计算机、人工智能等相关专业硕士及以上学历,具备扎实的机器学习/深度学习理论基础,精通 Python,熟练使用 PyTorch 等框架。
LLM 经验:深入理解 Transformer 架构,有大模型 Pre-training、SFT、RL 全流程实战经验。
业务落地能力:具备极强的工程落地能力,对数据有敏锐的洞察力,善于从海量非结构化数据(User Query, Notes, Comments)中挖掘价值。
加分项:
在 NeurIPS, ICML, ICLR, ACL 等顶会发表过高质量论文。
在 LLM 大家关注的 Benchmark 榜单有深入研究或优异表现。