【工作职责】
1. 负责文生图(Text-to-Image)生成算法的研发与优化,包括中文场景下图像生成质量提升、多模态对齐、可控性生成等方向;
2. 图文融合的排版生成技术研发,构建和优化多模态联合训练模型,实现自动化、智能化的视觉内容布局生成(如杂志、UI界面等);
3. 结合各业务场景下相关技术问题进行分析、算法设计,推动算法在工业级场景的部署与应用,沉淀在业界有影响力工作;
【任职要求】
1. 计算机、数学、自动化、控制等相关专业;
2. 扎实的数学和算法基础:概率统计、数值优化等算法;
3. 扎实的编程基础:熟悉Pytorch、TensorFlow、MXNet等其中的一种或以上;
4. 了解前沿的Diffusion、LLM、VLLM算法,包括不限于StableDiffusion、Flux、Llama、QwenVL等;
5. 关注多模态生成领域的业界最新动态,如Midjourney、Runway、Recraft、可灵、即梦等;
6. 在CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、AAAI、ACL、EMNLP等顶级学术会议上发表论文者优先;
7. 有图文排版预估生成、中文场景文生图相关经验优先。