职位描述
1. 多模态大模型训练与优化。围绕文本、图像等多模态数据,构建面向安全领域的垂直大模型,推动在内容理解、风险识别等场景的落地应用。
2. 模型架构设计与迭代。基于现有大模型底座,进行模型结构优化、训练策略设计及效果调优,提升模型在实际业务中的泛化能力与推理效率。
3. 数据处理与标注体系建设。构建高质量的多模态训练数据集,设计合理的标注流程与标准,支撑模型训练与评估。
4. 联合业务方推进模型部署与应用。与产品、工程团队紧密协作,完成模型从训练到上线的全流程闭环,并持续跟踪效果与优化。
5. Agentic AI训练。与已有Agent系统联动,构造高吞吐,可调用外部信息的,可训练的大模型系统。
职位要求
1. 硕士及以上学历,计算机、人工智能、电子信息等相关专业优先;
2. 2年以上算法相关工作经验,具备多模态模型训练或大模型研发经验者优先;
3. 熟悉Python编程语言,掌握TensorFlow/PyTorch等主流深度学习框架之一;
4. 具备良好的算法基础和工程实现能力,熟悉图像、文本等多模态数据处理方法;
5. 对AI前沿技术有持续关注,具备较强的问题分析与解决能力;
6. 良好的沟通能力和团队协作意识,能够跨团队推动项目落地。
加分项:
1. 有大规模多模态模型训练经验者优先;
2. 熟悉模型压缩、推理加速等相关技术者优先;
3. 在CV/NLP顶会(如ICCV、ACL)发表论文或参与过相关竞赛获奖者优先。
4. 有过Agent/Agentic AI开发经验优先。