职位描述
我们坚信算法是供应链智能化的核心驱动力。团队深度融合机器学习、深度学习、强化学习、运筹优化、大规模仿真、大语言模型(LLM)与多模态大模型(VLM/MLLM)等前沿 AI 技术,在品类规划、需求预测、库存优化、订单履约、物流执行等供应链核心环节构建智能化算法体系,持续推动自动化、智能化升级,为业务创造可量化的效率提升与成本优化。
在 VLM / 多模态大模型方向,持续优化算法能力和壁垒,致力于构建业界领先的供应链多模态智能体系,基于视频-语言大模型(VLM)、图片/时序/语音-语言大模型(MMLM)解决电商供应链中商品理解、核价审核、虚假签收识别、商货品自动审核、纯新品销量预测等关键问题,持续提升审核效率与预测准确性并驱动业务损益改善。
岗位职责
1. 负责淘天海量供应链多模态数据(图像、文本、视频等)的分析与建模,覆盖商品理解、核价审核、虚假签收识别、单品自动审核、纯新品销量预测等端到端场景,持续提升供应链感知与决策效率;
2. 紧跟视觉-语言大模型(VLM/MLLM)前沿方向,参与供应链多模态智能体系的架构设计、训练范式优化与模型能力建设,构建多模态算法域深度技术壁垒;
3. 设计、研发并落地 VLM / 多模态大模型算法,综合运用计算机视觉、自然语言处理、多模态学习等方法,提升商品理解、图文对齐、OCR、文档理解等能力,推动可量化的业务价值;
4. 针对 Fashion88、淘工厂等行业特性,构建核价审核、虚假签收识别、单品自动审核、纯新品销量预测(图像+文本)等算法能力,支撑行业审核效率、预测准确率与损益等核心经营目标达成。
职位要求
1. 计算机科学、人工智能、机器学习、计算机视觉、自然语言处理等相关专业硕士或以上学历;
2. 熟练掌握 Python,熟悉 PyTorch/TensorFlow 等深度学习框架,具备大规模分布式训练、多模态模型微调与推理优化经验;熟悉 SQL、Spark/Hadoop/Flink 等大数据处理工具,能高效处理海量图文数据;
3. 扎实的多模态/视觉-语言模型基础,熟悉至少一类主流架构:CLIP、BLIP/BLIP-2、LLaVA、MiniGPT-4、Qwen-VL、GPT-4V/Claude 类多模态大模型等;
4. 熟悉视觉理解任务(图像分类、目标检测、图文检索、图像 caption、视觉问答、OCR、文档理解等)以及自然语言处理基础;具备电商、零售、供应链场景的多模态算法经验者优先;
5. 具备业务抽象与建模能力,能够将复杂的多模态业务问题转化为可训练、可评估的算法任务;具备商品理解、价格审核、图像搜索、同款识别、内容审核等相关经验者优先;
6. 有将复杂学术成果转化为工业级方案并在真实业务中规模化落地者优先;在顶级会议或期刊发表过计算机视觉、多模态学习、自然语言处理、机器学习相关论文者优先;
7. 热爱算法研发,具备 hands-on 能力,持续关注学术前沿;积极、乐观、向上、皮实,具有较好的团队合作精神,勇于面对挑战。