1.参与公司大模型(多模态/Agent)的架构设计、训练、评估与持续优化。
2.负责基础模型的微调(SFT/LoRA/RLHF/DPO 等)、效果调优,并对关键场景进行闭环打磨。
3.参与构建数据 pipeline,包括数据清洗、过滤、对齐、多源数据构建等。
4.与产品、业务团队协作,将大模型能力落地到具体产品中,如问答、对话、检索、企业服务等。
5.跟踪大模型最新研究进展,快速探索并推动前沿技术应用落地(如 MoE、RAG、LLM Agent、推理架构优化等)。
1.计算机、人工智能、数学等相关专业,硕士及博士以上优先,优秀本科也可。
2.深度熟练一类学习框架优先(PyTorch/DeepSpeed/Megatron/Lightning 等)。
3.有 NLP 或多模态方向经验,对 Transformer、LLM 训练流程有体系化理解。
4.具备数据处理、特征构建经验,对数据质量敏感,能独立搭建高质量数据集。
5.有开源项目经验、模型训练实战项目、竞赛经历者优先。