1、负责汽车行业领域大模型的质量保障工作,其中包含软件的需求分析、模型评测、效果评估等,支持行业内的工程化落地;
2、负责汽车行业领域大模型的测试基建、评测体系的建设,提升业务评测效率和质量;
3、负责大模型业务测试数据的分析和统计,对模型结果、过程数据进行分析、提取、统计;
4、根据产品设计制定测试计划、风险评估、设计测试数据和测试用例,执行测试用例,进行Bug追踪等;
5、对大模型以及相关方向(如NLP、CV、多模态等)的前沿技术、评测体系进行持续跟踪和调研。
1、本科及以上学历,计算机、通信、统计等相关专业三年以上测试或开发工作经验;
2、熟悉NLP、深度学习、生成式语言大模型等基本原理和技术,熟悉常见的评测指标、效果评估方法;
3、熟悉掌握Python/Shell等语言中的一门或者多门;
4、具有良好的沟通能力和团队合作精神、快速的学习能力,具备一定的抗压能力和强烈的责任心;
5、有过AI类产品的质量保障工作经历或算法评测经验或有汽车行业相关经验、ToB交付业务经验最佳。