岗位名称
语言大模型技术研究和应用
工作内容
负责大模型方向技术的研究和应用,构建大规模智能系统,工作内容包括以下三方向:
1. 负责追踪大模型学术进展,预研前沿技术问题,打造行业领先技术影响力;
2. 负责根据业务场景,抽象技术问题,建立大模型智能体解决方案;
3. 负责将解决方案落地应用在具体业务场景,打造卓越的用户体验。
职位要求
1. 研究生及以上学历,发表过自然语言处理/大模型相关研究AI顶会论文优先;
2. 了解常用强化学习算法,如PPO、GRPO、DAPO等,熟悉常见的RL框架,如verl、openRLHF等;
3. 掌握NLP主流大模型,如GPT3/T5/PaLM/LLaMA/GLM等的原理,并对差异有深入的理解;
4. 熟练掌握主流深度学习框架pytorch,大模型训练框架Megatron-LM/Deepspeed等多机多卡方案,有大模型训练和项目经验优先;
5. 有良好的代码开发能力,有开源项目开发经验优先。
工作地点
小米武汉总部
联系方式
联系人:李超
电话(同微信):13995510990
投递地址
· 校招投递:https://xiaomi.jobs.f.mioffice.cn/s/zgST7acIowo
· 实习投递:https://xiaomi.jobs.f.mioffice.cn/s/OLHqnADesoU